让一个 Obsidian 研究系统替你读完这周的资料

Yaqin Hei··15分钟阅读
中文EN
让一个 Obsidian 研究系统替你读完这周的资料

原作者 @cyrilXBT,据其公开内容,长期在海外技术社区分享 Claude + Obsidian 的一线工作流搭建(不做职务背书,只说能确认的)。这类「把 agent 接到自己 vault 上」的方案近一年在海外 AI 工程圈被反复讨论和改编。中文编译、结构重排与 5 张配图本地化:Yaqin Hei(非原创,已保留原文出处)。

译者的话:这是「第二大脑」的下半场

上个月译过一篇 用 Fable 5 搭一个第二大脑,它解决的是知识怎么存、怎么连——raw/ 存原始档、agent 编译成互相链接的 wiki、越长越强。那篇的地基不用重搭,这篇是接着往下的一层:东西存进去之后,谁来治理它。

因为知识库真正的坑不是查不到,是查到了一条你三个月前深信、现在已经不成立的结论——而它在库里看起来和其他条目一样可信,还带着来源链接。它不会自己举手说「我过期了」。你越是把提炼交给 agent,这种「安静地错着」的条目就积得越快,因为每一条都长得像一条正常笔记。

这篇给出的解法,我认为是全篇最值钱的一句话:agent 发现新材料和旧笔记打架时,不许自动裁决,必须在两边都留下标记,然后停下来等人。 它直接改了我一个默认动作——以前我让 agent「更新知识库」,潜台词是让它自己判断谁对;现在我让它在冲突处停手并双向标记。因为「哪个对」往往取决于上下文(有时两个都对,只是场景不同),这个判断一旦被自动化掉,你就永远失去了「意识到自己想法变了」的那个瞬间——而那个瞬间恰恰是这套系统唯一不可替代的产出。

再加一条上一篇的延伸:别把高频提炼派给最贵的模型。 这套流水线每周要跑几十次提炼和交叉比对,是典型的量大活;稀有的、错了有代价的硬综合才值得升档。

下周就能用的三样:questions/ 文件夹(读到但没解决的问题单独存,不许 agent 猜)、周报只读最近 7 天、周报硬性压到 500 字。

以下是正文

研究工作里的大部分时间并不花在思考上。它花在读、提炼、交叉比对——一次一份资料,手工推进,而这些小时本该留给真正的思考。

Opus 5 改变了这道算术题,原因在于它被造出来是干什么的。Anthropic 给它的定价和 Opus 4.8 完全一致(每百万 token 输入 5 美元、输出 25 美元),而在 Frontier-Bench v0.1 上的成绩是 Opus 4.8 的两倍多。它被明确定位成「不是最聪明的那个」——那仍然是 Fable 5——而是为高频日常使用而造的那个:效率在成千上万次调用里累积出来的差距,是单条 benchmark 标题永远显示不出来的。法律 AI 公司 Harvey 独立报告称,在匹配 Opus 4.8 最高推理档产出质量的同时,平均少用 26% 的 token。

译注:Frontier-Bench v0.1 上 Opus 5 为 43.3%(max effort),Opus 4.8 为 18.7%;Fable 5 每百万 token 输入 10 美元、输出 50 美元,正好是 Opus 5 的两倍。

这个效率画像,恰好就是研究流水线需要的东西。你不是在跑一次昂贵的深挖,你是在一批持续变大的资料上,每周跑几十趟提炼和综合——如果用的不是为量而造的模型,单趟成本会飞快地滚起来。

这就是完整的系统:Obsidian 当永久存储,Opus 5 当处理引擎,中间一条特定的流水线,把生料自动变成互相链接、可被追问的知识——于是你过去花在手工提炼和交叉比对上的小时,还给你。

为什么是 Opus 5,不是 Fable 5

动手之前,值得把模型选择这件事说清楚,因为选错档是这类系统最常见的超支方式

一条每周吞资料的研究流水线,会产生大量独立调用:每份新材料一次提炼、对着已有笔记一次交叉比对、周期性的综合、周报生成。这是量大活,不是单发深活。Opus 5 的整个定位就是围着这个画像造的——同价位下 Frontier-Bench 成绩翻倍,加上 Harvey 在重复形态任务上独立验证到的 token 效率。

Fable 5 仍然是那些真正最硬的单个研究问题的更好选择:微妙的、高风险的综合,一个细微判断错了会有真实后果,它更深的推理值那大约两倍的单价。而对于搭建和维护这套系统的日常重复劳动——每周入库、持续提炼、周报生成——Opus 5 的效率优先设计才是正确默认值,把 Fable 5 留给系统自己标出来「这个值得额外审视」的那种偶发深挖。

四个文件夹

系统需要一个能永远活下去、完全属于你、不依赖任何单一模型或厂商的地方来存知识。Obsidian vault 里的纯 markdown 文件正好做到这点:明年出了更好的模型,你把它指向同一个文件夹,别的什么都不用变。

上一篇已经讲透了 raw/ 和编译层的逻辑,这里只说研究系统特有的四块:

  • raw/: 原封不动的原始材料——PDF、文章正文、视频转录,不加工。
  • wiki/: 加工过、互相链接、永久的知识版本,按主题组织,而不是按来源
  • questions/: 研究系统特有。存放你的阅读翻出来、但还没解决的开放问题——这样真正重要的东西不会在加工过程里被弄丢。
  • digests/: 存放 Opus 5 生成的周报,带时间戳——于是你回看任何一周「什么是重要的」时,不必把那周的东西重读一遍。

根目录一个 CLAUDE.md,定义这套系统该怎么运转。

Vault 四块结构:raw / wiki / questions / digests + 根目录协议

四个文件夹各有分工。questions/digests/ 是研究系统相对通用第二大脑多出来的两块——一个接住没解决的问题,一个接住「这周到底发生了什么」。

跑起整套系统的那个 CLAUDE.md

这是全套配置里杠杆最高的一个文件,因为它是 Opus 5 每次会话开头自动读的东西——意味着你把指令写一次,而不是每次用都把系统重讲一遍。

# 研究系统协议

本 vault 是一套研究系统。

结构:
/raw       - 原封不动的原始材料,永不编辑
/wiki      - 加工过、互相链接、按主题组织的知识
/questions - 尚未解决的开放问题
/digests   - 带时间戳的周报

当 /raw 里出现新材料:
1. 提炼出具体的、真正新的论断与发现,而不是整份文档的摘要。
2. 到 /wiki 检查同主题是否已有笔记。已有就扩写它,不要新建重复页。
3. 用 [[wikilinks]] 把每一条新论断连到相关的已有笔记上。
4. 若某条论断与 /wiki 里已有的内容矛盾,不许静默覆盖。
   在两边的笔记里都显式标出这处矛盾。
5. 若某份材料提出了一个真正的开放问题,且无法用 vault 里已有的
   其他材料解决,把它加进 /questions,而不是猜一个答案。

当被要求综合或生成周报:
从 /wiki 取材,不要直接从 /raw 取。wiki 是加工过的、可信的那一层。
原始材料可能包含后来被发现是错的、或已被取代的论断——
这正是上面第 4 条存在的理由。

在把任何一次提炼报告为「已完成」之前,
确认你**确实**去 /wiki 查过相关的已有笔记,
而不是默认这批全是新材料。

就是这一个文件,划开了「一堆互不相干的笔记」和「一套真正的系统」。里面每一条指令的存在,都是为了挡住一个具体的、真实发生过的失效模式——重复页、被静默覆盖的矛盾、悄悄丢掉的未解问题——否则它们会在几个月的使用里不声不响地堆起来。

入库流水线

vault 结构搭好、协议写完,下面是实际的每周动作。

随手往 raw/ 里丢。 一周里遇到什么丢什么:读到的文章、一篇论文、播客转录、视频转录、竞品的博客。这一步应该是秒级的,不是分钟级的——重点就是把捕获这件事的摩擦降到零,你才会真的持续做。

raw/ 里还没处理的新文件入库。 每一份:提炼真正新的论断、去 wiki/ 查相关已有笔记、按情况扩写或新建、标出与已记录内容的任何矛盾。解决不了的问题加进 questions/,不要猜。

节奏按你真实的阅读模式来:读得多就每天跑,输入零散就隔几天跑。关键是加工发生在离捕获不远的时候。而把十份材料一次拆成一趟趟独立的提炼和交叉比对,正是 Opus 5 的效率画像所针对的那种重复同形状的活。

入库五条规则:提炼 → 查重 → 连线 → 标矛盾 → 存问题

五条规则里,第 4 条(矛盾不许静默覆盖)和第 5 条(不许猜答案)是这套系统区别于「一堆 AI 生成笔记」的地方——它们都把判断权交回给人。

自动化的周报

这是时间节省最肉眼可见的地方,而且值得排成定时任务,而不是「你记得跑」的东西——整套系统的意义就是把机械部分里的你摘出来。

生成本周研究周报。

从 /wiki 取材,只聚焦最近 7 天新增或更新的内容,
不要覆盖整个 vault 的历史。

结构:
1. 本周最重要的 3 到 5 条新发现,附 /wiki 里完整笔记的链接。
2. 本周被标记出来的、新材料与已有笔记之间的任何矛盾——
   这些值得你亲自过目。
3. 本周加进 /questions、且仍未解决的开放问题。
4. 一行:指出本周活动异常密集的主题。某个主题短时间内
   迅速积累起大量相关笔记,通常意味着它值得你有意识地深挖,
   而不是被动堆着。

结果存进 /digests,以本周日期命名。
整份周报控制在 500 字以内。
它是通往完整笔记的指针,不是笔记的替代品。

把它排成每周开头自动跑,于是在你亲手打开任何一篇笔记之前,一份简短、结构化的「这周什么重要」已经在等你了。

这就是「替你读完这周资料」的具体机制: 你不再为了想起自己学过什么而把一周的生料重读一遍,你读的是一份两分钟的 500 字指针——而等价的手工回顾要花掉两小时。

周报解剖:四段结构 + 500 字上限 + 只读最近 7 天

三个约束缺一不可:只读最近 7 天(否则越写越长)、限 500 字(它是指针不是替代品)、排程自动跑(否则你会忘)。

追问整个库,而不是只追问你记得的部分

除了周报之外的另一大块时间节省,是能够对着你积累的全部知识提一个真问题,而不是费劲回忆到底哪篇笔记里有答案。

基于 /wiki 里的全部内容,关于 [某个具体主题] 我都学到了什么?
标明每一条论断出自哪篇笔记。
如果 vault 里的材料在这个主题上彼此不一致,
明确说出来,而不是挑一个当作共识呈现。

这是随系统运行时间复利最久的那部分回报。第一个月,你的 wiki 还很薄,这类追问只翻回来几篇笔记。第六个月,几十份材料被加工并交叉链接之后,同一个追问会浮出你手工绝不可能建立的连接——第二周读的一篇论文里的想法,直接接上了第二十周一份完全不相干的材料里的东西,因为两者被归到了同一个底层主题下,并据此连了线。

诚实地处理矛盾

这套系统相较于「凭记忆重读自己的笔记」有一个被严重低估的价值:它会主动浮现出你对某件事的理解已经变了,而不是任由一个过时的信念安静地待着——只因为你忘了自己曾经那样想过。

当入库协议标出一处矛盾——新材料说的和已有笔记声称的不一致——忍住那个「让系统挑一个看起来更新或更权威的,悄悄帮你解决掉」的本能。

浮现矛盾的价值,恰恰在于它逼出你的一次真实决策:是早先那份材料错了?是底层现实真的变了?还是两者都对、只是取决于某个需要补进笔记的上下文?

把这个判断自动化掉,就等于废掉了「搭一套让自己的思考随时间变得更严谨的系统」这件事本身的目的。

一个月的实际推演

把复利效应说具体一点,这是真实使用一个月大致会发生的事。

第一周,你丢进六篇跟手上项目相关的文章。入库跑完在 wiki/ 里建了八篇新笔记(有些文章触及多个不同主题),凡有真实关联的地方都互相连了线。周报很短,因为还没有多少既往材料可供交叉比对。

第二周,你又加了四份材料。其中两份扩写了第一周的已有笔记而不是新建,因为入库协议正确识别出了主题重叠。有一份触发了矛盾标记——第二周某份材料直接反驳了第一周某份材料言之凿凿的说法。周报把这处矛盾醒目地浮了出来,而你回看时意识到:第一周那份材料用的是过时数据。你直接更新那篇笔记,并记下这次修正以及为什么。

第三、四周延续同样的模式。到月末,对着这个主题的一次完整追问,返回的综合会回放出你理解本身的演化路径,包括那次修正——而不是一张「仿佛你第一天就知道正确答案」的静态快照。

这就是这套系统真正的价值主张,说得再具体一点:它不替你思考,它只是把过去每周都在和你真正的思考时间抢地盘的那些机械开销——提炼、交叉比对、想起自己已经知道什么——拿掉了。

四个常见的做废方式

做废方式后果
跳过 CLAUDE.md 协议,直接往 raw 里丢文件,指望 Opus 5 自己悟出正确行为缺了显式指令——尤其是「先查重再新建」和「矛盾只标记不覆盖」这两条——系统会退化成它本来要避免的那堆无结构 AI 笔记
周报对着整个 vault 跑,而不是这一周的活动周报每周变长、每周变没用,因为它在反复摘要你早已读过并加工过的材料,而不是只浮现真正新的东西
把 Opus 5 的综合当成自动正确,而不是一个起点它在做真实的认知劳动,和任何认知劳动一样,它受益于你的复核——尤其是它标出来的那些矛盾,那正是你的判断增值最多的时刻
出于习惯用 Fable 5 跑日常每周处理,以为贵的总是更安全对这套系统每周产生的重复同形状提炼与综合,Opus 5 的效率画像更合适,成本差在连续几个月里会明显累积。把 Fable 5 专门留给系统自己标出「值得额外审视」的那种罕见硬综合

直接连上 vault,而不是复制粘贴

上面所有东西,在你手动打开 Claude、把文件内容粘进去的情况下都成立;但真正无摩擦的版本,是把 Opus 5 直接连到你的 Obsidian vault,于是入库和追问全程不需要任何复制粘贴。

实际路径用 Obsidian 的 Local REST API 插件(在社区插件设置里启用),它会把你的 vault 通过一个本地 API 端点暴露出来,并带一个认证 key。Claude Code 或 Claude Desktop 的 MCP 连接随后就能直接读写 vault 里的文件——意味着前面那些入库 prompt 是跑在你真实的 vault 上、创建和编辑真实的笔记,而不是你在聊天窗和笔记之间来回搬内容。

配一次就够:

  1. 在 Obsidian 里安装并启用 Local REST API 插件,复制它生成的 API key。
  2. 在 Claude Code 里配一个指向你 vault 的 MCP 连接,用上那个 key。
  3. 让 Claude 列一下 raw/ 文件夹里的文件来测试——如果返回的列表是准确的,连接就通了。

这一步跑通之后,前面整条入库和周报流水线,就从一个手工复制粘贴过程变成了你发一条消息就触发的东西;而这也正是让排程真正自动化的前提——一个定时任务可以在你完全不在场的情况下调用同一个 MCP 连接。

多主题:分文件夹还是分 vault

上面全部假设一个 vault 一个研究主题。而认真跑这套系统的人,多数最后会同时追好几个不同领域:一个具体项目、一个你泛泛关注的行业、一个跟前两者都无关的长期兴趣。把它们混进一个不分家的 wiki,制造出的正是这套系统本来要防的那种噪音。

修法沿用同一套作用域纪律:给每个真正独立的研究主题自己的子文件夹结构;如果两个主题大到、且不相关到「交叉污染会主动搞乱综合」的程度——比如某个行业的一条论断仅仅因为和某个项目住在同一个不分家的 wiki/ 里就被错误地交叉引用了——那就干脆各给一个独立的 vault。

# 多主题作用域

本 vault 覆盖多个研究领域,每个在 /wiki 下有自己的顶层文件夹:
/wiki/topic-a、/wiki/topic-b,等等。

入库新材料时,先判定它属于哪个主题。
如果它确实横跨两个主题,显式记下这处跨主题连接,
而不是没有说明地含糊归进其中一个文件夹。

周报按主题分别生成,不合成一份,
除非被明确要求跨主题综合。

这个结构让每个主题各自独立复利——各自的 wiki、各自自洽的交叉引用集合——同时你仍然可以在两个领域之间确实存在值得浮现的真实连接时,显式要求一次跨主题综合;而不是让每一篇笔记都在一个不分家的大堆里,和无关材料隐性竞争相关性。

什么时候该彻底分 vault、什么时候子文件夹就够,有一条实用判据: 如果你绝不希望对一个主题的追问意外翻出另一个主题的无关材料,那么分 vault 值得那点来回切换的开销。如果主题之间的一些互相授粉其实是有价值的——比如一条行业大趋势能启发一个具体项目——那么一个 vault 里分子文件夹能保住这层连接组织,而上面那条显式主题定界的指令会防住日常入库时的实际混淆。

分文件夹还是分 vault:一条判据

判据只有一条:你希不希望两个主题之间有互相授粉。希望 → 一个 vault 分子文件夹;完全不希望 → 分开的 vault。

它到底有没有替你省下时间

这类系统很容易「感觉」很高效,却从来没有对着它本来要替代的那件事被真正度量过。值得周期性地做一次诚实检查,而不是因为系统存在、并且按时在跑,就默认时间省下来了。

建好后的两三周里,粗略记一下:你过去那套手工流程下,周一的回顾要花多久——把存下来的东西重读一遍、试着回忆什么跟什么有关、翻找一条你知道自己在哪读过的具体事实。诚实地对比一下,现在读那份生成的周报、外加跟进它标出来需要你注意的东西,要花多久。

但真正要紧的对比不是周报本身省下的时间——500 字的摘要读起来当然比一周的生料快。要紧的是周报有没有真的把重要的东西浮出来:也就是,你有没有在几天之后才另行发现,某件重要的事被埋在生料里,从来没进过任何一篇笔记、也没进过任何一份周报。如果这种情况反复发生,那么该收紧的是入库协议的提炼这一步,而不一定是把你的手工阅读时间再加回来当补丁。

另一个值得记的诚实指标,是「追问」这个能力有没有被真正用起来。 一套周报干净漂亮、你却从不真的拿它做交叉引用追问的系统,只交付了它意图价值的一半——被动摘要的那一半,而缺了主动的那一半:「关于这件事,我在喂进去的所有材料里到底学到了什么」。而真正的复利价值恰恰住在后一半。如果你注意到自己不追问了,那通常有两种意思:要么是 wiki 还没积累到足够的交叉链接、追问还不值当(头一两个月这很正常),要么是你单纯地掉出了「提问」这个习惯——那值得刻意纠正回来。

这周就动手

别想一口气把整条流水线搭完。按「每一块先自己证明自己」的顺序来。

  • 第一周: 只搭 vault 结构和 CLAUDE.md,然后对着你手上已经在读的东西手动跑入库 prompt。在自动化任何东西之前,先对提炼质量有手感。
  • 第二周: 加上周报生成,一开始也手动跑,好让你验证它确实是在拉取正确那一周的活动、并且保持在该有的简短程度。
  • 第三周: 两块都稳定跑通之后,把入库和周报都排上自动执行,让系统真正做到不靠你记得触发。

到第四、五周,你应该能察觉到这套系统本来要造出的那个转变:过去要靠回忆「上周我读了什么、学到了什么」来开始的周一早晨,现在从一份两分钟的周报开始——那份回忆已经替你做完了;而过去花在手工重读和交叉比对自己研究上的那些小时,腾给了研究里真正需要人的那部分:判断什么重要,以及为什么。


原文:@cyrilXBT《How to Build an Opus 5 + Obsidian Research System That Replaces Hours of Manual Reading Every Week》。中文编译与配图本地化:Yaqin Hei。

Subscribe for updates

Get the latest AI engineering posts delivered to your inbox.

评论