WorkBuddy搭建个人知识库教程:Obsidian增量维护与溯源

用 WorkBuddy 配合 Obsidian,搭建可增量维护的个人知识库:三层目录、AGENTS.md 规则、入库提示词和冲突溯源。
2026-09-16 04:40浏览 5

WorkBuddy 搭建个人知识库的核心思路是:让 AI 维护一套本地 Markdown 体系,而不是继续往文件夹里堆剪藏。新资料进入后,WorkBuddy 先查旧知识,已有主题就增量补充,缺概念才新建页面,重要结论附上原文路径。工具准备只需 Obsidian 和 WorkBuddy;用 Codex 等支持本地读写的工具,逻辑也相通。

自生长知识库和普通笔记库的区别

普通知识库更像资料中转站:同一主题存几十篇,得到几十个孤立 Markdown,新旧观点不对照,过时信息也不覆盖。自生长知识库的重点是知识融合。

维度普通知识库自生长知识库
新资料处理新建独立文件先遍历旧知识,增量补充
页面关系彼此孤立同主题合并,冲突保留来源
原文处理容易混在一起raw 只读,wiki 提炼
检索与追踪碎片多,难定位结论index 索引 + log 变更记录

工具准备:Obsidian 管存储,WorkBuddy 管维护

  • Obsidian:本地保存和浏览 Markdown,双链、图谱成熟,数据在本地,不依赖服务商长期存续。
  • WorkBuddy:读取新资料、提炼重点、和旧知识交叉对比,然后增量写入。
  • Codex 等支持本地读写工具可按同样思路执行,发布前需核验具体兼容范围。

WorkBuddy搭建个人知识库教程:初始化目录与 AGENTS.md

  1. 打开 Obsidian,新建一个空的本地仓库,例如 MyKnowledge。先不要在 Obsidian 里手动建文件夹。
  2. 打开 WorkBuddy,点击“打开本地文件夹”,选中该空目录,让它列出当前目录,确认目录干净。
  3. 让 WorkBuddy 初始化三层目录:raw/ 存原始文章、剪藏网页、会议记录,只读;wiki/ 存 AI 提炼的结构化知识;output/ 存临时报告、大纲、阶段性分析。
  4. 把维护规则写入根目录 AGENTS.md。初始化要求可以概括为:raw 不改原文;wiki 增量维护,处理前先读 wiki/index.md 并搜索相关页面;已有主题补充,没有合适页面再新建;重要结论标注 raw 文件路径;来源说法冲突时同时保留;每次处理后更新 index.mdlog.md;先建目录和规则,不处理现有文件。
  5. 执行后检查三个目录是否建好,并打开 AGENTS.md 确认规则。它是后续 AI 操作的约束文件。

目录层次越深,AI 维护越容易迷路,所以只分三层。

首次入库:只放一篇资料

规则就位后,挑一篇最近想消化的长文或技术资料,用浏览器剪藏插件转成 Markdown,放入 raw/。第一次测试只放一篇,便于观察 AI 改了哪些文件。

给 WorkBuddy 的入库要求可以写成:读取 raw 中新加入的资料,按 AGENTS.md 增量维护 wiki;先查已有相关页面,再决定更新还是新建;完成后更新 index.mdlog.md,并报告新增、修改、冲突和不确定内容。

执行后检查:raw/ 原文应保持不动,wiki/ 下出现结构化概念页,index.md 刷新,log.md 记录本次变动。

验证增量演进:第二篇同主题资料

找一篇同主题但观点不同或视角不同的文章,放入 raw/,再次发送入库要求。重点观察两件事:

  1. 旧概念页面是否在原页面上融合新内容,而不是新建重名文件。
  2. 核心结论后是否同时附带指向两篇原文的文件路径;遇到冲突观点,是否客观保留双方说法。

两项都符合,说明知识融合机制跑通。否则它仍只是静态网盘。

进阶方案:提示词直建法 vs claude-obsidian

方案适用场景操作要点
提示词直建法新手、日常阅读笔记、刚开始尝试 AI 知识管理手动建三层目录和 AGENTS.md,轻量、容易掌控
claude-obsidian数万字以上的复杂项目文档或行业知识库新建运行 init,已有库运行 adopt 接管;入库用 wiki-ingest,问答溯源用 wiki-query,检查孤立页面和失效链接用 wiki-lint

资料量很大、需要更严密工程化流程时,可接入开源 claude-obsidian。它把规则、检索脚本和一致性校验器封装成工作流,适合长期维护。

维护自检清单

  1. 原文和提炼页面是否彻底隔离。raw 负责真实存档,wiki 负责知识沉淀,不改原始文件。
  2. 关键事实能否溯源。wiki 核心论断要带来源文件相对路径。
  3. 相同主题是否合并。新资料优先补充旧主题,避免重复建页形成信息孤岛。
  4. 变更日记是否清晰。每次入库后 log.md 有变动记录,方便回溯。
  5. 索引是否同步。index.md 随时反映最新知识全貌。

资料存得再多,不产生连接就只是占空间。让每次输入都参与旧知识对照、增量迭代,才能把碎片信息变成可长期使用的第二大脑。