AI 进入本地知识库后,最先需要的不是更多插件,而是明确的范围、入口和不可修改区域。本文用 00-收件箱、索引文件、CLAUDE.md 和 AGENTS.md 组成最小规则层,说明如何让 AI 先读状态、只处理授权目录,并为每次整理留下可复核的变更记录。文中只讨论可复现的步骤,不把单次结果扩展成产品承诺;每个结论都标注前提、证据和无法覆盖的边界。读者可以先完成最小验证,再按自己的版本、权限和数据补充实验。
前面我们已经把 Obsidian 装好,装了 Editing Toolbar、Diagrams、Excalidraw,也把网页剪藏、同步和 Claudian 接上了。
但工具接上以后,还有一个更现实的问题:AI 进到 Vault 里,到底应该先看什么?哪些文件可以整理?哪些文件不能碰?一篇刚剪进来的文章,什么时候才算进入知识库?
如果这些约定只存在你的脑子里,每次对话都要重新解释一遍。今天说“只整理收件箱”,明天忘了补范围,AI 就可能把临时笔记、正式文章和配置文件混在一起处理。
这篇要搭的是一个很小、但很有用的规则层。它常被一些工作流文章称作“卡帕西知识库”,这里不要把它理解成 Obsidian 的官方功能,也不要把它理解成某个插件。它本质上是一种本地 Markdown 知识库方法:用收件箱接住资料,用索引说明文件位置,再用规则文件告诉 AI 该怎么工作。
一、卡帕西知识库到底是什么
先看最小结构:
AI产品知识库/
├─ 00-收件箱/
├─ 00-索引.md
├─ CLAUDE.md
└─ AGENTS.md
四个入口各自负责一件事:
| 文件或目录 | 作用 | 是否适合放原始资料 |
|---|---|---|
00-收件箱 |
接收网页剪藏、临时想法、待整理文件 | 是 |
00-索引.md |
记录重要目录、笔记和当前状态 | 否 |
CLAUDE.md |
给 Claude 类工具看的工作说明 | 否 |
AGENTS.md |
给进入这个 Vault 的 AI 工具看的通用规则 | 否 |
这四个入口解决的是“AI 如何进入知识库”的问题,不是替你完成全部知识管理。
它不会自动保证摘要正确,也不会自动判断一篇文章是否值得收藏。AI 仍然可能误读、漏掉上下文或者生成看起来很完整但事实不准确的内容。所以规则文件的第一目标不是让 AI 变聪明,而是把范围、动作和回报说清楚。
二、先手动创建四个入口
第一步:确认你用的是测试或备份 Vault
第一次建立规则文件时,建议先复制一份当前 Vault。尤其是你已经安装了能修改文件的 AI 插件,先把这几类内容保护起来:
- 已发布文章
- 原始课程资料
- 同步配置
- 插件配置目录
.obsidian - 含有账号、Token、授权信息的文件
可以复制成一个临时目录,例如:
D:\Obsidian\AI产品知识库-test
路径按自己的电脑调整。这里的重点不是目录名,而是让第一次试验发生在可恢复的副本中。
第二步:创建 00-收件箱
在 Vault 根目录新建文件夹:
00-收件箱
网页剪藏、微信文章、会议速记和还没想好放哪里的内容,先进入这里。收件箱不是最终分类,也不是垃圾桶。它的价值是让“资料进入知识库”这件事足够快,分类可以稍后做。
第三步:创建 00-索引.md
新建一篇 Markdown 笔记,文件名必须是:
00-索引.md
先粘贴下面这份最小模板:
# 00-索引
## 这个知识库做什么
- 用途:保存课程笔记、网页剪藏、产品资料、文章草稿和 AI 整理结果
- 默认语言:中文
- 原始资料入口:`00-收件箱`
- 当前状态:刚开始搭建
## 目录约定
| 位置 | 用途 | 备注 |
| --- | --- | --- |
| `00-收件箱` | 未整理资料 | AI 默认只处理这里 |
| `01-资料` | 已确认需要长期保存的原始资料 | 如暂未创建,不要自动批量创建 |
| `02-知识库` | 经过人工确认的概念、方法和案例 | AI 生成内容要标注来源 |
| `03-未发布` | 文章、课程和报告草稿 | 发布前人工审核 |
| `04-已发布` | 已经定稿或发布的内容 | 默认只读 |
## 当前重要文件
| 文件 | 用途 | 状态 |
| --- | --- | --- |
| `CLAUDE.md` | Claude 类工具的工作说明 | 已建立 |
| `AGENTS.md` | AI 工具通用工作规则 | 已建立 |
## 待处理
- [ ] 给收件箱中的资料补充来源和保存日期
- [ ] 选择第一篇资料做人工整理
## 维护规则
- 新资料先进入 `00-收件箱`
- 原始内容和 AI 生成内容分开保存
- 重要修改保留来源和修改记录
- AI 处理后必须汇报读取、创建和修改了哪些文件
目录可以按你的工作变化,但不要一开始就建立几十个分类。索引只记录真实存在的目录和文件,不要为了“看起来专业”提前写一份不存在的知识库地图。
三、CLAUDE.md 和 AGENTS.md 有什么区别
很多人会同时创建两个文件,然后把它们当成两个神秘开关。实际并没有那么玄。
CLAUDE.md:给 Claude 工作流的说明书
它适合写和 Claude 相关的工作习惯,例如:
- 进入 Vault 后先看哪些文件
- 文章整理时使用什么语言和格式
- 输出结果时如何报告变更
- 哪些目录只读
Claude Code 或其他 Claude 工作流是否自动读取规则文件,取决于工具当前版本、启动目录和配置。不要假设“文件放进去就一定生效”,重要任务仍然要在 Prompt 里明确要求先读取它。
AGENTS.md:给不同 AI 工具共用的底线
它更适合写所有 AI 都应该遵守的规则,例如:
- 默认用中文回复
- 不读取和展示密钥、Token、登录信息
- 不删除、覆盖或批量移动笔记
- 只在用户指定的目录中工作
- 完成后列出处理过的文件
有些工具会识别 AGENTS.md,有些不会。它不是操作系统级权限,也不是防火墙。它是一份可被 AI 读取的说明书,真正的安全边界仍然来自文件权限、备份、插件设置和人工验收。
四、直接可用的脱敏版 CLAUDE.md
在 Vault 根目录新建 CLAUDE.md,把下面内容粘进去,再按自己的情况修改方括号内容。不要把真实账号、授权信息、API Key、Token 或远程存储路径写进规则文件。
# CLAUDE.md
## 这个知识库是什么
这是一个 Obsidian 本地优先知识库,用来保存课程笔记、网页剪藏、原始资料、文章草稿和 AI 生成内容。
这里的文件会被长期使用。修改任何文件前,先理解任务范围和目录约定;无法判断时,先向用户说明,不要擅自扩大处理范围。
## 每次工作前先读取
1. 读取 `AGENTS.md`。
2. 读取 `00-索引.md`。
3. 读取用户明确指定的文件或目录。
4. 如果用户没有指定范围,默认只检查 `00-收件箱`,不要扫描整个 Vault。
## 默认工作方式
- 使用中文回复,保留原文中的专有名词、链接和代码。
- 原始资料、AI 摘要和人工确认后的知识笔记分开保存。
- 摘要必须区分“原文明确说了什么”和“根据原文推断了什么”。
- 不确定的事实标注“待核实”,不要把推测写成结论。
- 保留来源链接、作者、发布日期和保存日期;原文没有的信息不要编造。
## 文件范围
- `00-收件箱`:临时资料入口,可以读取和整理。
- `01-资料`:原始资料,默认只读,除非用户明确允许修改。
- `02-知识库`:经过人工确认后保存的概念、方法和案例。
- `03-未发布`:文章和报告草稿,需要明确任务后再修改。
- `04-已发布`:已发布内容,默认只读。
如果某个目录不存在,不要自动创建一整套目录。先告诉用户需要增加什么,再等待明确指令。
## 明确禁止
- 不删除任何文件。
- 不覆盖已有正文。
- 不批量移动或重命名文件。
- 不修改 `.obsidian`、同步配置或系统文件。
- 不读取、展示、记录或传播密码、Token、Cookie、授权信息和私密配置。
- 不把本地文件上传到外部服务,除非用户明确知道范围并批准。
- 不为了修复格式而改写原始资料。
如果任务确实需要删除、移动、覆盖或访问敏感配置,先停下来,把拟执行的动作和文件列出来请求确认。
## 完成后的汇报格式
请按以下顺序回复:
1. 读取了哪些文件。
2. 新建了哪些文件。
3. 修改了哪些文件。
4. 哪些内容没有处理,以及原因。
5. 哪些事实或来源需要人工核实。
6. 下一步建议是什么。
这份规则的关键不在于文字多,而在于把“默认范围”和“禁止动作”写出来。没有范围的“帮我整理知识库”,对 AI 来说可能意味着读取几百篇文件;有了范围,它才知道先从收件箱开始。
五、直接可用的脱敏版 AGENTS.md
在同一个 Vault 根目录新建 AGENTS.md:
# AGENTS.md
## 知识库基本规则
这是一个本地优先的 Obsidian 知识库。默认用中文回复,先理解任务,再读取必要的文件,最后汇报实际变更。
## 工作前检查
- 先读取 `00-索引.md`,了解目录是否真实存在。
- 再读取用户指定的规则文件和目标文件。
- 用户没有指定范围时,只处理 `00-收件箱`。
- 不因为发现空目录或缺少分类就自动建立大量目录。
## 内容处理
- 新资料保留来源、作者、发布日期和保存日期。
- 原始资料和 AI 生成内容必须能区分。
- 无法核实的内容标记为“待核实”。
- 生成知识笔记时,说明它依据了哪些原始文件。
- 不把 AI 摘要当作原文,不把推测写成事实。
## 文件操作底线
- 不删除文件。
- 不覆盖已有正文。
- 不批量移动、重命名或合并文件。
- 不修改 `.obsidian` 和同步配置。
- 不读取、展示或记录登录信息、密码、Token、Cookie、授权信息和私密路径。
- 不处理用户没有指定的目录。
- 不向外部服务发送本地内容,除非用户明确批准。
需要删除、移动、覆盖或访问敏感信息时,必须先停止并请求确认。
## 完成后的报告
完成任务后必须列出:
- 读取了哪些文件
- 新增了哪些文件
- 修改了哪些文件
- 没有处理哪些文件
- 仍然存在的风险或待核实内容
- 下一步建议
注意,AGENTS.md 不是技术权限控制。一个拥有本地文件读写权限的程序,理论上仍然可以绕过这份文字规则。因此不要因为存在 AGENTS.md 就把真实密钥放入 Vault,也不要把生产资料直接交给第一次使用的插件。
六、让 AI 建立四个入口的 Prompt
如果你已经在 Obsidian 中启用了 Claudian,可以先使用下面这段 Prompt。第一次执行时,建议在测试 Vault 中完成:
请先读取当前 Vault 根目录中已经存在的文件,不要扫描或展示任何登录信息、授权信息、Token、密码、Cookie、私密路径和同步配置。
我想建立一个最小的本地知识库入口,只允许创建以下内容:
1. 文件夹:00-收件箱
2. 文件:00-索引.md
3. 文件:CLAUDE.md
4. 文件:AGENTS.md
要求:
- 如果其中任何文件已经存在,先读取并汇报,不要覆盖。
- 不删除、移动、重命名或批量修改其他文件。
- 不修改 .obsidian 和同步配置。
- 规则文件使用脱敏模板,不写入任何真实账号、密钥或授权信息。
- 00-索引.md 只记录当前真实存在的目录和文件,不编造文件列表。
- CLAUDE.md 说明 Claude 类工具的工作范围、禁止动作和完成后的汇报格式。
- AGENTS.md 说明所有 AI 工具都应遵守的中文回复、范围限制、隐私边界和文件操作底线。
完成后请告诉我:
- 读取了哪些文件
- 创建或跳过了哪些文件
- 没有处理哪些文件
- 下一步如何手动验收
Prompt 里重复写“如果已经存在就不要覆盖”,是因为文件创建属于写操作,不能只依赖自然语言中的“帮我建立知识库”。
七、让 AI 整理收件箱,但不碰正式内容
入口建立以后,可以用下面这段处理一篇网页剪藏:
请先读取 AGENTS.md 和 00-索引.md。
本次任务只处理 00-收件箱 中新保存的 Markdown 文件。不要读取或修改 00-收件箱 以外的内容,不要删除、移动、重命名或覆盖任何已有文件,也不要读取、展示或记录登录信息、授权信息、Token、密码和同步配置。
对每篇资料只做以下事情:
1. 提取标题、作者、来源链接、发布日期和保存日期;原文没有的字段留空或标记“未知”。
2. 用 5 条以内概括原文明确表达的观点。
3. 列出 3 条需要人工核实的事实、数据或结论;没有就写“暂未发现明显待核实项”。
4. 给出 3 个适合的主题标签,但不要直接改变原文件的标签。
5. 在一个新文件中生成“整理草稿”,文件名以“整理草稿-”开头。
6. 不要把整理草稿移动到正式知识库,等我人工确认。
完成后按以下格式汇报:
- 读取了哪些文件
- 新建了哪些整理草稿
- 哪些信息缺失
- 哪些内容需要我核实
- 哪些文件完全没有处理
这里特意让 AI 新建“整理草稿”,而不是直接改写剪藏原文。原始资料是证据,摘要是二次产物,二者分开后,后续出现错误时更容易回溯。
八、从收件箱走向真正的知识库
可以把日常流程固定成五步:
网页、微信、课程、对话
|
v
00-收件箱
|
v
人工检查来源和价值
|
v
01-资料 / 02-知识库 / 03-未发布
|
v
人工确认后进入 04-已发布
不要让 AI 自动把所有内容归档到正式目录。更稳妥的做法是:
- 先用 Web Clipper 把资料剪进
00-收件箱。 - AI 只提炼标题、来源、摘要、标签建议和待核实问题。
- 你确认资料值得长期保存后,再手动选择目录。
- 需要写文章时,让 AI 读取已确认的知识笔记,不要直接把一堆未核实剪藏当成事实来源。
- 发布前检查原文链接、日期、数字和引用。
当目录规模变大,再逐步增加 01-资料、02-知识库、03-未发布 和 04-已发布。目录服务于工作流,不需要一开始就设计成完美的知识图谱。
九、给索引维护使用的 Prompt
索引是导航,不是内容仓库。可以用下面的 Prompt 让 AI 检查索引,但仍然限制在指定范围内:
请读取 AGENTS.md 和 00-索引.md,只检查以下真实存在的目录:00-收件箱、01-资料、02-知识库、03-未发布、04-已发布。
先输出你发现的文件数量、重复标题、缺少来源的文件和索引中已经失效的路径。不要立即修改任何文件。
等我确认后,再只更新 00-索引.md。更新时:
- 不改变其他笔记正文。
- 不删除索引中的历史记录。
- 不创建不存在的目录。
- 不读取、展示或记录任何私密配置。
- 对不能判断的内容标注“待人工确认”。
把“先检查、后修改”拆成两次对话,通常比让 AI 一次完成更容易验收,也更容易发现它理解错了范围。
十、四条安全边界一定要保留
1. 规则文件不是权限系统
CLAUDE.md 和 AGENTS.md 都是文本约定。它们不能替代 Windows 文件权限、Vault 备份、插件权限和同步服务的访问控制。
2. 不要把密钥放进 Vault
API Key、Token、Cookie、授权文件、数据库密码和企业内部连接信息,不应该因为“AI 需要上下文”就放进笔记。需要配置 Claudian、Remotely Save 或企业级大模型接入时,在插件设置界面使用本地凭据管理能力;不要把真实值粘贴到公开文章、聊天窗口和规则文件。
3. AI 输出必须能回到来源
每条重要结论尽量保留来源链接、原始文件名和日期。没有来源的摘要只适合作为草稿,不能直接当成事实、研究结论或企业决策依据。
4. 同步前先备份
Remotely Save 或其他同步方式解决的是多设备可用,不等于版本控制和灾备。同步前保留本地副本,发现大面积删除、重复或冲突时先暂停同步,再从副本检查。
十一、企业场景怎么扩展
个人知识库可以直接在本地使用。企业把它接入内部 AI 工作流时,要额外考虑:
- 通过统一企业 API 网关或企业级 API 入口管理模型调用,而不是让每个插件各自保存一套 Key。
- 按用户、团队、项目和资料等级配置访问范围。
- 记录调用时间、模型、耗时、错误类型和成本,但不要把原文密钥写进日志。
- 对外发送前做敏感信息识别,明确哪些笔记只能本地处理。
- 对 AI 新建、修改和导出的文件保留审计记录,重要文档实行人工发布。
如果你的 Claudian 或其他插件支持自定义模型 API,也要先确认它当前版本的请求格式、数据处理方式和失败行为。接入 上游 API 或其他中转服务时,Key、域名和模型标识以服务商当前文档为准,不要把示例值当成生产配置。
十二、验收清单
完成后不要只看左侧文件树,按下面清单逐项检查:
-
00-收件箱已创建,而且路径确实位于当前 Vault 内。 -
00-索引.md只记录真实存在的目录和文件。 -
CLAUDE.md与AGENTS.md均为脱敏内容。 - 两份规则都写明了禁止删除、覆盖、批量移动和读取私密配置。
- 用测试资料验证了“只处理收件箱”的 Prompt。
- AI 生成的是整理草稿,没有直接覆盖原始剪藏。
- 已发布目录被设置为默认只读或人工确认范围。
- 同步前保留了一份可恢复的 Vault 副本。
- 重要摘要能追溯到来源链接或原始文件。
总结
“卡帕西知识库”最值得借鉴的,不是某个神秘命名,而是把 AI 的工作入口固定下来:
00-收件箱:资料先进入这里
00-索引.md:告诉 AI 知识库里有什么
CLAUDE.md:说明 Claude 工作流如何处理
AGENTS.md:写清所有 AI 都要遵守的底线
先让 AI 在小范围、可回退的目录里工作,再逐步扩大权限。规则文件写得再漂亮,也不能替代来源核验、备份和人工发布。
结论
本文给出了问题定位、配置或创作流程的可执行路径。实际结果仍取决于当前版本、权限和运行环境,提交前应按官方文档复核可变字段,并保留失败证据和回滚边界。