AI 进入本地知识库后,最先需要的不是更多插件,而是明确的范围、入口和不可修改区域。本文用 00-收件箱、索引文件、CLAUDE.md 和 AGENTS.md 组成最小规则层,说明如何让 AI 先读状态、只处理授权目录,并为每次整理留下可复核的变更记录。文中只讨论可复现的步骤,不把单次结果扩展成产品承诺;每个结论都标注前提、证据和无法覆盖的边界。读者可以先完成最小验证,再按自己的版本、权限和数据补充实验。

前面我们已经把 Obsidian 装好,装了 Editing Toolbar、Diagrams、Excalidraw,也把网页剪藏、同步和 Claudian 接上了。

但工具接上以后,还有一个更现实的问题:AI 进到 Vault 里,到底应该先看什么?哪些文件可以整理?哪些文件不能碰?一篇刚剪进来的文章,什么时候才算进入知识库?

如果这些约定只存在你的脑子里,每次对话都要重新解释一遍。今天说“只整理收件箱”,明天忘了补范围,AI 就可能把临时笔记、正式文章和配置文件混在一起处理。

这篇要搭的是一个很小、但很有用的规则层。它常被一些工作流文章称作“卡帕西知识库”,这里不要把它理解成 Obsidian 的官方功能,也不要把它理解成某个插件。它本质上是一种本地 Markdown 知识库方法:用收件箱接住资料,用索引说明文件位置,再用规则文件告诉 AI 该怎么工作。

一、卡帕西知识库到底是什么

先看最小结构:

AI产品知识库/
├─ 00-收件箱/
├─ 00-索引.md
├─ CLAUDE.md
└─ AGENTS.md

四个入口各自负责一件事:

文件或目录 作用 是否适合放原始资料
00-收件箱 接收网页剪藏、临时想法、待整理文件
00-索引.md 记录重要目录、笔记和当前状态
CLAUDE.md 给 Claude 类工具看的工作说明
AGENTS.md 给进入这个 Vault 的 AI 工具看的通用规则

这四个入口解决的是“AI 如何进入知识库”的问题,不是替你完成全部知识管理。

它不会自动保证摘要正确,也不会自动判断一篇文章是否值得收藏。AI 仍然可能误读、漏掉上下文或者生成看起来很完整但事实不准确的内容。所以规则文件的第一目标不是让 AI 变聪明,而是把范围、动作和回报说清楚。

二、先手动创建四个入口

第一步:确认你用的是测试或备份 Vault

第一次建立规则文件时,建议先复制一份当前 Vault。尤其是你已经安装了能修改文件的 AI 插件,先把这几类内容保护起来:

可以复制成一个临时目录,例如:

D:\Obsidian\AI产品知识库-test

路径按自己的电脑调整。这里的重点不是目录名,而是让第一次试验发生在可恢复的副本中。

第二步:创建 00-收件箱

在 Vault 根目录新建文件夹:

00-收件箱

网页剪藏、微信文章、会议速记和还没想好放哪里的内容,先进入这里。收件箱不是最终分类,也不是垃圾桶。它的价值是让“资料进入知识库”这件事足够快,分类可以稍后做。

第三步:创建 00-索引.md

新建一篇 Markdown 笔记,文件名必须是:

00-索引.md

先粘贴下面这份最小模板:

# 00-索引

## 这个知识库做什么

- 用途:保存课程笔记、网页剪藏、产品资料、文章草稿和 AI 整理结果
- 默认语言:中文
- 原始资料入口:`00-收件箱`
- 当前状态:刚开始搭建

## 目录约定

| 位置 | 用途 | 备注 |
| --- | --- | --- |
| `00-收件箱` | 未整理资料 | AI 默认只处理这里 |
| `01-资料` | 已确认需要长期保存的原始资料 | 如暂未创建,不要自动批量创建 |
| `02-知识库` | 经过人工确认的概念、方法和案例 | AI 生成内容要标注来源 |
| `03-未发布` | 文章、课程和报告草稿 | 发布前人工审核 |
| `04-已发布` | 已经定稿或发布的内容 | 默认只读 |

## 当前重要文件

| 文件 | 用途 | 状态 |
| --- | --- | --- |
| `CLAUDE.md` | Claude 类工具的工作说明 | 已建立 |
| `AGENTS.md` | AI 工具通用工作规则 | 已建立 |

## 待处理

- [ ] 给收件箱中的资料补充来源和保存日期
- [ ] 选择第一篇资料做人工整理

## 维护规则

- 新资料先进入 `00-收件箱`
- 原始内容和 AI 生成内容分开保存
- 重要修改保留来源和修改记录
- AI 处理后必须汇报读取、创建和修改了哪些文件

目录可以按你的工作变化,但不要一开始就建立几十个分类。索引只记录真实存在的目录和文件,不要为了“看起来专业”提前写一份不存在的知识库地图。

三、CLAUDE.mdAGENTS.md 有什么区别

很多人会同时创建两个文件,然后把它们当成两个神秘开关。实际并没有那么玄。

CLAUDE.md:给 Claude 工作流的说明书

它适合写和 Claude 相关的工作习惯,例如:

Claude Code 或其他 Claude 工作流是否自动读取规则文件,取决于工具当前版本、启动目录和配置。不要假设“文件放进去就一定生效”,重要任务仍然要在 Prompt 里明确要求先读取它。

AGENTS.md:给不同 AI 工具共用的底线

它更适合写所有 AI 都应该遵守的规则,例如:

有些工具会识别 AGENTS.md,有些不会。它不是操作系统级权限,也不是防火墙。它是一份可被 AI 读取的说明书,真正的安全边界仍然来自文件权限、备份、插件设置和人工验收。

四、直接可用的脱敏版 CLAUDE.md

在 Vault 根目录新建 CLAUDE.md,把下面内容粘进去,再按自己的情况修改方括号内容。不要把真实账号、授权信息、API Key、Token 或远程存储路径写进规则文件。

# CLAUDE.md

## 这个知识库是什么

这是一个 Obsidian 本地优先知识库,用来保存课程笔记、网页剪藏、原始资料、文章草稿和 AI 生成内容。

这里的文件会被长期使用。修改任何文件前,先理解任务范围和目录约定;无法判断时,先向用户说明,不要擅自扩大处理范围。

## 每次工作前先读取

1. 读取 `AGENTS.md`。
2. 读取 `00-索引.md`。
3. 读取用户明确指定的文件或目录。
4. 如果用户没有指定范围,默认只检查 `00-收件箱`,不要扫描整个 Vault。

## 默认工作方式

- 使用中文回复,保留原文中的专有名词、链接和代码。
- 原始资料、AI 摘要和人工确认后的知识笔记分开保存。
- 摘要必须区分“原文明确说了什么”和“根据原文推断了什么”。
- 不确定的事实标注“待核实”,不要把推测写成结论。
- 保留来源链接、作者、发布日期和保存日期;原文没有的信息不要编造。

## 文件范围

- `00-收件箱`:临时资料入口,可以读取和整理。
- `01-资料`:原始资料,默认只读,除非用户明确允许修改。
- `02-知识库`:经过人工确认后保存的概念、方法和案例。
- `03-未发布`:文章和报告草稿,需要明确任务后再修改。
- `04-已发布`:已发布内容,默认只读。

如果某个目录不存在,不要自动创建一整套目录。先告诉用户需要增加什么,再等待明确指令。

## 明确禁止

- 不删除任何文件。
- 不覆盖已有正文。
- 不批量移动或重命名文件。
- 不修改 `.obsidian`、同步配置或系统文件。
- 不读取、展示、记录或传播密码、Token、Cookie、授权信息和私密配置。
- 不把本地文件上传到外部服务,除非用户明确知道范围并批准。
- 不为了修复格式而改写原始资料。

如果任务确实需要删除、移动、覆盖或访问敏感配置,先停下来,把拟执行的动作和文件列出来请求确认。

## 完成后的汇报格式

请按以下顺序回复:

1. 读取了哪些文件。
2. 新建了哪些文件。
3. 修改了哪些文件。
4. 哪些内容没有处理,以及原因。
5. 哪些事实或来源需要人工核实。
6. 下一步建议是什么。

这份规则的关键不在于文字多,而在于把“默认范围”和“禁止动作”写出来。没有范围的“帮我整理知识库”,对 AI 来说可能意味着读取几百篇文件;有了范围,它才知道先从收件箱开始。

五、直接可用的脱敏版 AGENTS.md

在同一个 Vault 根目录新建 AGENTS.md

# AGENTS.md

## 知识库基本规则

这是一个本地优先的 Obsidian 知识库。默认用中文回复,先理解任务,再读取必要的文件,最后汇报实际变更。

## 工作前检查

- 先读取 `00-索引.md`,了解目录是否真实存在。
- 再读取用户指定的规则文件和目标文件。
- 用户没有指定范围时,只处理 `00-收件箱`。
- 不因为发现空目录或缺少分类就自动建立大量目录。

## 内容处理

- 新资料保留来源、作者、发布日期和保存日期。
- 原始资料和 AI 生成内容必须能区分。
- 无法核实的内容标记为“待核实”。
- 生成知识笔记时,说明它依据了哪些原始文件。
- 不把 AI 摘要当作原文,不把推测写成事实。

## 文件操作底线

- 不删除文件。
- 不覆盖已有正文。
- 不批量移动、重命名或合并文件。
- 不修改 `.obsidian` 和同步配置。
- 不读取、展示或记录登录信息、密码、Token、Cookie、授权信息和私密路径。
- 不处理用户没有指定的目录。
- 不向外部服务发送本地内容,除非用户明确批准。

需要删除、移动、覆盖或访问敏感信息时,必须先停止并请求确认。

## 完成后的报告

完成任务后必须列出:

- 读取了哪些文件
- 新增了哪些文件
- 修改了哪些文件
- 没有处理哪些文件
- 仍然存在的风险或待核实内容
- 下一步建议

注意,AGENTS.md 不是技术权限控制。一个拥有本地文件读写权限的程序,理论上仍然可以绕过这份文字规则。因此不要因为存在 AGENTS.md 就把真实密钥放入 Vault,也不要把生产资料直接交给第一次使用的插件。

六、让 AI 建立四个入口的 Prompt

如果你已经在 Obsidian 中启用了 Claudian,可以先使用下面这段 Prompt。第一次执行时,建议在测试 Vault 中完成:

请先读取当前 Vault 根目录中已经存在的文件,不要扫描或展示任何登录信息、授权信息、Token、密码、Cookie、私密路径和同步配置。

我想建立一个最小的本地知识库入口,只允许创建以下内容:
1. 文件夹:00-收件箱
2. 文件:00-索引.md
3. 文件:CLAUDE.md
4. 文件:AGENTS.md

要求:
- 如果其中任何文件已经存在,先读取并汇报,不要覆盖。
- 不删除、移动、重命名或批量修改其他文件。
- 不修改 .obsidian 和同步配置。
- 规则文件使用脱敏模板,不写入任何真实账号、密钥或授权信息。
- 00-索引.md 只记录当前真实存在的目录和文件,不编造文件列表。
- CLAUDE.md 说明 Claude 类工具的工作范围、禁止动作和完成后的汇报格式。
- AGENTS.md 说明所有 AI 工具都应遵守的中文回复、范围限制、隐私边界和文件操作底线。

完成后请告诉我:
- 读取了哪些文件
- 创建或跳过了哪些文件
- 没有处理哪些文件
- 下一步如何手动验收

Prompt 里重复写“如果已经存在就不要覆盖”,是因为文件创建属于写操作,不能只依赖自然语言中的“帮我建立知识库”。

七、让 AI 整理收件箱,但不碰正式内容

入口建立以后,可以用下面这段处理一篇网页剪藏:

请先读取 AGENTS.md 和 00-索引.md。

本次任务只处理 00-收件箱 中新保存的 Markdown 文件。不要读取或修改 00-收件箱 以外的内容,不要删除、移动、重命名或覆盖任何已有文件,也不要读取、展示或记录登录信息、授权信息、Token、密码和同步配置。

对每篇资料只做以下事情:
1. 提取标题、作者、来源链接、发布日期和保存日期;原文没有的字段留空或标记“未知”。
2. 用 5 条以内概括原文明确表达的观点。
3. 列出 3 条需要人工核实的事实、数据或结论;没有就写“暂未发现明显待核实项”。
4. 给出 3 个适合的主题标签,但不要直接改变原文件的标签。
5. 在一个新文件中生成“整理草稿”,文件名以“整理草稿-”开头。
6. 不要把整理草稿移动到正式知识库,等我人工确认。

完成后按以下格式汇报:
- 读取了哪些文件
- 新建了哪些整理草稿
- 哪些信息缺失
- 哪些内容需要我核实
- 哪些文件完全没有处理

这里特意让 AI 新建“整理草稿”,而不是直接改写剪藏原文。原始资料是证据,摘要是二次产物,二者分开后,后续出现错误时更容易回溯。

八、从收件箱走向真正的知识库

可以把日常流程固定成五步:

网页、微信、课程、对话
        |
        v
    00-收件箱
        |
        v
人工检查来源和价值
        |
        v
01-资料 / 02-知识库 / 03-未发布
        |
        v
人工确认后进入 04-已发布

不要让 AI 自动把所有内容归档到正式目录。更稳妥的做法是:

  1. 先用 Web Clipper 把资料剪进 00-收件箱
  2. AI 只提炼标题、来源、摘要、标签建议和待核实问题。
  3. 你确认资料值得长期保存后,再手动选择目录。
  4. 需要写文章时,让 AI 读取已确认的知识笔记,不要直接把一堆未核实剪藏当成事实来源。
  5. 发布前检查原文链接、日期、数字和引用。

当目录规模变大,再逐步增加 01-资料02-知识库03-未发布04-已发布。目录服务于工作流,不需要一开始就设计成完美的知识图谱。

九、给索引维护使用的 Prompt

索引是导航,不是内容仓库。可以用下面的 Prompt 让 AI 检查索引,但仍然限制在指定范围内:

请读取 AGENTS.md 和 00-索引.md,只检查以下真实存在的目录:00-收件箱、01-资料、02-知识库、03-未发布、04-已发布。

先输出你发现的文件数量、重复标题、缺少来源的文件和索引中已经失效的路径。不要立即修改任何文件。

等我确认后,再只更新 00-索引.md。更新时:
- 不改变其他笔记正文。
- 不删除索引中的历史记录。
- 不创建不存在的目录。
- 不读取、展示或记录任何私密配置。
- 对不能判断的内容标注“待人工确认”。

把“先检查、后修改”拆成两次对话,通常比让 AI 一次完成更容易验收,也更容易发现它理解错了范围。

十、四条安全边界一定要保留

1. 规则文件不是权限系统

CLAUDE.mdAGENTS.md 都是文本约定。它们不能替代 Windows 文件权限、Vault 备份、插件权限和同步服务的访问控制。

2. 不要把密钥放进 Vault

API Key、Token、Cookie、授权文件、数据库密码和企业内部连接信息,不应该因为“AI 需要上下文”就放进笔记。需要配置 Claudian、Remotely Save 或企业级大模型接入时,在插件设置界面使用本地凭据管理能力;不要把真实值粘贴到公开文章、聊天窗口和规则文件。

3. AI 输出必须能回到来源

每条重要结论尽量保留来源链接、原始文件名和日期。没有来源的摘要只适合作为草稿,不能直接当成事实、研究结论或企业决策依据。

4. 同步前先备份

Remotely Save 或其他同步方式解决的是多设备可用,不等于版本控制和灾备。同步前保留本地副本,发现大面积删除、重复或冲突时先暂停同步,再从副本检查。

十一、企业场景怎么扩展

个人知识库可以直接在本地使用。企业把它接入内部 AI 工作流时,要额外考虑:

如果你的 Claudian 或其他插件支持自定义模型 API,也要先确认它当前版本的请求格式、数据处理方式和失败行为。接入 上游 API 或其他中转服务时,Key、域名和模型标识以服务商当前文档为准,不要把示例值当成生产配置。

十二、验收清单

完成后不要只看左侧文件树,按下面清单逐项检查:

总结

“卡帕西知识库”最值得借鉴的,不是某个神秘命名,而是把 AI 的工作入口固定下来:

00-收件箱:资料先进入这里
00-索引.md:告诉 AI 知识库里有什么
CLAUDE.md:说明 Claude 工作流如何处理
AGENTS.md:写清所有 AI 都要遵守的底线

先让 AI 在小范围、可回退的目录里工作,再逐步扩大权限。规则文件写得再漂亮,也不能替代来源核验、备份和人工发布。

结论

本文给出了问题定位、配置或创作流程的可执行路径。实际结果仍取决于当前版本、权限和运行环境,提交前应按官方文档复核可变字段,并保留失败证据和回滚边界。