2026年4月13日 · 阅读 —

个人知识库 2.0 升级方案(基于 Karpathy 编译方法论)

Agent 与 Skills知识与内容工具

请帮我将现有的个人知识库升级到 2.0 版本。以下是完整的实施方案。

一、升级理念

基于 Karpathy 的「编译」方法论,将知识库从”整理笔记”升级为”编译知识”:

  • 核心类比:Obsidian Vault = 代码仓库,LLM = 编译器,原始资料 = 源代码,结构化知识 = 构建产物
  • 三层分离:raw/(源码)→ wiki/(构建产物)→ outputs/(运行日志)
  • 增量编译:只处理新增/变更的 raw 文件,不全量重建
  • 可追溯:每个知识条目能追溯到原始来源

二、目录结构

在现有结构基础上新增以下目录和文件:
raw/ ← 新增:原始资料,不做修改
articles/ # Web Clipper / Agent Reach 剪藏的文章
podcasts/ # 播客转录
tweets/ # 推文收藏
wiki/ ← 新增:编译产物,由 LLM 维护
summaries/ # 逐篇三步编译摘要
concepts/ # 概念条目(每概念一个 .md 文件)
indexes/ # 自动维护的索引
All-Sources.md # 全部来源清单
All-Concepts.md # 全部概念清单
outputs/ ← 新增:运行时输出
qa/ # 问答沉淀(每次复杂提问都落文件)
health/ # 健康检查报告

如果已有 02-素材库/核心概念/ 目录,将其下的文件迁移到 wiki/concepts/ 并按新模板补全内容,然后删除旧的 02-素材库/核心概念/ 目录。

三、核心编译方法:三步编译法

每次编译 raw/ 中的内容,必须严格按以下顺序执行三步:

第一步:浓缩(第一性原理 + 剃刀法则)

基于认知负荷理论(人类工作记忆最多维持 20 秒,同时处理 2-4 个信息块):

  • 先抓主线,再深度质疑(顺序不能反)
  • 用剃刀法则删减:删掉它会影响理解吗?不会就删
  • 输出:核心结论(不超过 3 条)+ 关键证据 + 核心术语表

第二步:质疑(芒格反驳法)

“如果我不能比别人更好地反驳自己的观点,我就不配拥有这个观点。”

  • 逻辑链检查:推理链在哪里断了?
  • 前提假设:结论依赖哪些前提?列出每个隐含前提及”如果该前提不成立会怎样”
  • 不适用场景:这个观点在什么情况下不成立?写出具体反例
  • 输出:前提假设清单 + 不适用场景 + 反例

第三步:对标(它山之石可以攻玉)

  • 跨域类比:其他领域有类似现象吗?建立映射表
  • 迁移应用:这些知识还能用在哪儿?
  • 它山之石:其他领域的方法论能否迁移到当前领域?
  • 输出:跨域映射表 + 可迁移洞察 + 新连接

四、需要创建的模板文件

1. raw/articles/_模板.md

- --  
source_url:  
author:  
published:  
clipped_at: {{date}}  
tags:  []   
type: article  
- --  
  
# {{title}}  
  
> 原始资料,不做修改。编译产物见 wiki/summaries/ 对应文件。  
  
[原文内容粘贴在这里]   
  
2. `wiki/summaries/_模板.md`  
- --  
source: " raw/articles/YYYY-MM-文件名 "  
compiled_at: {{date}}  
concepts:  []   
status: compiled  
- --  
  
# {{标题}} — 三步编译摘要  
  
## 元信息  
  
- **来源**:  
- **作者**:  
- **类型**:文章 / 播客 / 论文 / 推文  
- **原文链接**:  
- **编译日期**:  
  
- --  
  
## 第一步:浓缩(第一性原理 + 剃刀法则)  
  
> 认知负荷理论:删除无关内容,削减外在负荷,把有限内存留给真正重要的东西。  
> 顺序不能反:先抓主线,再深度质疑。  
  
### 核心结论(不超过3条)  
  
1.  
2.  
3.  
  
### 关键证据  
  
-  
-  
  
### 核心术语  
  
| 术语 | 定义 |  
|------|------|  
  
- --  
  
## 第二步:质疑(芒格反驳法)  
  
> "如果我不能比别人更好地反驳自己的观点,我就不配拥有这个观点。"  
  
### 逻辑链检查  
  
- 逻辑链完整 / 逻辑链在哪里断了:  
- 断裂点:  
  
### 前提假设清单  
  
| # | 隐含前提 | 如果这个前提不成立会怎样 |  
|---|----------|--------------------------|  
| 1 | | |  
| 2 | | |  
| 3 | | |  
  
### 不适用场景  
  
- 这个观点在什么情况下不适用:  
- 反例:  
  
- --  
  
## 第三步:对标(它山之石可以攻玉)  
  
> 跨域类比、迁移、还能用在哪儿?哪些领域的知识可以用在当前领域?  
  
### 跨域映射  
  
| 当前领域概念 | 类比领域 | 类比对象 | 启示 |  
|-------------|----------|----------|------|  
  
### 可迁移洞察  
  
-  
-  
  
### 新连接  
  
- 可以和  概念名  关联  
- 可以用于  [场景]   
  
- --  
  
## 编译产物  
  
- **提取概念**: [列出提取的概念,将在 wiki/concepts/ 中建立或更新条目]   
- **关联素材**: [列出可关联到素材库的内容]   
- **选题启发**: [这条内容可以衍生出什么选题?]   
  
3. `wiki/concepts/_模板.md`  
  
```markdown
- --  
aliases:  []   
created_at: {{date}}  
updated_at: {{date}}  
sources:  []   
related_concepts:  []   
- --  
  
# {{概念名}}  
  
## 定义  
  
[一句话定义这个概念]   
  
## 第一性原理  
  
[这个概念背后最基本的原理是什么?去掉所有装饰后剩下什么?]   
  
## 证据链  
  
| # | 证据 | 来源 | 强度 |  
|---|------|------|------|  
| 1 | | | 强/中/弱 |  
  
## 质疑(这个概念在什么情况下不成立?)  
  
- 不适用场景:  
- 依赖的前提:  
- 反例:  
  
## 跨域连接  
  
- **类比**:  
- **迁移**:  
- **它山之石**:  
  
## 适用场景  
  
- 场景1:  
- 场景2:  
  
## 典型表达  
  
- "引述1"  
- "引述2"  
  
## 反向链接  
  
- 被以下摘要引用: [链接]   
- 被以下内容使用: [链接]   
  
4. `wiki/indexes/All-Sources.md`  
  
```markdown
# 全部来源索引  
  
> 自动维护。每次编译后由 LLM 更新。  
  
| ID | 标题 | 作者 | 类型 | 来源URL | 添加日期 | 编译状态 |  
|----|------|------|------|---------|----------|----------|  
  
5. `wiki/indexes/All-Concepts.md`  
# 全部概念索引  
  
> 自动维护。每次编译后由 LLM 更新。  
  
| 概念 | 定义(一句话) | 首次来源 | 相关概念 | 最后更新 |  
|------|---------------|----------|----------|----------|  
  
  
6. `outputs/qa/_模板.md`  
- --  
question: ""  
asked_at: {{date}}  
sources:  []   
- --  
  
# {{问题}}  
  
## TL;DR  
  
[一句话回答]   
  
## 结论  
  
[详细回答]   
  
## 证据  
  
- (链接回原始来源)  
  
## 不确定性  
  
[哪些地方还不确定,需要更多信息]   
  
## 关联  
  
- 相关概念: [链接]   
- 相关Q&A: [链接]   
  
7. `outputs/health/_模板.md`  
- --  
check_date: {{date}}  
check_type: weekly  
- --  
  
# 健康检查报告 — {{date}}  
  
## 概览  
  
| 检查项 | 状态 | 问题数 |  
|--------|------|--------|  
| 一致性 | ✅/⚠️/❌ | |  
| 完整性 | ✅/⚠️/❌ | |  
| 孤岛检测 | ✅/⚠️/❌ | |  
  
## 一致性检查  
  
> wiki/concepts/ 中是否有定义冲突?  
  
| 问题 | 位置 | 建议 |  
|------|------|------|  
  
## 完整性检查  
  
> 哪些概念条目缺定义、缺例子、缺来源?  
  
| 概念 | 缺失项 | 建议 |  
|------|--------|------|  
  
## 孤岛检测  
  
> 哪些笔记入链出链都少于2?  
  
| 文件 | 入链 | 出链 | 建议连接到 |  
|------|------|------|-----------|  
  
## 本期修复计划  
  
-  [ ]   
-  [ ]   
  
## 五、CLAUDE.md 更新要求  
  
在现有 CLAUDE.md 中新增以下内容(不是替换,是追加和整合):  
  
### 1. 新增架构说明  
## 架构概览  
  
知识管理:raw/ → wiki/ → outputs/(Karpathy 编译架构)  
内容创作:01-内容生产/ → 03-已发布内容/ → 04-数据与复盘/  
方法论沉淀:05-方法论/ + 06-选题研究/  
  
### 2. 新增目录索引  
  
在目录索引部分追加 raw/、wiki/、outputs/ 三个模块的说明。  
  
### 3. 新增三步编译法规范  
  
将上面的「三步编译法」完整写入 CLAUDE.md,作为编译规范。  
  
### 4. 新增 4 个工作流命令  
  
* *「抓取链接」**  
- 触发:用户发一个 URL 链接  
- 流程:判断内容类型 → 使用 Agent Reach 或 Jina Reader 抓取 → 转为 Markdown → 添加 YAML frontmatter(source_url, author, published, clipped_at, tags, type)→ 存入 raw/ 对应目录  
- 如果 Agent Reach 未安装,先执行安装:`pip install https://github.com/Panniantong/agent-reach/archive/main.zip && agent-reach install --env=auto`  
- 网页抓取备选方案:`curl -s "https://r.jina.ai/URL"` (Jina Reader)  
  
* *「编译」**  
- 触发:用户说"编译"、"compile"、"处理新内容"  
- 流程:扫描 raw/ 找未编译素材 → 三步编译法 → 存入 wiki/summaries/ → 提取概念到 wiki/concepts/ → 更新 wiki/indexes/ → 如有选题启发追加到选题库  
- 增量编译:只处理没有对应 wiki/summaries/ 文件的 raw 素材  
  
* *「健康检查」**  
- 触发:用户说"健康检查"、"检查知识库"  
- 流程:一致性检查(概念冲突)+ 完整性检查(缺失字段)+ 孤岛检测(入链出链<2)→ 报告存入 outputs/health/  
  
* *「知识问答」**  
- 触发:用户对知识库提出复杂问题  
- 流程:检索 wiki/ + outputs/qa/ → 生成带来源的回答 → 以 Markdown 存入 outputs/qa/  
  
### 5. 更新素材检索规则  
  
写文稿前的检索顺序更新为:  
1. `wiki/concepts/` → 查找概念(含质疑和跨域洞察)  
2. `wiki/summaries/` → 查找已编译的知识  
3. `02-素材库/金句库.md` → 查找可复用的表达  
4. `02-素材库/案例库.md` → 查找可引用的案例  
5. `02-素材库/爆款文稿库.md` → 查找爆款成功要素  
6. `05-方法论/` → 参考标题和开头公式  
7. `outputs/qa/` → 查找历史问答结果  
  
### 6. 更新工作流闭环图  
=== 知识管理层 ===  
  
URL / 剪藏 / 播客  
↓ 「抓取链接」  
raw/(原始资料,不改)  
↓ 「编译」(三步:浓缩→质疑→对标)  
wiki/summaries/ + wiki/concepts/ + wiki/indexes/  
↓  
outputs/qa/(问答沉淀)+ outputs/health/(健康检查)  
  
=== 内容创作层 ===  
  
碎片想法 → 选题库 → 待深化选题 → 文稿 → 定稿 → 发布 → 归档 → 数据复盘 → 方法论迭代  
  
=== 两条线的关系 ===  
  
知识管理线 → 为内容创作线提供编译好的知识素材  
内容创作线 → 发布后数据反馈 → 迭代方法论 → 指导知识编译的重点方向  
  
7. 追加编译产物规范  
## 编译产物规范  
  
### 摘要文件(wiki/summaries/)  
- 文件名格式:YYYY-MM-关键词.md  
- 必须包含三步编译的完整输出  
- 末尾列出:提取的概念、关联素材、选题启发  
  
### 概念条目(wiki/concepts/)  
- 文件名格式:概念名.md  
- YAML frontmatter:aliases, created_at, updated_at, sources, related_concepts  
- 必须包含:定义、第一性原理、证据链、质疑、跨域连接、适用场景、典型表达、反向链接  
- 新概念建条目,老概念补新证据  
  
### 索引维护  
- 每次编译后自动更新 All-Sources.md(追加来源)  
- 每次编译后自动更新 All-Concepts.md(新增/更新概念)  
  
六、已有概念迁移  
  
如果 `02-素材库/核心概念/` 下已有概念文件,对每个文件执行以下操作:  
  
1. 读取原概念内容  
2. 按新的 `wiki/concepts/_模板.md` 格式重写,补全以下新增字段:  
- **第一性原理**:这个概念去掉装饰后最基本的原理是什么?  
- **证据链**:列出支持证据并标注强度(强/中/弱)  
- **质疑**:不适用场景、依赖前提、反例  
- **跨域连接**:类比、迁移、它山之石  
- **YAML frontmatter**:aliases, created_at, updated_at, sources, related_concepts  
3. 写入 `wiki/concepts/`  
4. 更新 `wiki/indexes/All-Concepts.md`  
5. 删除 `02-素材库/核心概念/` 目录  
  
## 七、实施顺序  
  
按以下顺序执行:  
  
1. **创建新目录**:raw/articles/、raw/podcasts/、raw/tweets/、wiki/summaries/、wiki/concepts/、wiki/indexes/、outputs/qa/、outputs/health/  
2. **创建 7 个模板文件**(按上面的内容)  
3. **迁移已有概念**(如果有)  
4. **更新 CLAUDE.md**(按第五部分的要求)  
5. **安装 Agent Reach**(运行 `pip install https://github.com/Panniantong/agent-reach/archive/main.zip && agent-reach install --env=auto`)  
  
全部完成后,向我确认升级结果,列出最终目录结构和新增的文件清单。

- --