从素材到知识网络
四个阶段环环相扣,每步都跑物理校验脚本做硬断言。小批量高频验证,绝不在大动作后忘记验证。
资料摄入与摘要
回读原始文案、PDF、转写稿等素材,按标准模板生成结构化拆书摘要。内容面向旁白解说与知识结构提炼,严禁生成出镜朗读类脚本。
实体提炼与建立
从摘要中提取人名与独立概念,反向回读提炼内容。必含"也叫做""核心要点""相关实体"等必需章节。已有实体综合所有来源重写,绝不追加。
降维剪枝与网络化
识别"X与Y"等复合短语噪声,去双括号降级为普通文本;用别名格式修复不匹配链接;在跨多个实体/摘要涌现高维概念时建主题页连接知识网络。
物理硬断言与交接
跑内置物理校验脚本做硬断言:死链 0/0、模板 100% 合规。上下文临近上限或跨窗口时,自动更新根目录交接文档,无缝续接。
用自然语言直接触发
无需记忆复杂命令,用自然语言描述意图即可启动对应阶段。
标准模板与文件结构
三套标准模板统一位于 .agent/templates/,保证摘要、实体、主题的一致性与可维护性。
项目目录结构
十条铁律,违反即破坏知识库
每一条都是用真实教训换来的,贯穿整个工作流。
raw-sources 只进不改 —— 原文件绝对不修改,连一个标点都不动
整理只在 wiki/ —— 摘要写 summaries/,实体写 entities/,主题写 themes/
双向链接必须用 [[ ]] —— 实体引用来源,摘要关联实体,主题关联实体和主题
命名规则 —— 文件名 YYYY-MM 关键词.md,中文写正文第一行;文件夹全小写英文 - 连接
诚实汇报 —— 每次用校验脚本实测数字,绝不引用文档里的旧数字
半成品不拼接 —— 缺章节的摘要/实体一律重写整篇,不原地补全
实体更新不追加 —— 新素材提到已有实体时,综合所有来源重写整篇
内容取向 —— 面向旁白解说与知识结构提炼,严禁生成出镜朗读脚本/口播文案
文件名禁止 / —— 斜杠会创建子目录导致死链;用平铺文件名 + 别名链接
死链硬断言 0/0 —— 每批处理后必须跑校验脚本;死链必须回归 0
批次控制铁律
| 操作 | 上限 | 后处理 | 失败处理 |
|---|---|---|---|
| 新建摘要 | ≤ 5 篇 / 批 | 跑校验脚本 | Error > 0 → 修复 → 最多 2 轮后停靠等用户 |
| 新建实体 | ≤ 3 个 / 批 | 跑校验脚本 | 同上 |
| 格式修正 / 死链修复 | ≤ 10 个 / 批 | 跑校验脚本 | 同上 |
六个技术坑,每一个都验证过
用真实故障换来的教训,务必规避。
三种典型场景
用实际对话方式展示操作路径。
用户:新增摘要
- 1. 回读原始素材文案
- 2. 按摘要模板生成结构化摘要 → 写入摘要目录
- 3. 跑 python3 verify.py → 确认无新增死链
- 4. 从摘要提取实体:人名、概念...
- 5. 新建/重写实体页 ≤3 个/批
- 6. 跑 python3 verify.py → 清死链
- 7. 死链 0/0 → ✅ 完成
用户:检查死链
- 1. 跑 python3 verify.py
- 2. 读 missing_entities.json
- 3. 报告死链数量和清单
用户:更新交接文档
- 1. 跑 python3 verify.py
- 2. 读 missing_entities.json
- 3. 清死链到 0/0(别名修复 → 降级剪枝 → 新建实体,最多 2 轮)
- 4. 更新交接文档(实测数字、本轮变更、技术坑)
- 5. 更新工作规范中的数字
- 6. 报告最终状态 ✅
verify.py 输出解读
运行 python3 verify.py 即可。零第三方依赖,支持别名匹配、排除模板与交接目录。
| 检查项 | 输出 | 含义 |
|---|---|---|
| 目录结构 | ✓ / ✗ | 缺目录 = 错误 |
| 摘要完整性 | 合规摘要 N/N | 缺章节 = 警告 |
| 实体完整性 | 合规实体 M/M | 缺章节 = 警告 |
| 死链检测 | 唯一死链: K | K > 0 = 必须修复 |
| 路径检查 | 残留检查 | 有残留 = 错误 |
| 终极目标 | ✅ 全部通过 | 死链 0/0 + 模板 100% |
verify.py 输出即终极断言。任何不满足该目标的输出都视为未完成。