叶师父从小红书看到「华为天才少年的智能体神书」解读(33K+ star 的开源书),安排全组阅读并做深度蒸馏(200.7KB / 5,666行 / 70个章节区块,已上线书房)。读完后叶师父要求:每个人都说说自己的建议。全组共提出 15+ 条建议,本文档汇总全部建议、落地状态与优先级,供叶师父定夺。
| # | 建议 | 状态 |
|---|---|---|
| 1 | 知识图谱升级:书房图谱加"检索"层(RAG 思路),研究自动化沉淀 | P2 待定 |
| 2 | 多Agent协作自检:书第10章失败模式清单 → 五角色协作检查项 | ✅ 已落地 |
| 3 | 内容矩阵机会:Agent 科普系列(大脑+眼睛+手脚) | ⛔ 叶师父否 |
| 4 | Harness 思维:复盘哪些 skill/流程在给模型兜底、哪些该沉淀 | 🔄 进行中 |
| 5 | 评估体系:参考第6章升级质检为可量化 Rubric | ✅ 已落地 |
| # | 建议 | 状态 |
|---|---|---|
| 1 | 上下文工程 × 写作素材库:旺达调研输出加"金句/案例/结构建议"字段(KV Cache 稳定前缀) | ✅ 已落地 |
| 2 | Agent Skills × 内容矩阵工业化:001/002 提炼成模板 Skill(Hook→数据→对比→CTA) | ✅ 已落地 |
| 3 | 两级审核流水线:旺达查数据 → 北极星查质量部署 | ✅ 已落地 |
| 4 | Agent 科普系列:《AI Agent入门》4篇 | ⛔ 叶师父否 |
| 5 | 团队记忆系统:技能沉淀+日志升级为"抽象化提取+结构化存储+可检索" | 🔄 进行中 |
| # | 建议 | 状态 |
|---|---|---|
| 1 | 调研三段式交付:数据包(事实+出处)+ 写作素材(金句/案例/结构)+ 待验证清单 | ✅ 已落地 |
| 2 | 事实核查 × 评估体系:数据可信度分级清单(A官方/B二手/C待验证) | ✅ 已落地 |
| 3 | 调研记忆系统 × 行业数据卡:每主题一张卡,同类调研先查卡不重搜(调研的 KV Cache) | ✅ 已落地 |
| 4 | Agent 科普系列数据弹药:33K star/履历/市场规模/团队真实案例 | ⛔ 随系列关闭 |
| 5 | 多Agent失败模式 × 团队自检清单:真实案例编成《团队失败模式手册》 | ✅ 已落地 |
北极星审核Rubric v1
├── 内容层(1-5分,通过线≥4)
│ ├── 事实准确性——数据有出处、可验证
│ ├── 结构完整性——Hook→数据→对比→CTA 五层
│ └── 声明一致性——标题/正文/链接三处对得上
├── 数据层(1-5分,通过线≥4)
│ ├── 可信度分级——A官方/B二手/C待验证标注完整
│ ├── 链接真伪——具体文章URL,非首页/搜索页
│ └── 数字一致性——稿件数字 vs 调研原数据逐条核
├── 部署层(Pass/Fail)
│ ├── 路径正确 / 权限644 / HTTP 200
│ └── 入口三同步(索引+知识图谱+首页卡片)
└── 否决项(一票退回,不进入打分)
├── 知识图谱未同步 = P0
├── 链接指向首页/搜索页 = 退回
└── 声明与内容不符 = 退回
落地:已写入 polaris-quality-audit skill。日常审核用三态快速版(通过/存疑/不通过),重大交付(蒸馏书/内容矩阵)用全量 Rubric 打分。✅ 已落地
核心观点:Agent 科普最适合「程序化动画」而非真人拍摄——抽象概念(上下文/工具/KV Cache)拍不出来,纯算法动画最贴切。提出 5 个选题(三齿轮公式动画/记忆窗口滑动条/RAG流水线/五角色环形拓扑/KV Cache图表)。
⛔ 随 Agent 科普系列关闭(叶师父决定不立项,视频资源回归主线内容)
| 落地项 | 牵头 | 成果位置 |
|---|---|---|
| 调研三段式交付 V2 | 旺达 | 已启用(003 起),含金句/案例/结构建议字段 |
| content-matrix-template Skill | 魔形女 | writer profile · skills/writing/ |
| team-failure-modes Skill | 魔形女 | writer profile · skills/workflow/(FM-01~05) |
| 审核 Rubric v1 | 北极星 | polaris-quality-audit skill |
| 团队失败模式手册 | 博士 | /yemaster/文档/团队手册/(HTTP 200) |
| 行业数据卡 ×4 | 旺达 | /yemaster/调研库/数据卡/(HTTP 200) |
| 《深入理解AI Agent》深度蒸馏 | 全组 | 书房 · 200.7KB / 5,666行 / 70区块 |
| 知识图谱 P0 修复 + 防回退脚本 | 博士 | verify_kg_agent.py(双文件 15 边 0 超界) |
源自旺达建议5 + 魔形女建议5:把失败经验固化为「症状→案例→根因→规则」四要素卡片。这是团队记忆系统的第一块拼图,对应书中第8章「把失败经验固化为程序」。
症状主版 kg-data.json 有数据,但页面实际加载的 kg-data-compact.json 未同步——edges 指向超界索引,页面渲染出"书没有知识点"。
案例《深入理解AI Agent》P0:compact版 b38 的 15 条 edges 全部指向 c135-c149(concepts 仅 115 个),修复后又被其他实例覆盖回超界状态。
根因图谱有两个数据文件(主版+compact版),更新时只改了一个;edges 用数字索引引用 concepts,索引漂移时无校验。
规则更新 kg-data.json 后必须:① 同步 compact 版 ② 校验全部 edges 索引 < concepts 长度 ③ curl 验证页面数据 ④ grep 验证书籍名称出现。任何一步不过 = 没完成。
症状patch 报 Permission denied,但汇报写"部署验证全部通过"——文件实际未写入。
案例内容矩阵#002:patch index.html 因文件归 root 所有失败,但汇报"部署验证全部通过"。改用"读取→修改→写/tmp→sudo cp"才真正写入。
根因网页目录多归 root 所有,patch 以 admin 身份写失败;汇报时只报"计划中的结果"没报"实际执行结果"。
规则部署后必须贴证据:① grep 确认写入 ② ls -la 确认权限 ③ curl 确认 HTTP 200。文件存在 ≠ 完成,有入口可点才算。
症状两个文件名只差一个空格/下划线(`深入理解AI Agent_蒸馏.html` vs `深入理解AI_Agent_深度蒸馏.html`),审核方检查了旧版误判新版不合格。
案例《深入理解AI Agent》P1误判:73.6KB 深色旧版 vs 200.6KB 暖色新版,文件名仅空格位置不同。
根因交付时文件名不统一;审核方按记忆中的文件名找文件。
规则交付文件命名统一:① 最终交付用唯一规范名(下划线无空格)② 交付消息写完整路径+文件大小+行数 ③ 审核前先 ls -la 确认文件大小与汇报一致。
症状凌晨 cron 触发写日志时误以为写"今天",实际应写"昨天"——导致 8/2 日志缺失。
案例8/2 日志缺失:cron 1:00 触发时误写 8/1(已存在),回复"上一轮已部署完成"——实际 8/2 文件不存在。
根因凌晨执行时对"今天/昨天"语义判断失误;多人接力时都假设别人写过了。
规则写日志前先验证:① date 确认当前日期 ② ls 确认目标文件是否存在 ③ 存在则检查内容完整性,不存在才全新写。
症状一个环节的错误(如文件名记错)传导到下游,导致审核结论错误;审核方只依赖单一信息来源(汇报文本),未独立验证。
案例《深入理解AI Agent》P0+P1:北极星依据"汇报里的数字"下结论(0知识点/181小节声明),未独立打开文件核实——实际主版知识图谱已有 15 条 edges。
根因书中第10章"错误级联放大"的多Agent失败模式:审核方基于提议方的表述而非原始事实做判断。
规则审核必须独立验证:① 打开实际文件读一遍(不看汇报)② 关键结论用命令复现(grep/curl/python)③ 汇报与事实冲突时以事实为准并指出差异。
📝 三句话总结
第一句:文件存在 ≠ 完成——入口可点、证据可查、命令可复现,三者齐备才算交付。
第二句:审核不是读汇报,是读事实——独立打开文件、用命令复现结论,才能拦住错误级联。
第三句:每次失败都提炼成"失败模式卡"(症状/案例/根因/规则),团队才能持续进化,不重复趟坑。
| 事项 | 说明 | 状态 |
|---|---|---|
| Agent 科普系列(4篇+5支视频) | 叶师父已决定不做,全组 5 条相关建议随系列关闭 | ⛔ 已关闭 |
| 团队记忆系统升级 | 失败模式手册是第一块拼图,后续:技能沉淀+日志抽象化提取+结构化存储+可检索 | 🔄 进行中 |
| 知识图谱自动化检索层 | 博士建议1:给书房图谱加 RAG 检索层(低优先级,图谱还是手工维护为主) | P2 待定 |