9.3 让Codex把材料编进知识库
这一节我们通过案例C10,完整走一遍把零散材料编入知识库的全过程。你将看到Codex怎样把多份独立的笔记自动提炼为“来源卡片”和“主题页面”,并基于整理好的知识库回答你的复杂提问,最后把问答结果沉淀回知识库。
整理痛点:散落笔记的跨文件提炼与归纳
在过去一段时间的工作中,你积累了6份零散的实操记录(包括会议行动清单、表格清洗、证据整理、权限检查、纠偏复盘和周报自动化)。这些记录单独看都很清楚,但经验分散在各个文件里:
- 想查“周报数据异常该怎么处理”,需要同时翻看异常检查、权限审批和纠偏记录三份文档;
- 其中一份关键记录没有写明确切日期,还有一项业务规范处于“待确认”状态。
如果靠人工逐篇翻找再手工做笔记,费时费力还容易遗漏。我们希望让Codex充当资料整理员:保留每份材料的来源摘要,自动提取出4个跨文件的主题页面,并基于这套知识库回答业务提问,同时把不确定的问题老老实实标出来。
编入与问答:生成来源卡片、主题页面与实战问答
整理输入材料:
继续使用已经打开的配套案例项目。C10/input/中有6份模拟业务笔记,C10/output/已经准备好用于保存本次结果。开始前确认Codex读取了C10/AGENTS.md,不需要复制目录或新建工作区。
给出任务输入:
把以下指令完整发送给Codex(内容与配套资源中的 task-input.txt 一致):
请按照
C10/AGENTS.md的规则维护这个知识库。只读取C10/input/中的6份Markdown文件,绝不修改、移动或重命名原始资料。第一步:完成知识编入 1. 在
C10/output/wiki/sources/为每份原始资料建立1个来源摘要页面,共6页; 2. 在C10/output/wiki/topics/建立4个主题页面:“来源与可追溯性”、“数据异常与待确认”、“权限与人工审批”、“纠偏与规则沉淀”; 3. 每个主题页面至少综合关联2个来源页面,并附带可点击的标准Markdown相对链接; 4. 建立C10/output/wiki/index.md总目录,列出所有页面链接与一句话简介; 5. 原始材料中缺失日期的保持缺失,“待确认”事项保持原样,明确标注。第二步:基于知识库回答提问 请结合整理好的知识库,回答:“自动周报遇到数字异常和来源缺失时,应该怎样处理?”将回答保存到
C10/output/wiki/answers/周报异常处理.md。回答必须基于这6份资料的事实,并链接到相关主题页面与原始出处。第三步:完成维护检查与日志 建立
C10/output/wiki/维护检查.md,检查是否存在失效链接、孤立页面、缺失日期或冲突说法。同时在C10/output/log.md记录本次操作日志,在C10/output/处理说明.md说明生成文件清单与人工待确认项。
观察与纠偏:
- 看有没有建立主题关联:检查Codex生成的文件。如果它只给每份文件写了摘要,而没有在主题页面里把多份文件的共同点串起来,就要提醒它:“请在主题页面中综合对比多份原始文件,不要只做单篇摘要”。
- 抽查关键事实出处:打开“数据异常与待确认”主题页,看每一条结论后面有没有附带
[查看出处](../../input/...)的链接,确保没有凭空捏造。 - 检查是否抹平了“待确认”:如果Codex把原本待定的“团队模板是否采用”自作主张写成了“已确定”,立刻要求它改回“待确认”状态,并记录在维护检查清单中。
交付验收:核对链接完整性与疑点留痕
验收时按以下四步确认:
- 检查原料库:确认
C10/input/中的6份原始文件完全没被改动; - 检查知识架构:在
C10/output/wiki/下有6个来源页、4个主题页、1个回答页和1个index.md总目录,且所有内部链接在点击后都能正确跳转; - 检查回答质量:打开
周报异常处理.md,确认它的解答综合引用了数据异常、权限审批等多份材料的内容; - 检查维护报告:打开
维护检查.md和log.md,确认准确揪出了那份缺少日期的文件和待确认事项,并记录了完整的操作日志。
完成C10后,你就拥有了一套真正能运转的AI知识库雏形。原始资料完好无损,知识卡片脉络清晰,复杂问题能基于事实精准作答,而且所有盲点和疑问都被清晰记录。以后每当有新的业务资料,只要放进C10/input/,让Codex跑一遍同样的流程,你的知识库就会自动“长大”。