展开知识库目录
长文件一次塞不下,先让 AI 建目录、分章节、留页码
几百页材料别一口气全丢给 AI。先让它列目录和章节结构,再按问题挑章节处理,最后回到原文核对,这样既不会漏重点,结果也查得到出处。
先统计文件、页数和章节结构
上下文窗口是有限的,长材料必须分批送,批次之间还要能接上。几十个文件、几百页材料一次塞进去,前面的细节会被后面的内容冲淡,重点互相淹没。先把材料拆成批次,再规定每批只回答哪组问题。
分批处理的代价是上下文断裂:第二批可能忘掉第一批的术语和口径。所以要提前写一张“任务单”,固定术语、问题和输出格式,每批开头都贴一遍,最后再检查跨批次的口径是否一致。
这些情况适合用,另外几种先停一下
适合用
- 材料超过几十页,或一个任务涉及多个文件
- 需要跨章节比较观点或找重复内容
- 结果要写进论文、报告并要求能回查
先别急着用
- 只有几段话,直接放进对话就能处理
- 材料涉及保密协议,先确认能否上传
先分批次、固定术语,再按批问答,最后做跨批次一致性检查
为什么这样安排
Claude Code 官方文档在大型代码库场景强调按目录分块加载,避免上下文越界;这正是分批处理加固定规则的来源。
- 01
先建批次地图
先把文件分成几批,批内按目录、章节和图表建地图,明确每批的页码范围。
- 02
固定术语与问题
把问题和术语写进任务单,每批开头贴一遍,避免批次之间口径漂移。
- 03
分批只答本批问题
每批只回答本批材料覆盖的问题,跨批的问题留到最后一轮统一核对。
- 04
跨批次一致性检查
最后检查各批结论里的术语、数字和口径是否一致,不一致就回到原文定位原因。
复制前先替换 {占位}
长材料分批处理提示词(复制后改 {占位})
我有一批长材料要处理,请按下面的流程来:
1. 先列材料地图:文件清单、章节结构、图表位置、页码范围;
2. 我把问题清单给你后,分批读取相关章节,一次只回答本批问题;
3. 每条结论带“文件/页码/原句”;
4. 批次之间保持同一套术语和问题口径;
5. 最后做跨批次一致性检查,矛盾处单独标出。
材料:{粘贴或说明材料位置}
问题清单:{问题1、问题2}300 页报告处理示例
下面是已经填过变量的示例。复制时请换成自己的文件名、数字和材料位置,别把示例数据原样交出去。
看清格式再改
300 页报告处理示例
第一步:目录与页码范围共 12 章 第二步:问题清单按优先级排 3 条 第三步:只读第 4、7、9 章回答问题 1 结论格式:结论 + 页码 + 原句 待确认:第 9 章两组数据口径不同 抽样回查:3 条结论 2 条页码一致,1 条已修正
先对症状,别一上来重写整段提示词
前面的内容到后面被忘掉
- 常见原因
- 一次处理范围太大
- 怎么修
- 缩小到单个章节,先建地图再分批提问。
结论有页码,但页码对不上
- 常见原因
- PDF 页码与印刷页码不一致
- 怎么修
- 先确认页码口径,再用原文关键词二次定位。
两轮提问后口径变了
- 常见原因
- 没有把问题和术语固定下来
- 怎么修
- 把问题清单和术语定义放在每轮开头。
最后五分钟,逐项打勾
这篇具体参考了什么
正文按公开教程和官方文档重新整理,并换成了可以直接操作的中文场景。产品能力、规则和投稿要求会更新,真正执行前请再打开原始页面核对一次。
