如何让 AI 整理多份资料:统一口径、发现冲突和保留来源
给多份材料编号,统一字段和时间口径,区分共识与差异,让 AI 合并资料时不把矛盾悄悄抹掉。
相关工具
合并资料不等于把段落拼起来
多份资料可能时间不同、口径不同、观点不同。AI 如果只追求一份顺滑的总结,很容易把冲突抹平。可靠的整理应先统一结构,再区分共识、差异和待确认事项。
资料中关于上下文、信息提取、事实核验和结构化输出的内容,正好可以用来处理多来源任务。先让模型知道每份材料是谁、什么时候形成、用于什么,再要求它提取同一组字段,最后比较这些字段。
如果直接说“综合下面所有资料写一份报告”,模型可能把不同时间的数字当成同一时期,把个人观点写成共同结论,把一份材料的限定条件漏掉。合并前多做一步对齐,通常比事后修补更省力。

材料编号、来源、共同事实、差异观点、冲突事项、待确认问题和最终结论组成整理框架。
先给每份材料建立身份
在 Prompt 中给材料编号,例如材料 A、材料 B、材料 C,并补充标题、来源、形成时间、作者或机构、适用范围和用途。编号不是形式要求,它让后续引用有了稳定位置。
如果材料来自不同渠道,要说明可信度和使用目的。官方记录、用户反馈、个人观点和媒体报道可能都能提供信息,但它们支持的结论不同。不要让模型只因为文字写得确定,就把它当成最高等级证据。
材料之间有版本关系时,要明确哪个是最新版本、哪个只用于背景参考。新版本不一定自动推翻旧版本,旧版本可能解释变化过程。要求 AI 说明采用依据和时间范围,比简单地“以最新为准”更稳。
每份材料还要有边界。网页中的评论、引用和脚注是否纳入分析?表格中的备注是否是正式数据?如果不说明,模型可能把所有文字放在同一层处理。
先抽取统一字段,再进行比较
多资料合并的核心,是让每份材料回答同一组问题。字段可以包括对象、时间、指标、事实、观点、原因、影响、建议和来源位置。先结构化抽取,再做比较,能减少模型被段落顺序带偏。
字段名称要统一,但不能强行统一不同概念。例如“用户数量”和“活跃用户数”不是同一个字段;“收入”和“合同金额”也不能因为都是金额就直接放进同一列。遇到可能不同的字段,应保留原名称并标记不可直接比较。
空值要有统一处理方式。材料没有提到,写未提及;材料明确说没有,写无;材料存在但无法读取,写待核验。不要把三种情况都变成空白,也不要用 AI 猜一个缺失值。
如果材料很长,可以分两步做:先让 AI 为每份材料生成结构化卡片,再把卡片交给第二轮 Prompt 比较和合并。这样既减少上下文混乱,也方便人工核对来源。
统一时间、对象和统计口径
很多冲突并不是真冲突,而是时间、对象或口径不同。一个数据是月度,另一个是季度;一个统计全部用户,另一个只统计付费用户;一个记录订单数,另一个记录订单金额。直接比较一定会产生误导。
让 AI 比较数据前,先输出对齐表:时间范围、对象范围、指标定义、单位、数据来源和计算方式。任何一项不同,都先标记不可直接比较,并说明需要怎样转换或补充信息。
可以允许模型做单位换算,但要求保留原始数值、换算规则和近似误差。涉及统计口径时,不要让模型自行把多个指标换成一个“综合数”,除非用户明确提供了计算方法。
如果资料只有叙述没有原始数据,AI 可以整理说法差异,但不能假装完成了数值对比。没有统一基线时,最可靠的输出可能是“暂时无法比较”和一份需要补充的数据清单。

给材料编号、提取统一字段、对齐时间口径,再区分共识、差异和冲突。
把共识、差异和冲突分开
共识是多份材料在对象、时间和口径可比的前提下都支持的内容;差异是材料关注点或观点不同,但不一定互相否定;冲突则是对同一对象、同一时间和同一口径给出了不一致说法。
这三类内容不要放在同一段里。共识可以合并表达,但保留来源;差异需要分别说明各自视角;冲突要列出材料 A 和材料 B 的说法、证据位置和可能原因,不要为了写得顺而选择一个。
冲突可能来自数据版本、采集方式、定义变化、样本差异或真实变化。让 AI 列出可能原因和需要核验的材料,但不要让它在没有证据时宣布哪一方正确。
如果用户明确要求给出判断,可以按照事先提供的证据优先级进行选择,并说明依据。如果没有优先级,就输出建议判断和不确定性,而不是把推测写成最终事实。
来源要跟着结论走
合并报告最容易失去的是来源。最终结论看起来像一段新写的文字,读者却不知道它来自哪份材料。对关键事实、数字、差异和冲突,至少保留材料编号和章节、页码或段落定位。
引用不是把所有原文都复制一遍。可以在结构化表格中加入来源字段,正文只给简短标记,附录再列详细位置。这样既便于核对,也不会让报告被重复引用撑长。
如果多份材料共同支持一个结论,可以列出多个来源;如果结论只来自一份材料,明确写单一来源,不要用“资料显示”制造共识感。来源数量不等于证据强度,关键是来源是否独立、适用范围是否一致。
无法定位来源的内容要标记为待核验。对 AI 来说,找不到来源并不代表内容一定错误,但代表这条内容暂时不能作为高可信结论使用。

可靠合并会统一时间、单位、对象和来源,并保留不能直接比较与存在冲突的部分。
一份多资料整理 Prompt
下面的模板适合整理多份报告、会议记录、调研材料和 资料 内容。材料较长时,建议先分份提取,再进行第二轮合并。
示例 Prompt: 任务:根据材料 A、材料 B 和材料 C,整理一份可核对的综合结果。 材料信息:为每份材料保留编号、标题、来源、时间、作者或机构、适用范围和用途。 第一步:分别提取对象、时间、指标定义、关键事实、观点、原因、影响、建议和来源位置;材料未提及写未提及,无法确认写待核验。 第二步:对齐时间、对象、单位、统计口径和术语;不能直接比较的字段保留原名并说明原因。 第三步:把内容分为共同支持、不同观点、直接冲突和待确认事项;不要为了流畅合并冲突或把单一来源写成共识。 输出:一、材料清单;二、字段对齐表;三、共同事实;四、差异与冲突;五、综合结论;六、待确认问题;七、来源索引。 规则:关键数字、结论和冲突必须标记材料编号及定位;不得补造缺失数据,不得用推测替代来源。 材料:<<<分别粘贴并标记材料 A、B、C>>>。
生成后可以继续要求:请检查综合结论是否超出了单份材料的证据范围,是否混用了不同时间和口径,是否遗漏了冲突,是否每个关键事实都能回到来源位置。
资料合并后仍然需要人工判断
AI 很适合完成材料编号、字段提取、重复信息归并和差异初筛,但它不能自动知道哪份材料在组织内部更有权威,也不能凭文字风格判断事实真假。涉及决策的结论,仍需要业务人员核对来源和适用条件。
人工复核可以优先看三类内容:会改变结论的数字,单一来源支撑的重要判断,以及被 AI 判定为共识或冲突的关键内容。对其余低影响表达问题,可以在后续润色阶段处理。
多份资料整理得好不好,不在于最后的报告读起来多顺,而在于读者能不能知道哪些内容已经确认,哪些只是不同说法,哪些问题还需要补证据。保留差异和来源,报告可能少一点确定语气,却多一层可信度。
常见问题
多份资料内容矛盾时,AI 应该选哪一份?
先检查时间、对象、指标和口径是否一致;确认是真冲突后保留双方说法和来源,只有在明确的证据优先级下才选择其中一方。
资料没有页码或段落定位怎么办?
使用材料编号、标题、章节或原文短句定位;如果无法定位,标记为待核验,不要假装有精确来源。
先合并再让 AI 统一口径可以吗?
不建议。应先识别时间、对象、单位和指标差异,再决定哪些内容可以比较,避免把不可比数据合并成一个结论。