操作指南
如何核查 AI 内容:七步证据工作流

核查 AI 内容时,先把文本拆分成不可再分的事实声明,再按风险为这些声明排序,为每项声明定义可接受的来源,在生成答案之外独立搜索,记录确切证据,并依据证据修订内容。不要让同一个 AI 自行完成最终审核,然后把它的结论当成核查结果。
研究与披露: 本工作流参考了 Google Fact Check Explorer、NIST 生成式 AI 风险指南,以及 2026 年 9 月 4 日 Google 美国 SERP 中马里兰大学和亚利桑那大学提供的横向阅读指南。七步方法和模板均为原创编辑框架。
第一步:冻结草稿并提取事实声明
保留生成草稿原样不动,把它作为来源记录。将每个可核查的陈述复制到事实声明清单中。拆分复合句,使每一行都能对应自己的证据和结论。
需要检查的内容包括姓名、日期、数字、引语、因果陈述、产品能力、法律、价格、排名,以及对某个来源内容的转述。纯粹观点和明确标注的建议不需要接受同等处理,但支撑它们的事实前提需要核查。
第二步:标记风险与时效性
| 级别 | 示例 | 审查深度 |
|---|---|---|
| 关键 | 健康、法律、安全、金融、针对个人的指控 | 由具备资质的审查者检查权威证据 |
| 高 | 客户承诺、就业、上市公司声明 | 原始来源加上责任人审批 |
| 中 | 产品功能、统计数据、归因建议 | 当前直接来源和编辑审查 |
| 低 | 稳定的背景信息 | 可靠来源和常规编辑审查 |
时效性需要单独标记。一家公司的创始人可能是稳定事实,但其现任 CEO、价格和产品限制可能发生变化。时效性声明需要带日期的来源,并在临近发布时重新检查。
第三步:设定来源层级
搜索之前,先说明什么证据可以解决这项声明:
- 法律、监管机构、标准组织、原始数据集、官方文档、正式文件或直接声明。
- 同行评审研究,或方法公开、信誉良好的机构。
- 能够链接其证据的可靠独立报道。
- 用于理解背景的二手解释,不能替代可以获得的原始来源。
- 明确标记为个案证据的社区报告。
十个页面重复同一条未经支持的统计数据,并不等于十个来源。沿引用链继续查找,直到找到信息源头。
第四步:进行横向阅读
离开当前页面,调查来源本身。在不同标签页中搜索相关组织、作者、声明措辞、日期和独立报道。检查该页面是否具有与声明相匹配的专业能力、利益动机、纠错机制和发布历史。
核查引语时,打开原始文字记录或出版物,阅读前后语境。核查统计数据时,检查研究对象、样本、方法、日期和分母。
第五步:建立证据台账
声明 ID:
声明原文:
风险和时效性:
所需来源类型:
来源 URL 和发布者:
发布或更新日期:
确切的支持段落或数据字段:
背景或限制:
结论:支持 / 反驳 / 证据混合 / 未解决
审查者和审查日期:
对草稿所做的修改:台账让不确定性保持可见,也让另一位编辑可以复核同一决定。保存相关段落,因为网页可能在发布后发生变化。
第六步:依据证据修订
不要强行让证据适应草稿。修正数字、收窄因果措辞、补充日期、区分企业声明和实测结果、删除虚构引语,并移除仍然无法解决的声明。如果来源存在分歧,应说明分歧,并解释以哪项证据为准。
第七步:执行最终完整性检查
确认每项重要声明都有正确引用,每个链接都能打开预期来源,并且引用段落确实支持相邻文字。检查修订过程是否引入了新的数字或绝对化声明。对于高影响工作,应安排第二位审查者签字确认。
完整示例:核查产品对比
假设 AI 草稿写道:“平台 A 是速度最快的研究助手,支持所有常见文件类型,并且在一项大学研究中把报告准备时间缩短了 60%。”
这句话至少包含三项声明,而不是一项:
| 声明 | 风险 | 所需证据 | 可能的处理方式 |
|---|---|---|---|
| 平台 A 速度最快 | 高风险、比较性 | 方法公开的当前独立基准测试 | 没有合适基准时删除 |
| 它支持所有常见文件类型 | 中风险、时效性强 | 当前官方兼容性文档 | 改为带日期的具体格式清单 |
| 它把准备时间缩短了 60% | 高风险、定量 | 原始研究、研究对象、方法和结果 | 准确归因,否则删除 |
先搜索包含 60% 的原始措辞。如果十篇文章都重复这一数字,但最终全部指向供应商新闻稿,那么仍然只有一个存在利益关系的来源。如果底层研究存在,就打开它,检查参与者是谁、“报告准备”如何定义、采用什么基线,以及结果属于平均值、自我报告还是实测结果。
修订后的文字可以是:
截至 2026 年 9 月 4 日审查时,平台 A 的文档列出了 PDF、DOCX 和 PPTX 导入支持。在供应商面向自身客户开展的一项赞助研究中,参与者报告称准备时间有所缩短,但该研究并不能证明这款产品是速度最快的选择。
这句话不那么吸引眼球,却更有用。它把已核实的能力和带有限定条件的研究声明分开,并删除了缺乏支持的最高级表述。
如何检查不同类型的声明
数字和百分比
找到原始表格、数据集、正式文件或方法部分。核对单位、分母、地区、时间段、样本以及数字是否经过调整。注意不要把百分点变化描述成百分比变化。如果底层数值可用,应重新计算简单合计。
引语
搜索一段具有辨识度的确切措辞,然后打开原始文字记录、录音、正式文件、演讲或出版物。确认发言者、措辞、日期和前后语境。不要把转述改成带引号的直接引语。
产品功能和价格
使用当前官方文档和价格页面,记录审查日期,并注明适用套餐、地区、平台或限制。产品页面可以证明供应商提供或声称提供什么,但不能独立证明实际性能。
科学与健康声明
优先使用原始同行评审研究和权威健康机构资料。检查研究设计、研究对象、终点、不确定性和后续证据。不要把相关性改写为因果关系,也不要把初步结果写成已确立的指导意见。
法律、法规和政策
使用当前官方文本,并注明司法管辖区、生效日期和适用范围。二手法律博客可以帮助定位问题,但不应作为最终权威。采取建议或行动前,应由具备资质的人员审查。
关于个人或组织的声明
确认身份,并使用直接记录或可靠报道。不要仅仅因为生成文本中出现了某项指控就重复传播。考虑该声明是否必要、适度、当前有效,并且具有公平完整的语境。
分两次使用 AI,并赋予不同角色
AI 可以在两个相互分离的阶段发挥作用。第一阶段作为提取器,在不判断真伪的情况下识别声明、日期、实体、引语和隐含比较。第二阶段在获得来源后作为证据整理器,把段落与声明对应起来,呈现矛盾,并起草带有限定条件的修订版本。
审查者需要独立于这两个阶段。不要让一个模型在同一次对话中生成声明、搜索支持、判断支持是否充分,再批准发布。分离职责更容易暴露确认偏误和缺失证据。
编辑签字检查清单
[ ] 每个重要事实句都出现在声明清单中。
[ ] 高风险和时效性强的声明在最接近发布时间时得到检查。
[ ] 引用链接可以打开并指向预期版本。
[ ] 引用段落支持相邻文字的确切措辞。
[ ] 在可获取时检查了原始数据、引语和政策文本。
[ ] 供应商声明和赞助研究均已标注。
[ ] 冲突、不确定性和缺失证据保持可见。
[ ] 表格、图片说明、FAQ 和 CTA 与正文接受了同等审查。
[ ] 第二位审查者批准了关键声明。
[ ] 证据台账和最终版本已按照政策保留。在团队内划分工作
对于长篇报告,应按声明类型或章节分配工作,不要让多名审查者在职责不明的情况下同时修改同一份台账。一名研究员可以检查企业和产品声明,另一名检查数据和方法,领域专家则审查高影响解释。
使用统一的结论词汇,并要求每位审查者记录证据、日期和理由。主编负责解决重叠部分,并确认不同章节采用相同的来源标准。
审查负责人:负责范围、来源层级、冲突处理和最终签字。
声明负责人:查找证据并提出处理结论。
领域审查者:判断专业性或后果性内容。
文字编辑:使最终措辞和引用与已批准证据一致。
发布负责人:确认当前链接、披露信息和审批状态。在最终文字编辑期间冻结台账,或者自动跟踪新声明。否则,润色后的改写可能在研究结束后引入未经检查的比较、日期或因果陈述。
处理发布后的纠错
已发布的声明受到质疑时,重新打开对应的声明记录。保留原始措辞、证据、发布版本、质疑、调查、决定、修正和通知。如果读者或下游用户可能已经依据错误内容采取行动,不要悄悄替换具有后果的错误。
判断问题来自证据不可用、引用不匹配、事实过期、解释错误,还是审批后的编辑变更。把案例加入后续审查培训和自动化检查。
为时效性声明安排重新核查。价格、产品限制、职位、法律和政策即使在最初核查时没有错误,也可能随时间变得不正确。
无效的常见捷径
只问“这是真的吗?” 宽泛问题只会引出另一个流畅答案。应要求拆分后的事实声明和确切证据。
计算搜索结果数量。 重复内容可能来自转载、复制的营销文案或同一份原始报告。真正需要计算的是相互独立的证据链。
自动信任熟悉的域名。 即使权威网站也可能包含旧页面、观点、用户内容,以及超出其专业领域的材料。应判断具体页面是否适合这项声明。
只检查统计数据。 姓名、日期、否定词、套餐限制、归因和因果措辞出错时同样可能造成严重影响。
写完以后再装饰性地补引用。 这种做法容易选择仅仅与声明主题相似的来源。证据驱动的修订会在支持不足时改变或删除声明。
保留不确定性的事实核查提示词
从所附草稿中提取不可再分的事实声明。
返回包含声明、类型、风险、时效性和所需来源类型的表格。
初步结论只能使用已提供来源。
引用确切的支持段落,并包含来源 URL 和日期。
把混合或缺失证据标记为未解决。不得虚构引用、
静默改写草稿,也不得作出最终法律、医疗或安全决定。AI 事实核查工具指南说明了如何评估适合这套工作流的工具。提示词工程指南则展示了如何清晰定义证据要求和输出契约。
常见问题
可以使用 AI 核查 AI 生成的文本吗?
可以用它提取声明、辅助搜索和整理证据。但人必须检查原始来源,并批准具有后果的结论。
每项声明需要多少个来源?
来源质量比数量更重要。一项当前、权威的原始来源可能足以解决直接声明;有争议、涉及因果关系或影响较大的声明通常需要独立佐证。
来源意见不一致时应该怎么办?
记录分歧,比较方法和日期,优先使用事先定义的来源类型,收窄声明;如果证据无法支持负责任的结论,就将其标记为未解决。
可以信任 AI 生成的引用吗?
在打开链接、确认它是预期来源并且直接支持声明之前,不应信任任何引用。虚构引用和引用错配是常见失败模式。
事实核查需要多长时间?
这取决于声明数量和风险。应先进行分级:包含多项法律或定量声明的短文,可能比长篇观点文章需要更多审查时间。按声明类型跟踪用时,以便后续简报预留现实的审查预算。
截图算证据吗?
截图可以保存页面当时的样貌,但还要记录 URL、日期、所有者和前后语境。如果无法追溯到真实来源,截图只能算薄弱证据。
应该如何处理匿名来源?
遵循出版机构的编辑政策,并评估其接触信息的条件、动机、佐证和风险。AI 无法仅凭一段引语独立确认匿名来源的身份或可信度。
已发布文章应该在什么时候重新核查?
为时效性声明设定复查周期,并在重要来源、产品、法律、职位、研究或外部质疑发生变化后重新检查。稳定的历史声明可能不需要定期刷新。
将草稿、已批准来源和台账模板放入 Ottermind,生成一份证据和未解决问题始终相互关联、可供审查的交付物。
