操作指南
如何核查 AI 內容:七步證據工作流程

核查 AI 內容時,先把文字拆分成不可再分的事實聲明,再按風險為這些聲明排序,為每項聲明定義可接受的來源,在生成答案之外獨立搜尋,記錄確切證據,並依據證據修訂內容。不要讓同一個 AI 自行完成最終稽核,然後把它的結論當成核查結果。
研究與披露: 本工作流程參考了 Google Fact Check Explorer、NIST 生成式 AI 風險指南,以及 2026 年 9 月 4 日 Google 美國 SERP 中馬里蘭大學和亞利桑那大學提供的橫向閱讀指南。七步方法和模板均為原創編輯框架。
第一步:凍結草稿並提取事實聲明
保留生成草稿原樣不動,把它作為來源記錄。將每個可核查的陳述複製到事實聲明清單中。拆分複合句,使每一行都能對應自己的證據和結論。
需要檢查的內容包括姓名、日期、數字、引語、因果陳述、產品能力、法律、價格、排名,以及對某個來源內容的轉述。純粹觀點和明確標註的建議不需要接受同等處理,但支撐它們的事實前提需要核查。
第二步:標記風險與時效性
| 級別 | 示例 | 審查深度 |
|---|---|---|
| 關鍵 | 健康、法律、安全、金融、針對個人的指控 | 由具備資質的審查者檢查權威證據 |
| 高 | 客戶承諾、就業、上市公司聲明 | 原始來源加上責任人審批 |
| 中 | 產品功能、統計資料、歸因建議 | 目前直接來源和編輯審查 |
| 低 | 穩定的背景資訊 | 可靠來源和常規編輯審查 |
時效性需要單獨標記。一家公司的創始人可能是穩定事實,但其現任 CEO、價格和產品限制可能發生變化。時效性聲明需要帶日期的來源,並在臨近發布時重新檢查。
第三步:設定來源層級
搜尋之前,先說明什麼證據可以解決這項聲明:
- 法律、監管機構、標準組織、原始資料集、官方文件、正式檔案或直接聲明。
- 同行評審研究,或方法公開、信譽良好的機構。
- 能夠連結其證據的可靠獨立報導。
- 用於理解背景的二手解釋,不能替代可以獲得的原始來源。
- 明確標記為個案證據的社群報告。
十個頁面重複同一條未經支援的統計資料,並不等於十個來源。沿引用鏈繼續查詢,直到找到資訊源頭。
第四步:進行橫向閱讀
離開目前頁面,調查來源本身。在不同標籤頁中搜尋相關組織、作者、聲明措辭、日期和獨立報導。檢查該頁面是否具有與聲明相匹配的專業能力、利益動機、糾錯機制和發布歷史。
核查引語時,開啟原始文字記錄或出版物,閱讀前後語境。核查統計資料時,檢查研究物件、樣本、方法、日期和分母。
第五步:建立證據臺賬
聲明 ID:
聲明原文:
風險和時效性:
所需來源類型:
來源 URL 和發布者:
發布或更新日期:
確切的支援段落或資料欄位:
背景或限制:
結論:支援 / 反駁 / 證據混合 / 未解決
審查者和審查日期:
對草稿所做的修改:臺賬讓不確定性保持可見,也讓另一位編輯可以複核同一決定。儲存相關段落,因為網頁可能在發布後發生變化。
第六步:依據證據修訂
不要強行讓證據適應草稿。修正數字、收窄因果措辭、補充日期、區分企業聲明和實測結果、刪除虛構引語,並移除仍然無法解決的聲明。如果來源存在分歧,應說明分歧,並解釋以哪項證據為準。
第七步:執行最終完整性檢查
確認每項重要聲明都有正確引用,每個連結都能開啟預期來源,並且引用段落確實支援相鄰文字。檢查修訂過程是否引入了新的數字或絕對化聲明。對於高影響工作,應安排第二位審查者簽字確認。
完整示例:核查產品對比
假設 AI 草稿寫道:“平台 A 是速度最快的研究助手,支援所有常見檔案類型,並且在一項大學研究中把報告準備時間縮短了 60%。”
這句話至少包含三項聲明,而不是一項:
| 聲明 | 風險 | 所需證據 | 可能的處理方式 |
|---|---|---|---|
| 平台 A 速度最快 | 高風險、比較性 | 方法公開的目前獨立基準測試 | 沒有合適基準時刪除 |
| 它支援所有常見檔案類型 | 中風險、時效性強 | 目前官方相容性文件 | 改為帶日期的具體格式清單 |
| 它把準備時間縮短了 60% | 高風險、定量 | 原始研究、研究物件、方法和結果 | 準確歸因,否則刪除 |
先搜尋包含 60% 的原始措辭。如果十篇文章都重複這一數字,但最終全部指向供應商新聞稿,那麼仍然只有一個存在利益關係的來源。如果底層研究存在,就開啟它,檢查參與者是誰、“報告準備”如何定義、採用什麼基線,以及結果屬於平均值、自我報告還是實測結果。
修訂後的文字可以是:
截至 2026 年 9 月 4 日審查時,平台 A 的文件列出了 PDF、DOCX 和 PPTX 匯入支援。在供應商面向自身客戶開展的一項贊助研究中,參與者報告稱準備時間有所縮短,但該研究並不能證明這款產品是速度最快的選擇。
這句話不那麼吸引眼球,卻更有用。它把已核實的能力和帶有限定條件的研究聲明分開,並刪除了缺乏支援的最高階表述。
如何檢查不同類型的聲明
數字和百分比
找到原始表格、資料集、正式檔案或方法部分。核對單位、分母、地區、時間段、樣本以及數字是否經過調整。注意不要把百分點變化描述成百分比變化。如果底層數值可用,應重新計算簡單合計。
引語
搜尋一段具有辨識度的確切措辭,然後開啟原始文字記錄、錄音、正式檔案、演講或出版物。確認發言者、措辭、日期和前後語境。不要把轉述改成帶引號的直接引語。
產品功能和價格
使用目前官方文件和價格頁面,記錄審查日期,並註明適用套餐、地區、平台或限制。產品頁面可以證明供應商提供或聲稱提供什麼,但不能獨立證明實際效能。
科學與健康聲明
優先使用原始同行評審研究和權威健康機構資料。檢查研究設計、研究物件、終點、不確定性和後續證據。不要把相關性改寫為因果關係,也不要把初步結果寫成已確立的指導意見。
法律、法規和政策
使用目前官方文字,並註明司法管轄區、生效日期和適用範圍。二手法律部落格可以幫助定位問題,但不應作為最終權威。採取建議或行動前,應由具備資質的人員審查。
關於個人或組織的聲明
確認身份,並使用直接記錄或可靠報導。不要僅僅因為生成文字中出現了某項指控就重複傳播。考慮該聲明是否必要、適度、目前有效,並且具有公平完整的語境。
分兩次使用 AI,並賦予不同角色
AI 可以在兩個相互分離的階段發揮作用。第一階段作為提取器,在不判斷真偽的情況下識別聲明、日期、實體、引語和隱含比較。第二階段在獲得來源後作為證據整理器,把段落與聲明對應起來,呈現矛盾,並起草帶有限定條件的修訂版本。
審查者需要獨立於這兩個階段。不要讓一個模型在同一次對話中生成聲明、搜尋支援、判斷支援是否充分,再批准發布。分離職責更容易暴露確認偏誤和缺失證據。
編輯簽字檢查清單
[ ] 每個重要事實句都出現在聲明清單中。
[ ] 高風險和時效性強的聲明在最接近發布時間時得到檢查。
[ ] 引用連結可以開啟並指向預期版本。
[ ] 引用段落支援相鄰文字的確切措辭。
[ ] 在可獲取時檢查了原始資料、引語和政策文字。
[ ] 供應商聲明和贊助研究均已標註。
[ ] 衝突、不確定性和缺失證據保持可見。
[ ] 表格、圖片說明、FAQ 和 CTA 與正文接受了同等審查。
[ ] 第二位審查者批准了關鍵聲明。
[ ] 證據臺賬和最終版本已按照政策保留。在團隊內劃分工作
對於長篇報告,應按聲明類型或章節分配工作,不要讓多名審查者在職責不明的情況下同時修改同一份臺賬。一名研究員可以檢查企業和產品聲明,另一名檢查資料和方法,領域專家則審查高影響解釋。
使用統一的結論詞彙,並要求每位審查者記錄證據、日期和理由。主編負責解決重疊部分,並確認不同章節採用相同的來源標準。
審查負責人:負責範圍、來源層級、衝突處理和最終簽字。
聲明負責人:查詢證據並提出處理結論。
領域審查者:判斷專業性或後果性內容。
文字編輯:使最終措辭和引用與已批准證據一致。
發布負責人:確認目前連結、披露資訊和審批狀態。在最終文字編輯期間凍結臺賬,或者自動跟蹤新聲明。否則,潤色後的改寫可能在研究結束後引入未經檢查的比較、日期或因果陳述。
處理發布後的糾錯
已發布的聲明受到質疑時,重新開啟對應的聲明記錄。保留原始措辭、證據、發布版本、質疑、調查、決定、修正和通知。如果讀者或下游使用者可能已經依據錯誤內容採取行動,不要悄悄替換具有後果的錯誤。
判斷問題來自證據不可用、引用不匹配、事實過期、解釋錯誤,還是審批後的編輯變更。把案例加入後續審查培訓和自動化檢查。
為時效性聲明安排重新核查。價格、產品限制、職位、法律和政策即使在最初核查時沒有錯誤,也可能隨時間變得不正確。
無效的常見捷徑
只問“這是真的嗎?” 寬泛問題只會引出另一個流暢答案。應要求拆分後的事實聲明和確切證據。
計算搜尋結果數量。 重複內容可能來自轉載、複製的行銷文案或同一份原始報告。真正需要計算的是相互獨立的證據鏈。
自動信任熟悉的域名。 即使權威網站也可能包含舊頁面、觀點、使用者內容,以及超出其專業領域的材料。應判斷具體頁面是否適合這項聲明。
只檢查統計資料。 姓名、日期、否定詞、套餐限制、歸因和因果措辭出錯時同樣可能造成嚴重影響。
寫完以後再裝飾性地補引用。 這種做法容易選擇僅僅與聲明主題相似的來源。證據驅動的修訂會在支援不足時改變或刪除聲明。
保留不確定性的事實核查提示詞
從所附草稿中提取不可再分的事實聲明。
返回包含聲明、類型、風險、時效性和所需來源類型的表格。
初步結論只能使用已提供來源。
引用確切的支援段落,幷包含來源 URL 和日期。
把混合或缺失證據標記為未解決。不得虛構引用、
靜默改寫草稿,也不得作出最終法律、醫療或安全決定。AI 事實核查工具指南說明了如何評估適合這套工作流程的工具。提示詞工程指南則展示瞭如何清晰定義證據要求和輸出契約。
常見問題
可以使用 AI 核查 AI 生成的文字嗎?
可以用它提取聲明、輔助搜尋和整理證據。但人必須檢查原始來源,並批准具有後果的結論。
每項聲明需要多少個來源?
來源品質比數量更重要。一項目前、權威的原始來源可能足以解決直接聲明;有爭議、涉及因果關係或影響較大的聲明通常需要獨立佐證。
來源意見不一致時應該怎麼辦?
記錄分歧,比較方法和日期,優先使用事先定義的來源類型,收窄聲明;如果證據無法支援負責任的結論,就將其標記為未解決。
可以信任 AI 生成的引用嗎?
在開啟連結、確認它是預期來源並且直接支援聲明之前,不應信任任何引用。虛構引用和引用錯配是常見失敗模式。
事實核查需要多長時間?
這取決於聲明數量和風險。應先進行分級:包含多項法律或定量聲明的短文,可能比長篇觀點文章需要更多審查時間。按聲明類型跟蹤用時,以便後續簡報預留現實的審查預算。
截圖算證據嗎?
截圖可以儲存頁面當時的樣貌,但還要記錄 URL、日期、所有者和前後語境。如果無法追溯到真實來源,截圖只能算薄弱證據。
應該如何處理匿名來源?
遵循出版機構的編輯政策,並評估其接觸資訊的條件、動機、佐證和風險。AI 無法僅憑一段引語獨立確認匿名來源的身份或可信度。
已發布文章應該在什麼時候重新核查?
為時效性聲明設定複查週期,並在重要來源、產品、法律、職位、研究或外部質疑發生變化後重新檢查。穩定的歷史聲明可能不需要定期重新整理。
將草稿、已批准來源和臺賬模板放入 Ottermind,生成一份證據和未解決問題始終相互關聯、可供審查的交付物。
