操作指南

AI 文件審查工作流程:從來源包到批准草稿

2026-09-04·閱讀時間:14 分鐘·更新於 2026-09-04

AI 文件審查工作流程應該把一組範圍明確的來源檔案轉換成人員能夠核實的結構化發現。AI 可以盤點檔案、提取條款或事實、比較版本、標記缺口並起草報告,但不應隱藏來源衝突、虛構缺失內容,或作出最終法律、財務、就業或安全決定。

研究與披露: 本工作流程參考了 IBM 文件工作流程指南IBM 文件處理指南NIST 生成式 AI 配套框架,資料查核日期為 2026 年 9 月 4 日。審查矩陣和驗收清單均為原創編輯框架,不能替代具備資質的專業審查。

AI 文件審查適合什麼場景

它適合在一組已知文件中處理範圍明確、可重複的問題:比較政策版本、尋找缺失欄位、為法律顧問整理合約條款、從招標檔案中提取要求、將報告與來源檔案核對,或者準備盡職調查索引。

不要從“審查所有內容”這種沒有定義的請求開始。應明確決定、文件、問題、證據標準、審查者和輸出。

選擇審查模式

模式目的典型輸出
提取定位指定事實、條款、要求或欄位包含來源位置的結構化表格
比較識別新增、刪除和含義變化版本矩陣和重大差異
合規檢查按明確規則集比較文件逐項控制發現和缺口
盡職調查為專家判斷組織證據問題清單、證據、責任歸屬和待解決問題
品質審查按來源和驗收標準檢查草稿修正、缺乏支援的聲明和批准狀態
探索尋找供進一步調查的模式或問題與已核實發現明確分離的假設

一個專案可以採用多種模式,但應將其作為可見階段分別執行。探索假設不能悄悄變成合規發現。

第一步:鎖定來源清單

分析前建立清單:

欄位目的
文件 ID 和檔名建立穩定引用
版本和生效日期防止與過期文字比較
來源和負責人確立權威性
敏感級別和存取限制暴露
納入或排除讓範圍可見
取代關係解決版本關係

將原件保持為只讀。記錄任何損壞、不完整、重複或超出範圍的檔案。

定義來源權威順序

分析前先寫下衝突處理規則。政策審查中,目前已簽署政策可能優先於手冊草稿;合約工作中,已執行的修訂可能取代原始條款;研究中,原始資料集可能優先於後續摘要。

系統應保留兩個來源並解釋所應用的關係。不要從記錄中刪除優先順序較低的版本,因為它可能解釋過去決定或揭示遷移問題。

按來源而不只是專案控制存取

來源包可能組合具有不同權限的文件。確認審查者和處理系統有權存取每份檔案。不要因為所有專案參與者都能看到最終摘要,就讓他們同時存取受限附錄。

派生筆記可能繼承存取限制。即使只提取一條簡短條款,也可能暴露個人、法律、財務或安全敏感內容。

第二步:定義審查模式結構

先把審查問題轉換成欄位,再要求系統給出結論。

Prompt
審查目標:
必需文件集合:
主題或條款:
提取措辭:
文件 ID 以及頁碼或章節:
生效日期:
與基線的差異:
問題類型:
影響:
缺失資訊:
建議審查者:
狀態:待處理 / 已確認 / 已解決 / 超出範圍

結構模式能夠讓缺口保持可見。敘述式摘要經常把缺失、衝突和不確定性模糊成流暢文字。

新增 extraction_statusreview_statusdecision_status 欄位。一項發現可能成功提取,卻受到審查者質疑,並且仍在等待授權決定。單一的 complete 欄位無法表達這些差異。

對模式和審查標準進行版本控制。要求變化時,確定哪些發現必須重新執行。比較不同版本的問題數量時,必須考慮規則集是擴大還是縮小。

第三步:準備文件

開始實質審查前:

  1. 確認檔案完整性、格式、可讀性、頁數和語言。
  2. 檢測重複和近似重複檔案,但不要過早刪除證據。
  3. 保留表格、分欄、頁首、腳註、簽名和修訂記錄的佈局。
  4. 在需要時執行 OCR,並保留置信度或品質訊號。
  5. 在有意義的邊界處拆分大檔案,同時保留頁碼引用。
  6. 識別缺失的附件、附表、連結檔案和被引用文件。
  7. 標記手寫、已脫敏、損壞或僅含圖片的區域,交由人工處理。

只提取文字可能破壞含義。表格轉換品質較差時,“排除”列中的值可能顯示在“包括”標題旁邊。信任批次結果前,應先抽查複雜佈局。

第四步:先提取,再解釋

第一輪只返回相關文字以及文件和位置引用,並將樣本與原件核對。完成這一步後,才能讓系統為差異分類或綜合發現。把提取與解釋分開,更容易發現錯誤。

對於表格和掃描檔案,應驗證佈局、單位、標題、腳註和 OCR。一個識別正確的數字仍可能被放到錯誤列中。

採用兩輪提取設計。第一輪識別候選位置,第二輪從這些位置返回確切段落和結構化欄位。跨文件類型和佈局比較樣本,並加入本不應該找到相關內容的頁面。

不要只測準確率,也要測遺漏。一次審查可能正確返回五項條款,卻漏掉第六項必需條款;它看起來準確,實際仍不完整。

第五步:建立問題與證據矩陣

為每個問題保留支援段落、衝突來源、缺失檔案、所用規則和審查決定。使用 unresolved 標記缺口,不要用看似可能的答案填補。

按影響和置信度確定優先順序:

  • 高影響、低置信度立即交由專家審查;
  • 高影響、高置信度仍需責任人批准;
  • 低影響、低置信度可以抽查或退回補充說明;
  • 低影響、高置信度可按工作流程已批准規則繼續。

使用穩定的問題類別

類別可以包括缺失要求、措辭衝突、義務變化、來源過期、負責人未定義、聲明缺乏支援、證據無法存取、計算不匹配、審批缺口和超出範圍。穩定類別有助於分流,並揭示重複的流程問題。

每個問題都應包含影響理由,而不只是嚴重程度標籤。審查者需要知道誰或什麼受到影響,以及哪項決定被阻止。

保留分歧

如果兩位審查者對一項條款有不同解釋,應記錄雙方立場、支援段落以及有權決定的人。不要讓 AI 把分歧融合成折中句子。

第六步:使用可追溯引用起草

每項重要發現都應連結到來源位置。區分文件原文、審查者解釋和 AI 建議。來源衝突時,應說明衝突和來源優先順序規則,而不是靜默選擇其中一項。

Prompt
僅使用已批准的來源清單生成審查矩陣。
引用最少量的相關段落,並註明文件 ID 以及頁碼或章節。
將提取、解釋和建議相互分離。
把缺失或衝突證據標記為未解決。
不得作出最終法律、財務、就業或安全決定。

為已確認發現、未解決問題、範圍限制和建議分別建立章節。建議應該引用它所回應的發現,並指定決策人。

避免製造置信度假象。只有定義並驗證了含義,數值置信度才有用。來源品質、提取置信度、規則匹配和審查者一致性是不同訊號。

第七步:審查、修訂並批准固定版本

審查者開啟引用位置、修正矩陣、解決或升級問題,併為特定輸出版本簽字。如果來源包發生變化,應識別受影響發現並重新批准,不能沿用舊批准。

使用原因程式碼記錄修正:證據遺漏、位置錯誤、提取錯誤、解釋錯誤、來源過期、範圍變化或審查者偏好。這樣可以把審查工作轉化為評估集,並判斷系統是否改進。

最終批准應說明覆蓋範圍。批准問題清單不會自動批准合約、付款、政策或發布。

完整示例:審查政策版本

一家公司必須在上線前,把新的差旅政策與目前員工手冊、地區費用規則和經理指南比較。

來源清單

團隊記錄四份檔案及其負責人和日期。政策草稿不具有權威性;地區費用規則決定當地報銷限額,在新政策獲批前,已簽署的員工手冊決定公司範圍內的措辭。

審查結構模式

必需主題包括資格、預訂、批准限額、收據、例外、安全、地區差異、資料處理、生效日期和負責人。每一行都需要確切措辭,以及每個適用來源中的位置。

提取與比較

AI 提取候選段落,確定性檢查識別幣種和數字差異。比較結果發現,草稿提高了一項餐費限額、刪除了一項收據例外,並指定了一個組織目錄中不存在的審批角色。

問題矩陣

限額變化分配給財務,刪除例外分配給 HR 和法務,不存在的角色分配給政策營運。某個地區缺少來源,因此該行保持未解決。

草稿與批准

系統起草一份帶引用和被阻止事項清單的決策備忘錄,但不會宣稱政策已經就緒。負責人解決問題,將修訂來源作為新版本加入,重新執行受影響條目,再由授權政策負責人批准固定版本。

這套工作流程在溝通開始前暴露了缺失來源和不存在的角色,因此取得成功。

按文件類型選擇審查模式

合約

針對簽約方、期限、續約、價格、義務、資料、安全、責任、終止、適用法律和引用附表建立條款矩陣。與已批准基線比較,但將法律判斷交給法律顧問。

招標檔案

把每項要求映射到回應位置、負責人、狀態、證據和例外。區分強制措辭、評分指南和問題。單獨驗證提交說明、日期、格式和附件。

研究報告

提取重要聲明、方法、研究物件、日期、限制、資助和源資料。檢查草稿是否把相關性改寫成因果關係,或把結論推廣到研究物件之外。

政策和流程

跟蹤權威、生效日期、適用性、角色、必需操作、例外、記錄和被取代文件。確認培訓和溝通使用的是已批准版本。

財務或營運報告

把數字追溯到來源表格、單位、篩選條件、期間和轉換過程。重新計算重要合計,並與權威系統對賬。

安全與提示詞注入控制

文件文字是不受信任的輸入。簡歷、合約或網頁匯出內容可能包含讓 AI 忽略審查範圍、洩露其他檔案或使用工具的指令。處理系統應把這些文字視為文件內容,絕不能視為系統權限。

限制可存取來源和工具,隔離專案,最小化權限,驗證結構化輸出,並要求外部操作獲得批准。記錄每次執行存取過哪些來源和工具。上線前使用含有對抗性指令的文件進行測試。

不要透過跨專案搜尋索引暴露某一方的受限文件。必須在查詢時執行檢索權限,並讓快取或派生內容遵循同一權限。

衡量審查品質與成本

指標定義
發現召回率已發現的必需發現 / 已知必需發現
引用準確率正確支援位置 / 返回的引用
重大錯誤率存在後果性提取或解釋錯誤的發現
未解決問題可見性正確保留的真實缺口 / 已知缺口
審查者修正時間檢查、修正和批准所需時間
返工率下游使用後重新開啟的審查
每項批准審查的成本處理、工具、審查者和修正成本

根據已完成審查建立帶標籤的資料集,並加入沒有發現問題的文件。模型、提取、提示詞、結構模式、來源類型或審查標準變化後重新評估。

圍繞證據設計審查介面

在結構化發現旁邊顯示原始頁面和提取段落。審查者應能檢視前後語境、比較版本、修正欄位、改變處理狀態、分配負責人和記錄理由,同時不丟失來源位置。

謹慎使用視覺狀態。不能只用顏色表達嚴重程度或批准情況。使用文字和可存取控制元件區分機器建議、人工已審查、已解決和已授權狀態。

將相關發現分組並優先顯示重要問題,以減輕審查疲勞,但必須保留檢查完整來源的方法。隱藏低置信度行可能造成審查原本要發現的遺漏。

跟蹤能夠改進工作流程的互動證據:被修正欄位、被拒絕發現、被替換來源、被升級衝突,以及按問題類型統計的時間。不要把滑鼠移動或表面操作當成審查品質指標。

校準人工抽樣

上線早期審查每項發現。之後,如果實測表現和政策允許,可以抽查確定性的低風險提取。對於高影響問題、新文件類型、變更後的模型、已確認事故和接近決策閾值的案例,繼續進行完整審查。

對部分樣本使用盲法雙人審查,測量審查者一致性。分歧可能說明標準模糊,而不是 AI 失敗。應澄清量表、保留合理不確定性,不要在合格專家意見不同時強迫達成共識。

逐步上線

先在人工審查旁邊以影子模式執行。下一階段讓 AI 準備提取表,但仍由審查者作出所有發現。然後允許低風險發現進入問題矩陣並接受完整審查。只有實測表現達標後,工作流程才能自動路由或起草最終交付物。

為敏感、異常、無法存取或具有對抗性的文件保留人工路徑。擴充到新語言、司法管轄區、條款集或檔案格式屬於新的驗證範圍,而不是普通設定開關。

驗收檢查清單

  1. 來源清單完整且具有存取控制。

  2. 每項重要發現都有文件和位置引用。

  3. 已將提取樣本與原件核對。

  4. 缺失和衝突證據保持可見。

  5. 受限資料沒有進入未經批准的系統。

  6. 高影響發現具有指定的合格審查者。

  7. 已批准輸出和來源版本得到記錄。

  8. 修正可用於未來評估。

  9. 文件內容無法改變系統權限或審查規則。

  10. 人工備用和來源變更後的失效路徑已經測試。

文件工作流程自動化指南介紹接收、路由、異常和保留。AI 知識管理指南則說明如何在更廣泛的資料集合中管理來源責任和時效性。

常見問題

AI 可以審查合約嗎?

AI 可以提取和比較條款、整理問題並準備審查矩陣。尤其在措辭、司法管轄區或缺失語境會影響結論時,應由具備資質的法律顧問作出法律解釋和決定。

如何減少文件審查中的幻覺?

限制來源集合,先提取再綜合,要求精確到位置的引用,使用結構化欄位,允許結果保持未解決,並讓審查者開啟原件。

封閉式文件審查應該允許 AI 使用網頁搜尋嗎?

只有範圍明確允許時才可以。將外部研究與依據所提供記錄得出的發現分開,並標記每種來源,使審查者知道結論由什麼證據決定。

審查完成後應該保留什麼?

根據適用記錄政策保留來源清單、已批准輸出、問題矩陣、審查者決定和必要審計記錄。避免保留不必要的敏感提示詞或中間內容。

AI 文件審查必須達到多高準確率?

按照發現類型和影響設定驗收標準。即使實測準確率很高,高影響條款或數字仍可能需要完整人工檢查。在代表性文件上同時測量召回率和準確率。

AI 可以同時比較數百份文件嗎?

它可以輔助批次提取和比較,但數量增加會提高檔案遺漏、引用失效、語境丟失和隱藏異常的風險。應使用清單、分階段處理、抽樣、對賬和明確的失敗報告。

批准後來源發生變化怎麼辦?

建立新的來源版本,識別並重新執行受影響發現,在含義或證據變化時重新批准。按照保留政策儲存之前獲批的記錄。

審查者應該看到 AI 置信度分數嗎?

只有在分數含義已經驗證且不會鼓勵自動化偏差時才顯示。來源段落、規則、影響和不確定原因通常比單一百分比更可操作。

審查者修正可以自動用於訓練系統嗎?

可以把修正保留為候選評估或訓練資料,但重複使用前要審查其品質、權限、隱私和代表性。匆忙作出的修正不會自動成為標準答案。

Ottermind 中使用來源清單、審查結構模式和驗收清單啟動審查,使最終文件始終與背後的證據和決定相連線。

下載桌面端與行動端 App

隨時隨地使用 Ottermind。

電腦