概念解析
什麼是 Human-in-the-Loop AI?人工審查與核准詳解

Human-in-the-Loop AI(人在迴路中的 AI,簡稱 HITL),是指在 AI 輔助任務的明確節點,由人提供判斷或授權,之後流程才繼續。有效的審查關卡會暫停具體動作,展示證據與預期影響,讓有權限的審查者選擇核准、修改、拒絕、接管或升級,並記錄任務如何恢復。
重點不是讓人對 AI 每一步都按「核准」,而是在涉及語境、後果與責任時保留人的決定權,同時讓低風險工作持續推進。
研究與揭露: Ottermind 發布本文。我們於 2026 年 8 月 26 日核對 NIST、Anthropic 與 Microsoft 的一手資料。下文的審查契約與行銷案例是原創編輯框架,不是 Ottermind 實測 benchmark。
Human-in-the-Loop AI 是什麼?
HITL 描述 AI 先完成任務的一部分,人再於一個或多個決策點介入。人可以補充背景、選擇方案、糾正理解、核准動作、拒絕提議或直接接管。判斷標準不是「有人用了軟體」,而是系統是否有明確路徑,讓人的判斷能改變下一步。
例如,AI 可依已核准的產品事實起草客戶公告;發送前,傳播負責人必須核對主張、受眾、時間和收件人,並能要求修改、拒絕或停止。訊息自動送出後才顯示免責聲明,並不構成 HITL。
訓練回饋與執行期間審查不同
| 迴路 | 人何時參與 | 人的輸入改變什麼 | 範例 |
|---|---|---|---|
| 模型開發迴路 | 標註、訓練、評估或改進 | 未來模型行為或評測 | 審查者比較模型回覆 |
| 執行期間任務迴路 | 真實任務進行時 | 當前決策、動作或交付物 | 負責人核准 Brief 後再製作資產 |
HITL 是執行控制方式,不能取代模型評測、自動檢查、存取控制和組織責任。
In-the-Loop、On-the-Loop 與 Out-of-the-Loop
| 模式 | 工作如何推進 | 人的角色 | 適用情況 |
|---|---|---|---|
| 人主導 | 人指導每個關鍵步驟 | 操作者 | 路徑仍不明確的新任務 |
| Human-in-the-Loop | 到預設關卡就暫停 | 審查者或決策者 | 高後果判斷、對外內容與重要核准 |
| Human-on-the-Loop | 系統在邊界內繼續,人可介入 | 監督者 | 可觀察、可恢復的受限操作 |
| Human-out-of-the-Loop | 日常執行不需人參與 | 政策負責人位於執行之外 | 窄範圍、低風險、充分驗證的自動化 |
同一任務可混合多種模式。完整執行結構見什麼是 Agentic Workflow?。
若要先了解更廣泛的類別定義,請閱讀什麼是 Agentic AI?。
AI 何時應暫停?
- 意圖未解決: 請求有數個實質不同的合理解讀。
- 證據薄弱或衝突: 重要主張缺少來源,或現行文件互相矛盾。
- 輸出代表個人或組織: 公開文案、客戶訊息、提案或高階建議需要審查。
- 下一步改變外部世界: 發送、發布、購買、刪除、付款、授權和修改正式紀錄。
- 政策要求可追責判斷: 法律、合約或制度要求特定角色決定。
依 影響、可逆性、可發現性和權限 選擇控制。模型信心不足以決定;AI 可能很有把握地出錯。
| 風險 | 建議控制 | 範例 |
|---|---|---|
| 低影響、可逆、易檢查 | 自動執行並保留紀錄 | 整理重複筆記 |
| 中等影響或解讀不確定 | 審查中間產物 | 選定定位方向 |
| 高影響但可逆 | 明確核准具體動作 | 排程已審查郵件 |
| 高影響且難逆轉 | 由人執行或禁止 AI 操作 | 付款或刪除紀錄 |
五欄位人工審查契約
| 欄位 | 要回答的問題 | 必須展示的資訊 |
|---|---|---|
| Action 動作 | 究竟在等待什麼? | 變更、目標、時間與範圍 |
| Evidence 證據 | 審查者憑什麼判斷? | 來源、假設、diff、預覽、檢查與風險 |
| Reviewer 審查者 | 誰具備資格與權限? | 負責角色、備援與期限 |
| Decision 決定 | 人能選什麼? | 核准、修改、拒絕、接管或升級 |
| Resume 恢復 | 各決定後如何繼續? | 保存狀態、下一步、過期行為與紀錄 |
這套 Action–Evidence–Reviewer–Decision–Resume 契約讓審查可以實作和驗證。缺少任何一項,審查者都可能無法理解請求、行使權力或讓任務恢復。
範例:審查行銷 Campaign Package
團隊向 AI 提供產品資料、客戶訪談、已核准主張和品牌規範,希望得到 Brief、落地頁、郵件和簡報。
| 關卡 | 動作 | 證據 | 負責人 | 恢復路徑 |
|---|---|---|---|---|
| 事實來源 | 從衝突說明中選擇 | 文件、日期與受影響主張 | 產品負責人 | 選來源、要求釐清或刪除主張;從證據表恢復 |
| 策略 | 將定位帶入全部資產 | 受眾證據、方案、取捨與假設 | 行銷負責人 | 核准或修改;從已核准 Brief 恢復 |
| 發布 | 發送或發布 | 預覽、主張檢查、連結、收件人和回復方案 | 渠道負責人 | 授權、退回或取消;保留草稿 |
此案例只說明方法,不是生產測試。若事實來源改變,依賴舊事實的下游產物必須標記過期;若定位被否決,應回到 Brief。完整過程見如何建立 AI 行銷工作流程。
核准之外的決定
- 核准: 從已審查狀態繼續。
- 修改: 從最早受影響的產物繼續。
- 拒絕: 停止此路徑,保留來源、中間成果與原因。
- 接管: 人完成動作,再把結果交回任務。
- 升級: 交給具備權限或專業能力的人。
- 過期: 無人及時回覆時安全停止。
有意義的審查需要背景、專業能力、時間、真實權限與可追溯性。人也有偏見;「有人看過」不是正確性證明。
常見失敗
- 審查太晚,錯誤已擴散到下游。
- 每步都核准,造成核准疲勞。
- 只顯示摘要,不顯示實際動作與影響。
- 沒有拒絕、過期和恢復路徑。
- 找有空的人,而不是有權的人。
- 回饋未改善來源、標準、權限和關卡。
如何設計 HITL 任務
- 寫明交付物與責任人。
- 拆分決定、草稿、檢查與外部動作。
- 評估影響、可逆性、可發現性和權限。
- 自動化低風險準備。
- 在模糊判斷和對外產物前審查。
- 在高後果動作前要求精確授權。
- 為每個關卡填寫五欄位契約。
- 設計修改、拒絕、接管、升級與過期。
- 上游決定改變時讓下游產物失效。
- 衡量被接受成果、修正與事故。
如何先定義資料、限制和驗收條件,可參考如何用 AI 自動化任務。
Ottermind 如何承接
Ottermind 是支援多步驟工作的 AI Agent 工作空間。任務可從目標、檔案、連結與專案背景開始,形成 Brief、報告、簡報或其他交付物。來源、決定與下游資產保持連結,團隊能審查證據表和計畫,修改方向後繼續,而不必重新開始。
Ottermind 不取代責任人或領域審查。先從邊界清楚、可檢查的交付物開始;沒有明確控制時,發送、發布、購買、刪除和修改正式紀錄應留在 Agent 權限之外。
常見問題
每個 AI 輸出都需要人工核准嗎?
不需要。控制應匹配影響、可逆性、可發現性與權限。私人草稿可事後檢查;付款或發布可能需要明確授權。
人工審查能保證 AI 正確嗎?
不能。審查者也可能缺乏背景、能力、時間或獨立性。只有證據、決定權和恢復路徑設計良好時,人工審查才會增強控制。
應該設多少關卡?
採用能保護重要決定的最少數量,優先覆蓋意圖、證據、對外代表、高後果動作和正式權限。
拒絕後怎麼辦?
保存證據與決定,停止原動作,再依預設分支修改、補充資訊、轉由人處理、升級或安全結束。
結論
Human-in-the-Loop AI 不是一句「有人會檢查」。它是具體控制設計:正確的動作暫停、正確的證據可見、正確的人擁有真實選擇,任務能安全繼續或停止。
