概念解析

什麼是 DeepSeek Harness?架構與使用情境

2026-08-18·14 分鐘閱讀·更新於 2026-08-18

DeepSeek Harness 是由 DeepSeek AI 開發的開源 Agent 執行環境。它不是語言模型,而是提供模型周邊的運作機制,包括工作階段、工具執行、檔案系統、核准、持久化、Agent 迴圈和操作介面。它採用「一切皆外掛」的架構,開發者可以組合或替換這些部分,因此適合建置客製化程式設計 Agent、內部工具和可控的 Agent 實驗。

本指南適合正在評估 DeepSeek Harness 是否應納入 AI 技術堆疊的開發者、創辦人和技術產品團隊。讀完後,你將掌握一套實用的理解模型、架構全貌、啟動方式,以及用真實任務評估它的檢查清單。

研究與揭露: 本文由 Ottermind 發布。我們於 2026 年 8 月 17 日查閱了 DeepSeek Harness 官方儲存庫、架構文件和使用者指南。我們沒有進行受控基準測試、將專案部署到正式環境,也沒有測試所有外掛和供應商。專案目前仍處於開發者預覽階段,因此行為與相容性可能改變。

DeepSeek Harness 快速概覽

問題答案
它是什麼?一個開源 Agent Harness,也稱為 dsh
由誰開發?DeepSeek AI
它是 DeepSeek 模型嗎?不是。它是可將模型連接到工具、工作階段、政策和介面的執行環境
核心設計原則是什麼?「一切皆外掛」
底層框架是什麼?Cordis
使用者如何執行?可使用 Web UI 或無頭設定檔,也能透過設定檔與外掛組合更多功能
目前狀態如何?開發者預覽版,預期會有破壞相容性的變更
採用什麼授權?MIT
適合誰?想檢查、擴充、替換或組合 Agent 執行環境的開發者

最精簡而實用的定義是:DeepSeek Harness 是 AI 模型周邊的執行層。模型負責產生回覆和工具呼叫;Harness 決定如何組裝上下文、可用哪些工具、操作在哪裡執行、記錄哪些內容、何時需要核准,以及多步驟任務如何繼續。

Agent Harness 有什麼作用?

語言模型可以提出操作,但模型本身並不能構成完整可用的 Agent。真正可用的 Agent 需要一套圍繞模型運作的系統。

這套系統必須回答一些實際問題:

  • 哪些檔案和指示會進入模型上下文?
  • 請求會送到哪個模型供應商?
  • 模型可以呼叫哪些工具?
  • Shell 指令和檔案操作在哪裡執行?
  • 哪些操作需要核准?
  • 訊息、工具呼叫和結果如何保存?
  • 工具失敗或需要下一步時會發生什麼?
  • 開發者能否替換一項能力,而不必重建整套系統?

Agent Harness 負責協調這些職責。這個概念很重要,因為它把模型智慧與執行環境行為區分開來。即使使用相同模型,只要工具、上下文規則、權限、工作階段狀態和 Agent 迴圈不同,兩個產品的表現也可能截然不同。

DeepSeek Harness 將這套周邊系統明確公開。它不把執行環境藏在固定應用程式裡,而是以外掛、服務、事件、設定檔和設定層呈現各個部分。

DeepSeek Harness 與模型、助理、自動化工具和工作區的差異

這些類別彼此重疊,但不能互相替代。

層級主要職責範例問題
語言模型產生 Token 並進行推理哪個模型應該回應這項請求?
AI 助理為使用者提供介面和一組支援的任務我如何提出需求並檢閱回覆?
工作流程自動化依預先定義的觸發條件和動作傳遞資料發生這個事件後應該執行什麼?
Agent Harness協調模型、工具、工作階段、政策、執行與後續步驟Agent 應如何執行並記錄多步驟任務?
AI Agent 工作區讓來源、決策、任務、Agent 和交付成果保持連結這項 Agent 任務如何融入更大的專案?

這項區分可以避免常見誤解:安裝 DeepSeek Harness 並不代表安裝新的 DeepSeek 模型。Harness 仍需要設定模型供應商,也不會自動提供 Agent 任務周邊的商業上下文、審查流程或完整專案交付成果。

若要查看更廣泛的模型層比較,請參閱 2026 年最佳 AI 模型。若你更關注面向終端使用者的開發體驗,請參閱最適合開發者的 AI 助理

DeepSeek Harness 如何運作?

從整體來看,一項 DeepSeek Harness 任務會依下列 Agent 迴圈執行:

  1. 執行環境接收使用者輸入與所有排隊中的上下文。
  2. 外掛組裝系統提示詞、模型可見訊息和工具 Schema。
  3. 模型轉接器把請求送到選定的供應商。
  4. 執行環境記錄串流輸出和完整的助理訊息。
  5. 如果模型要求呼叫工具,受保護的工具管線會先檢查再執行。
  6. 工具結果回到工作階段,並可能觸發下一個模型步驟。
  7. 沒有待處理的工具、訊息或後續動作時,本輪任務結束。

官方架構文件區分 step(步驟)turn(輪次)。一個步驟包含一次模型請求及其呼叫的工具;一個輪次可以包含零個或多個步驟。當任務需要反覆觀察和操作,而不是一次回覆即可完成時,這項差異十分重要。

工作階段日誌是此流程的核心。使用者訊息、助理輸出、工具呼叫、工具結果、步驟和輪次都會成為持久事件。模型歷史由這份日誌產生,因此執行環境可以從同一條記錄流支援重播、繼續、逐字稿和持久化等工作階段行為。

DeepSeek Harness 架構解析

專案以一句話描述其架構:一切皆外掛。要理解這項主張,需要掌握五個概念。

1. Cordis 提供組合模型

DeepSeek Harness 由 Cordis 驅動。在官方架構中,外掛會向共用上下文提供服務、型別化事件和可撤銷副作用。

模型轉接器、工具登錄、工作階段日誌、Agent 迴圈、持久化層、沙箱和使用者介面都不是不可觸碰的核心,而是透過同一套組合系統提供。外掛載入時可登錄行為,卸載時這些登錄也能隨之撤銷。

這不同於在固定核心外圍只提供少量外掛 API 的應用程式。DeepSeek Harness 的設計讓執行環境的大部分功能都能透過設定替換。

2. 設定檔描述可執行的組合

設定檔(profile) 是儲存在 Harness 主目錄中的命名組合。它列出要載入的 Bundle、保存安裝在專案外的外掛,以及使用者的修補設定。

專案提供 Web 與無頭設定檔範本。Web 設定檔加入瀏覽器應用程式;無頭設定檔支援不使用伺服器的一次性操作。開發者可以使用 dsh --profile web --dump-config 檢查實際生效的外掛樹。

設定檔回答的是:這項工作應啟動哪一種 Harness 組合?

Web UI 也提供 Standard、Code、Minimal 和 Creator 等 Agent 預設。預設控制單一工作階段可使用的外掛組合,設定檔則決定啟動時更廣泛的 Harness 組合。

DeepSeek Harness Web UI 顯示 Standard、Code、Minimal 和 Creator Agent 模式

3. Bundle 封裝有序設定

Bundle 用來發布 Cordis 設定列及其掛載的程式碼。Bundle 依順序堆疊載入,接著套用設定檔層級、主目錄層級的修補,以及命令列修補覆寫。

這種分層方式讓開發者可以從標準組合開始,只替換選定的設定列,而不必 Fork 整個執行環境。這也代表設定順序很重要:後載入的層可以修改先前 Bundle 插入的行為。

4. 事件連接執行環境行為

DeepSeek Harness 使用多個事件領域:

  • 工作階段事件記錄重新載入後仍須保留的持久事實。
  • Agent 事件公開進行中的工作,包括請求、步驟、狀態、驗證和後續執行。
  • 能力事件把供應商與政策附加到檔案系統、工具和遙測等邊界。

事件讓外掛能在明確記載的位置觀察、攔截、擴充或終止行為,也減少無關套件直接匯入並修改 Agent 迴圈的需求。

5. 能力接縫讓供應商可替換

能力接縫(capability seam) 將三種角色分開:服務定義、實作服務的供應商,以及使用服務的消費者。

例如,檔案系統和子程序供應商可以共用同一個執行環境。更換供應商後,Shell、終端機和語言伺服器行為可以移到另一個沙箱,不必由每個消費者各自實作遠端路徑。

同樣的模式也適用於模型轉接器、工具、子 Agent、持久化、憑證、遙測、終端機、工作和介面整合。

理解 DeepSeek Harness 的實用模型

官方架構十分詳盡。進行專案規劃時,可以將它濃縮為五個層級。

層級需要定義的內容應檢查的證據
1. 意圖與輸入目標、來源上下文、排除項目和驗收標準已核准的任務說明和納入的訊息
2. Agent 迴圈何時規劃、請求模型、呼叫工具、繼續或停止步驟、輪次和 Agent 事件
3. 模型與工具供應商、模型、提示詞區段、Schema 和工具登錄生效的設定檔和工具呼叫
4. 執行邊界檔案系統、子程序、沙箱、權限、憑證和核准政策供應商設定、核准記錄和指令範圍
5. 持久證據訊息、工具結果、失敗、輸出和未解決風險工作階段日誌、逐字稿、檢查結果和產出物

編輯框架: 以上五層理解模型是 Ottermind 依據 DeepSeek Harness 官方架構整理的編輯框架,並非 DeepSeek 官方圖示,也不代表我們已對每一層進行基準測試。

這套模型也適合評估其他 Agent Harness。第三層的展示成功,不能證明執行邊界安全,也不能證明最終證據足以供他人審查。

「一切皆外掛」在實務上代表什麼?

外掛設計改變了開發者擴充執行環境的方式。

你可以向語言模型服務登錄轉接器來新增模型供應商,透過工具登錄增加模型可見能力,利用檔案系統供應商替換檔案存取方式,透過沙箱後端限制指令,使用工作服務加入背景作業,或建立另一個介面來驅動 Agent 並呈現工作階段事件。

它的實際優勢是不必永久維護 Fork 也能組合能力。團隊可以在現有外掛旁掛載能力,或修補一個設定列,而不必為每次客製化都修改中央迴圈。

代價是彈性會把複雜度轉移到架構和設定。開發者需要了解外掛擁有權、事件順序、服務邊界、修補分層、版本相容性和第三方程式碼權限。「一切皆外掛」不代表每個外掛都能安全安裝或輕鬆維護。

DeepSeek Harness 能做什麼?

確切行為取決於啟用的設定檔和外掛,但官方專案提供了支援以下任務類型的基礎能力。

儲存庫與程式設計任務

配備適當的檔案系統、子程序、終端機和語言伺服器能力後,Agent 可以檢查工作區、編輯檔案、執行指令並回傳驗證證據。Harness 負責協調這些操作;儲存庫指示、測試和人工審查仍然決定變更是否可接受。

客製化內部 Agent

團隊可以為範圍狹窄的內部工作組合專用設定檔,例如移轉助理、驗證器、支援除錯 Agent、測試執行器或領域專用開發工具。精簡設定檔可以只公開該工作真正需要的能力。

如需了解專用 Agent 在日常營運中的應用,請參閱適合小型企業的 AI Agent

模型與供應商實驗

由於模型存取由轉接器隔離,開發者可以比較不同設定,或在不重新設計工具和工作階段層的情況下支援其他供應商。有效評估仍需要固定任務、重複執行、評分標準和明確記錄的限制。

沙箱或遠端執行

能力供應商可以將檔案系統和子程序行為移到受控執行環境。這適合不應在本機存取的情境,但供應商、憑證路徑、網路規則、隔離方式和失敗行為都必須視為信任邊界的一部分加以審查。

新介面與 Agent 體驗

Web UI 只是一種介面,不是完整的產品定義。外掛和工作階段事件可以支援其他編輯器、用戶端或專用檢視,並共用底層 Agent 與工作階段行為。

DeepSeek Harness 外掛

開發者可以將可重用的供應商、工具、政策、整合或介面行為封裝為外掛。官方專案建議使用 dsh-plugin GitHub Topic 提高可發現性。授予外掛存取儲存庫、憑證、Shell 或網路的權限前,應把它視為可執行程式碼進行審查。

DeepSeek Harness 設定頁面顯示已安裝外掛及其啟用狀態

如何執行 DeepSeek Harness

官方 npm 快速入門需要 Node.js。執行 npx @deepseek-ai/dsh web

預設情況下,這個指令會在 http://127.0.0.1:3080 啟動 Web UI。使用者可以在其中設定模型供應商、選擇工作區並開始工作階段。

DeepSeek Harness Web UI 提示使用者選擇工作區並開始工作階段

負責任的首次執行應使用:

  • 小型示範儲存庫,而不是正式環境程式碼庫;
  • 合成或非敏感輸入;
  • 範圍嚴格限制的工作區;
  • 明確的核准政策;
  • 現有測試或檢查;
  • 具有清楚停止條件的任務。

從原始碼執行的開發者可以複製官方儲存庫、安裝相依套件、建置專案並執行 Web 設定檔。由於專案變化迅速,應記錄實驗使用的 Commit 或 Release。

DeepSeek Harness 只能使用 DeepSeek 模型嗎?

Harness 由 DeepSeek AI 開發,但架構透過轉接器隔離模型存取。官方文件將模型轉接器描述為可替換外掛,並提供新增供應商的擴充點。

因此,這個執行環境不只是單一模型的包裝。這不保證所有供應商或模型都有相同表現;工具呼叫、串流傳輸、訊息格式、上下文限制、憑證和錯誤行為都可能不同。每個轉接器和預計使用的模型仍需個別測試。

權限、沙箱與安全性

Agent 執行環境可以結合模型輸出、檔案存取、指令、憑證、網路呼叫和第三方外掛,因此設定本身就是安全模型的一部分。

使用 DeepSeek Harness 處理重要工作前:

  • 將工作區限制在任務真正需要的檔案;
  • 不要在提示詞和交接文件中放入 API Key 或正式環境憑證;
  • 安裝前檢查外掛、修補、指令碼和外部呼叫;
  • 對後果重大的操作使用核准政策;
  • 確認檔案系統和子程序供應商實際在哪裡執行;
  • 要求執行儲存庫平常使用的測試、Lint、型別檢查和安全檢查;
  • 由人工負責人審查最終 Diff 和指令歷史;
  • 如實記錄失敗和未經驗證的假設,不要隱藏。

沙箱能降低部分風險,但不能證明模型輸出、外掛程式碼、網路目的地或產生的變更值得信任。

DeepSeek Harness 的限制

最重要的限制是目前狀態。官方 README 將 DeepSeek Harness 標示為開發者預覽版,並警告將出現破壞相容性的變更。

這會帶來一些實際影響:

  • 設定檔、外掛、設定和 API 可能需要移轉。
  • 文件和範例可能跟不上快速變動的實作。
  • 與某個版本相容的外掛可能無法在另一個版本運作。
  • 團隊必須自行負責測試、版本鎖定、升級和營運支援。
  • 彈性的執行環境可能比代管式助理更考驗技術判斷。

因此,DeepSeek Harness 更適合希望檢查和塑造 Agent 執行環境的團隊,而不是只想要穩定、完整程式設計助理的使用者。它也不能取代專案需求、程式碼審查、安全政策或領域專業知識。

誰適合使用 DeepSeek Harness?

如果你至少有以下一項需求,DeepSeek Harness 值得評估:

  • 需要可組合的 Agent 執行環境,而不是固定助理;
  • 需要客製化工具、供應商、政策、介面或執行後端;
  • 需要可檢查的工作階段與工具事件;
  • 需要針對不同 Agent 環境的設定檔;
  • 需要研究 Agent 架構的平台;
  • 需要控制 Agent 操作在哪裡、以何種方式執行。

若你需要保證相容性、最少設定、集中式企業管理,或團隊無意自行維護的成熟任務體驗,應暫緩採用或選擇代管程度更高的產品。

如果你正在比較更廣泛的產品類別,AI Agent 工作區指南說明了不同工具在上下文、執行、可重複性、審查和交接方面的差異。

Ottermind 在其中扮演什麼角色?

DeepSeek Harness 更接近 Agent 執行環境層。真實專案還會包含客戶證據、研究、任務說明、決策、審查、文件、簡報和後續任務。

Ottermind 是面向真實工作的 AI Agent 工作區。它可以圍繞邊界明確的技術任務,讓更廣泛的專案上下文及交付成果保持連結。團隊可以在 Ottermind 準備實作說明和驗收標準,在受控 Harness 工作區執行儲存庫任務,再回傳經驗證的結果用於文件記錄和審查。

產品團隊可以透過產品團隊最佳 AI 工具指南比較周邊的規劃、研究和交付技術堆疊。

我們沒有發現或測試 DeepSeek Harness 與 Ottermind 之間的原生一鍵整合。目前應將兩者的關係視為明確的產出物交接,而不是已存在的連接器或產品承諾。

如何判斷 DeepSeek Harness 是否適合你

採用前請檢查以下問題:

  1. 你是否需要替換或組合 Agent 執行環境的部分能力?
  2. 團隊能否維護外掛、設定檔、修補和版本升級?
  3. 目標任務是否受到工作區、權限和驗收標準的明確限制?
  4. 你能否檢查供應商、工具、沙箱、憑證和網路邊界?
  5. Agent 之外是否還有測試和人工審查?
  6. 工作階段證據是否足以讓其他人驗證結果?
  7. 專案能否承受開發者預覽版帶來的變更?

若大多數答案是肯定的,DeepSeek Harness 為建置客製化 Agent 提供了少見且高度可檢查的基礎。若大多數答案是否定的,可以先使用代管式助理或 Agent 工作區,等到執行環境控制需求變得明確後再重新評估 Harness。

「什麼是 DeepSeek Harness?」的答案

DeepSeek Harness 不是新模型,也不只是一個聊天介面。它是一個開源、由外掛組合而成的執行環境,用來將模型連接到工具、工作階段、執行環境、政策和使用者體驗。

它的價值在於控制力:開發者可以檢查事件流、替換供應商、組合設定檔並擴充能力,不必把 Agent 迴圈視為封閉黑盒。它的成本在於責任:團隊必須在快速變動的開發者預覽階段,自行承擔架構、權限、外掛信任、測試和相容性工作。

下一項任務:Ottermind 中定義一項邊界清楚的 Agent 工作,列出來源資料、允許的工作區、權限、驗收標準和所需證據。再使用這份說明判斷 DeepSeek Harness 是否需要為該工作建立客製設定檔、外掛或供應商。

來源

下載桌面端與行動端 App

隨時隨地使用 Ottermind。

電腦