與 Claude Opus 4.6 對話

AI ChatClaude Opus 4.6

Claude Opus 4.6 是什麼?

Claude Opus 4.6 是 Anthropic 為高難度程式開發與知識工作打造的模型,於 2026 年 2 月 5 日發布。API ID 是 claude-opus-4-6,接受文字和圖像輸入,輸出文字。 截至 2026 年 9 月 8 日,Opus 系列最新已發布型號是 7 月 24 日推出的 Claude Opus 5。產品頁仍以 4.8 為標題,但供應情況段落已介紹 5。本頁專門討論仍可使用的 4.6。

目前的 4.6 API

  • 把相關證據放在同一脈絡: 此型號的 API 概覽列出 100 萬 token 上下文與 12.8 萬 token 最大輸出。目前的上下文文件將 100 萬設為預設,不需 beta 標頭,也沒有長上下文加價。保留來源標籤,並為回答預留空間;容量大不保證能準確找回資訊。
  • 自適應推理: 自適應思考讓模型決定何時深入推理,文件列出的預設 effort 為 high。舊式延伸思考已棄用。介面提供選項時,可在小修改上測試較低強度。4.6 已不提供快速模式:依定價文件,帶 speed: fast 的請求仍以標準速度執行、按標準費率計費。
  • 一個具體費用範例: 標準 API 定價為每百萬輸入 token 5 美元、每百萬輸出 token 25 美元。20,000 個輸入加 4,000 個計費輸出 token,基本費用為 0.20 美元,尚未計入快取、工具與其他調整。這是供應商費率,並非 Ottermind 定價;重試會增加任務總成本。

四項值得用 Opus 4.6 嘗試的任務

發布資料強調程式碼審查與長輸入檢索。以下任務將這些能力轉成可以核查的成果,並在重要環節保留人工複核。

  • 審查程式庫內的跨檔案變更

    提供 diff、受影響的呼叫端與介面行為規格。要求列出附檔案引用及重現測試的失敗路徑,再依重要性排序。有用的成果是經得起驗證的缺陷報告,而不是更長的推測性問題清單。

  • 從一組文件追查說法

    提供有日期的報告與固定頁碼標籤。要求找出支持或反駁某項說法的段落,包括附錄中的例外。採用結論前逐一打開引用段落。大視窗有助於整合相關證據,但不保證引用正確。

  • 先解釋差異,再做簡報

    提供預算、實際數字與加總公式。要求拆解差異,分清數量、價格及缺漏資料的影響,再產出簡短簡報大綱。發表前先用試算表工具重算;純文字分析不會執行活頁簿。

  • 依可測試階段實作規格

    從產品說明、驗收案例與明確排除項目開始。要求分成小步實作,每一步都檢查、測試後再繼續。這呼應下方社群紀錄的分步做法,也讓你有機會及早否決不合適的設計。

Claude Opus 4.6 與 Claude Opus 5 比較

選擇依據Claude Opus 4.6Claude Opus 5
標準輸入 / 輸出每百萬 token 5 / 25 美元每百萬 token 5 / 25 美元
上下文 / 最大輸出100 萬 / 12.8 萬 token100 萬 / 12.8 萬 token
目前定位仍可使用的舊版模型目前的 Opus 型號
評估目的保留已驗證的 4.6 行為基準用相同難題評估遷移結果

今天如何選用 4.6

值得評估的理由

  • 為既有工作保留穩定參照: 當提示詞或整合依賴 4.6 的行為,一組已複核輸出就有價值。同時保留成功與失敗案例,以便比較替代型號。Opus 5 概覽介紹了較新的選擇;視窗大小相同不代表答案相同。
  • 讓分析銜接交付成果: 透過 Ottermind 將審查說明、證據表或簡報大綱帶入下一階段。把尚未釐清的假設一併保留,讓下一次修訂能處理。可用模型與工具取決於帳戶。

需要衡量的取捨

  • 單價相同,帳單可能不同: 定價文件指出,Claude 4.7 與後續版本採用的新分詞器,對同一文字產生的 token 約多 30%,實際增幅依工作負載而異。比較 4.6 與 5 的實際用量和重試次數;相同費率或單看 token 數,都不足以判斷哪個完成任務更便宜。
  • 用戶端行為會影響體驗: Anthropic 的 4 月 23 日檢討將品質問題歸因於 Claude 用戶端的三項變更,已於 4 月 20 日解決,API 未受影響。比較執行結果時記錄用戶端版本與 effort,不要假設每次變化都來自模型。

使用者的實際回饋

這些是個人經驗,不代表共識或受控基準。它們提醒你該在自己的環境測試什麼,並非通用的品質或速度排名。

逐步引導依然重要

在一則 Hacker News 留言中,Frannky 描述先寫產品需求文件,再逐步執行計畫,成功完成前端、後端與演算法工作的經驗。作者也提到有些想法不好,需要引導。這份紀錄支持設置檢查點,不能證明無人監督也會正確。

簡單請求也可能思考太久

在 3 月的 Cursor 討論中,有人回報簡單問題思考數分鐘,另一人則只遇過一次。支援人員要求提供請求 ID。這是該用戶端曾出現此類問題的證據,不代表今天的 API 總有相同延遲。

在 Ottermind 繼續

1

設定可核查的目標

提供相關證據、允許的範圍和驗收檢查。說明需要問題發現、修補計畫,還是有來源支持的解釋。

2

在 Studio 確認模型

前往 Studio,必要時登入。帳戶可用時再選擇 Claude Opus 4.6,並查看使用條款。本頁不會自動選取模型,也不保證存取權限。

3

驗證後再往下走

執行測試、核對原文,或重新計算總數。將已驗收發現和未解決問題一起帶入後續工作。

Claude Opus 4.6 常見問題

Opus 4.6 已退役了嗎?

截至 2026 年 9 月 8 日,概覽標為 Legacy,生命週期表則列為 Active,退役不早於 2027 年 2 月 5 日。這不是已公告的停用日期。合作平台可能有不同時程。

100 萬上下文仍需發布時的 beta 嗎?

不需要。目前 Claude API 文件將 100 萬列為預設,採標準價格且不需 beta 標頭。2 月發布文章的 beta 與加價描述的是當時狀態。請確認實際使用應用程式的限制。

它能原生產生圖像或編輯檔案嗎?

原生輸入是文字和圖像,原生輸出是文字。瀏覽網頁、執行程式碼與編輯檔案需要應用程式提供工具。解釋試算表應如何修改,不代表修改已經實際套用。

在這裡使用 Opus 4.6 免費嗎?

本頁不承諾免費使用或模型存取權限。提示詞會帶入 Studio,可用性、工具與費用依帳戶而定。開始前請確認模型。

把難題轉成經過核查的成果

將證據帶進 Ottermind Studio,從可以檢查、測試的發現繼續推進。