值得評估的理由
- 已知的行為基準: 既有提示詞、驗收通過的修補與複核過的文件,能建立實用的 4.5 基準。也要留下具代表性的失敗案例。如此才能依實際工作評估替代模型,而非只看第一次回答是否漂亮。
- 讓規劃接上下一步行動: 把分析轉成範圍明確的實作說明、有來源依據的備忘錄,或試算表檢查項目。Ottermind 協助將這份說明銜接到下一階段。模型與工具是否可用取決於帳戶;頁面本身不代表已取得存取權。
Claude Opus 4.5 是 Anthropic 為程式開發、代理與複雜知識工作推出的推理模型,於 2025 年 11 月 24 日發布。固定 API ID 為 claude-opus-4-5-20251101,別名為 claude-opus-4-5。它接受文字與影像輸入,輸出文字。 截至 2026 年 9 月 8 日查核,Opus 系列最新已發布型號是 2026 年 7 月 24 日推出的 Claude Opus 5。Opus 產品頁標題仍寫 4.8,但公告及供應情況已介紹 5。本頁專注於文件仍列為可用的 4.5。
問題有多個互相牽動的限制條件時,最值得考慮它。以下範圍明確的任務,能幫你判斷額外推理是否有助於實際工作。
提供請求 ID、各服務的紀錄,以及最後一次正常運作的行為。要求先整理時間軸、可能原因與區分原因的測試,再產生修補。這能協助辨別是 API 故障、過期的用戶端狀態,還是重試讓同一操作執行兩次。
提供新舊介面、相容性要求與代表性測試。要求規劃含回復節點的分階段遷移,再逐一處理模組邊界。除了編譯,也要檢查呼叫端與資料格式,避免整齊的重構在無形中改變原有約定。
附上有日期的提案、會議紀錄與決策標準。要求指出歧異、支持段落及各選項背後的假設。逐一查核建議來源,否則流暢的彙整可能掩蓋兩份文件之間尚未解決的衝突。
提供欄位定義、範例資料列、公式與預期合計。要求說明單位、缺漏值或重複紀錄可能如何影響結論。請在試算表工具中重新計算建議的修正;解釋合理,不代表活頁簿真的執行過。
| 選擇依據 | Claude Opus 4.5 | Claude Opus 5 |
|---|---|---|
| 標準 API 輸入 / 輸出 | 每百萬 token 5 / 25 美元 | 每百萬 token 5 / 25 美元 |
| 上下文 / 最大輸出 | 200K / 64K token | 1M / 128K token |
| 思考方式 | 延伸思考 | 自適應思考 |
| 評估理由 | 保留已測試的 4.5 工作流程,或重現過往結果 | 以較長輸入和相同驗收案例測試目前的 Opus |
這些討論記錄的是 4.5 發布期間與後續數週的個人經驗,不是共識,也不是目前的受控基準測試。用戶端、任務及訂閱方案都會影響體驗。
在 Hacker News 發布討論中,一位 Amp 團隊成員表示,早期內部使用的 Opus 4.5 平均對話成本低於 Sonnet 4.5。這是相關業者未控制變因的觀察。它說明值得衡量完成任務的成本,並不能保證每位使用者都省錢。
在一位非程式開發者的心得中,作者表示修正橫向篩選器捲動位置花了六次嘗試,額度也消耗得更快。回覆看法不同:有人肯定 Opus 處理陌生問題,也有人偏好 Sonnet 執行精確指示。截圖和有說服力的回答,無法取代真正重現互動。
提供錯誤、相關來源與限制條件。說明需要的成果,例如含重現步驟的診斷、遷移順序,或附來源段落的備忘錄。
前往 Studio,視需要登入。帳戶可使用時,再選擇 Claude Opus 4.5 並確認使用條款。本頁不會自動選取模型,也不保證存取權。
執行重現步驟、檢查差異,或重新計算數字。將已驗收的發現與待解問題放在一起,讓下一步建立在核實過的工作上。
截至 2026 年 9 月 8 日,概覽標示為 Legacy,而生命週期表列為 Active,退役時間不早於 2026 年 11 月 24 日。這不是已公告的停用日期。需要持續存取前,請向供應商確認。
沒有。4.5 文件所列限制為 200K 上下文和 64K 最大輸出。比較表中的 1M 上下文、128K 輸出與自適應思考屬於 Opus 5。產品更新不會改變固定版本 4.5 的型號。
它的原生輸出是文字。瀏覽網頁、執行程式與編輯檔案需要應用程式提供工具。影像輸入可協助視覺分析,但不代表它原生產生影像,也不能證明活頁簿已開啟並重新計算。
本頁不承諾免費使用或模型可用性。提示詞會接續至 Studio,存取權、工具與費用取決於帳戶。開始前請確認可用模型。
將證據帶入 Ottermind Studio,把分析轉成能夠檢查、測試並繼續推進的結果。