評估 Haiku 的理由
- 重複工作的基本費率較低: 目前的模型比較表列出 Haiku 的基本費率為 Sonnet 5 的一半,延遲排名也較低。這是供應商的比較,不是回應時間承諾。記錄重試次數與審閱投入後,再判斷整體成本。
- 在大任務中負責明確的一步: 經過審閱的計畫,可以把廣泛需求拆成較小的實作或擷取步驟。每一步都應保留輸入與驗收條件。Ottermind 能將需求帶入銜接的工作流程;可用模型及工具取決於帳號。
Claude Haiku 4.5 是 Anthropic 於 2025 年 10 月 15 日推出的輕量模型,可接收文字與圖片,並輸出文字。官方將它定位於需要迅速回應的助理與範圍明確的程式開發工作。 截至 2026 年 9 月 8 日,Haiku 產品頁和該版本 API 文件仍將 4.5 列為目前的 Haiku。固定快照 ID 是 claude-haiku-4-5-20251001,別名為 claude-haiku-4-5。Sonnet 或 Opus 推出新版,並不會改變這個型號的身分。
先訂出範圍明確的交付成果,並提供合格答案的範例。以下是評估方向,不是實測效能保證。
提供失敗的測試、相關函式與預期行為,要求沿用既有輔助函式,以最小修補完成工作。執行測試,檢查是否新增重複邏輯或更動無關檔案。
將客戶訊息與現行政策、訂單事實一起提供,要求簡短回覆並列出缺少的資訊。寄出前查核退款承諾、日期與例外條件,避免模型自行編造公司政策。
提供幾則供應商訊息,以及產品、數量和交貨日期的欄位規格。缺漏欄位須填 null,每筆紀錄附上來源摘錄。先驗證輸出並抽查有歧義的日期,再處理更大批次。
提供 diff 與問題描述,要求列出使用者可察覺的變化、遷移提醒與尚不確定的影響。確認每項主張都有修補內容支持,避免把內部重構寫成新功能。
| 選擇依據 | Claude Haiku 4.5 | Claude Sonnet 5 |
|---|---|---|
| 標準 API 輸入/輸出費率 | 每百萬 token 1/5 美元 | 每百萬 token 2/10 美元 |
| 上下文/最大輸出 | 20 萬/6.4 萬 token | 100 萬/12.8 萬 token |
| 思考控制 | 手動延伸思考 | 自適應思考 |
| 適合進行的試驗 | 範圍明確的修改與重複擷取 | 較大的資料集與需要更多規劃的任務 |
這些上市初期的討論呈現個人經驗,並非共識或目前的基準測試。使用的客戶端、任務與設定都不同。
在 Haiku 程式開發討論中,有人用 Sonnet 規劃,讓 Haiku 執行或進行局部修改。有些人肯定速度,也有人更喜歡 Sonnet 的程式品質。這支持嘗試該分工方式,不能推定品質相同。
在 Haiku 4.5 程式能力討論中,一位使用者指出模型新增實作後仍留下舊方案作為備援;另一位遇到檔案路徑與工具使用混亂。其他回覆也有正面經驗。應將它們當成待測試的失敗案例,而非普遍缺陷。
加入相關來源資料、預期輸出與具體查核方法。程式任務附上失敗範例;客服任務附上決定回覆內容的政策。
前往 Studio,必要時登入。若帳號可用,選擇 Claude Haiku 4.5 並查看用量條款。本頁不會自動選取模型,也不保證存取權限。
對照來源檢查輸出,執行適用的測試,修正具體缺漏。將通過驗收的成果與證據放在一起,供下一項任務使用。
截至 2026 年 9 月 8 日,生命週期表仍將它列為 active,退役不早於 2026 年 10 月 15 日。這是最早時間界線,不是已宣布的停用日期。合作平台可能有不同時程。
用 claude-haiku-4-5-20251001 指定文件中的固定快照,便捷別名為 claude-haiku-4-5。產品的模型選單、帳號權限與 API 模型 ID 是不同概念。
它的標準輸入與輸出費率都是 Sonnet 5 的一半,但額外嘗試、更長的回答與審閱投入可能抵銷節省。請讓兩者完成相同任務,並套用相同驗收標準。
此處不承諾存取權限或免費額度。Studio 會接收提示詞;模型可用性、工具與收費取決於帳號。開始任務前請確認這些資訊。
帶上來源資料,明確定義成果,在 Ottermind Studio 繼續工作。