评估 Haiku 的理由
- 重复任务的基础单价更低: 当前模型对照表中,Haiku 的基础单价是 Sonnet 5 的一半,延迟排名也更低。这是服务商的比较,不是响应时间承诺。应记录重试次数和审阅投入,再判断总体上哪一个更便宜。
- 在大任务中承担明确的一步: 经过审阅的计划能把宽泛需求拆成小的实现或提取步骤。每一步都保留输入资料和验收标准。Ottermind 可以把需求带入衔接的工作流;可用模型和工具取决于账号。
Claude Haiku 4.5 是 Anthropic 于 2025 年 10 月 15 日发布的轻量模型,接受文字和图片输入,输出文字。官方将其定位于需要快速响应的助手和范围明确的编程任务。 截至 2026 年 9 月 8 日,Haiku 产品页和该版本的 API 文档仍将 4.5 列为当前 Haiku。固定快照 ID 为 claude-haiku-4-5-20251001,别名为 claude-haiku-4-5。Sonnet 或 Opus 的新版本不会改变这一型号的身份。
先确定范围明确的交付物,并提供合格答案的例子。以下是评估思路,不是实测性能保证。
提供失败测试、相关函数和预期行为,要求复用现有辅助函数,以最小补丁完成修复。运行测试,并检查修改是否增加重复逻辑或触及无关文件。
把客户消息与现行政策、订单事实一起提供,要求输出简短回复并列出缺失信息。发送前核查退款承诺、日期和例外条件;不能让模型编造公司政策。
提供几条供应商消息,以及产品、数量、交付日期的字段规范。要求缺失字段写 null,每条记录附原文摘录。先校验输出并抽查有歧义的日期,再处理更大批次。
提供 diff 和问题描述,要求列出用户可感知的变化、迁移提示和不确定的影响。核实每项说法都有补丁依据,避免把内部重构包装成新功能。
| 选择依据 | Claude Haiku 4.5 | Claude Sonnet 5 |
|---|---|---|
| 标准 API 输入/输出价格 | 每百万 token 1/5 美元 | 每百万 token 2/10 美元 |
| 上下文/最大输出 | 20 万/6.4 万 token | 100 万/12.8 万 token |
| 思考控制 | 手动扩展思考 | 自适应思考 |
| 适合开展的试验 | 范围明确的修改和重复提取 | 更大的资料集和需要更多规划的任务 |
这些发布初期的讨论反映个人经验,并非共识或当前基准测试。使用的客户端、任务和设置各不相同。
在 Haiku 编程讨论中,有人用 Sonnet 做规划,让 Haiku 执行或完成定点修改。部分用户认可速度,另一些更喜欢 Sonnet 的代码质量。这支持尝试这种分工,不能据此认定质量相同。
在 Haiku 4.5 编程能力讨论中,一位用户报告模型新增实现后仍保留旧方案作为回退;另一位遇到文件路径和工具使用混乱。也有正面回复。应将这些作为待测试的失败案例,而非普遍缺陷。
加入相关原始资料、预期输出和具体核验方式。代码任务附上失败示例;客服任务附上决定回复内容的政策。
前往 Studio,按需登录。若账号可用,选择 Claude Haiku 4.5 并查看用量规则。本页不会自动选中该模型,也不保证访问权限。
对照原文检查输出,运行适用的测试,修正具体缺漏。将验收后的结果与证据放在一起,供下一项任务使用。
截至 2026 年 9 月 8 日,生命周期表仍将其列为 active,退役不早于 2026 年 10 月 15 日。这是最早时间边界,不是已宣布的停用日期。合作平台可能采用不同时间表。
使用 claude-haiku-4-5-20251001 指定文档中的固定快照,便捷别名为 claude-haiku-4-5。产品的模型选择器、账号权限与 API 模型 ID 是不同概念。
它的标准输入和输出单价都是 Sonnet 5 的一半,但额外尝试、更长回复和审阅成本可能抵消节省。应让两者完成同一任务,并采用相同验收标准。
这里不承诺访问权限或免费额度。Studio 会接收你的提示词;模型可用性、工具和收费取决于账号。开始任务前请核实这些信息。
带上原始资料,明确所需结果,在 Ottermind Studio 继续工作。