与 Claude Haiku 4.5 对话

AI ChatClaude Haiku 4.5

什么是 Claude Haiku 4.5?

Claude Haiku 4.5 是 Anthropic 于 2025 年 10 月 15 日发布的轻量模型,接受文字和图片输入,输出文字。官方将其定位于需要快速响应的助手和范围明确的编程任务。 截至 2026 年 9 月 8 日,Haiku 产品页和该版本的 API 文档仍将 4.5 列为当前 Haiku。固定快照 ID 为 claude-haiku-4-5-20251001,别名为 claude-haiku-4-5。Sonnet 或 Opus 的新版本不会改变这一型号的身份。

能力与费用

  • 20 万 token 上下文: API 支持 20 万 token 上下文,最多输出 6.4 万 token。提供相关文件或摘录时应附上标识;较大窗口并不保证准确找回细节。原生输出为文字,因此可以分析截图,但生成图片需要其他模型或工具。
  • 按需开启扩展思考: Haiku 4.5 通过 token 预算手动启用扩展思考,不使用自适应思考或 effort 设置。可用一个难处理的例外案例测试,同时比较可接受的结果、耗时和 token 消耗。常规分类未必需要额外推理。
  • 按完成的任务计算费用: 服务商标准价格为每百万输入 token 1 美元、输出 token 5 美元。按此计算,1 万输入加 2000 输出 token 为 0.02 美元,尚未计入其他收费。缓存、批处理和工具会影响账单;这些并非 Ottermind 价格。

值得用 Haiku 4.5 尝试的任务

先确定范围明确的交付物,并提供合格答案的例子。以下是评估思路,不是实测性能保证。

  • 修复指定缺陷

    提供失败测试、相关函数和预期行为,要求复用现有辅助函数,以最小补丁完成修复。运行测试,并检查修改是否增加重复逻辑或触及无关文件。

  • 起草客服回复

    把客户消息与现行政策、订单事实一起提供,要求输出简短回复并列出缺失信息。发送前核查退款承诺、日期和例外条件;不能让模型编造公司政策。

  • 提取统一格式的记录

    提供几条供应商消息,以及产品、数量、交付日期的字段规范。要求缺失字段写 null,每条记录附原文摘录。先校验输出并抽查有歧义的日期,再处理更大批次。

  • 把补丁整理成发布说明

    提供 diff 和问题描述,要求列出用户可感知的变化、迁移提示和不确定的影响。核实每项说法都有补丁依据,避免把内部重构包装成新功能。

Claude Haiku 4.5 与 Claude Sonnet 5 对比

选择依据Claude Haiku 4.5Claude Sonnet 5
标准 API 输入/输出价格每百万 token 1/5 美元每百万 token 2/10 美元
上下文/最大输出20 万/6.4 万 token100 万/12.8 万 token
思考控制手动扩展思考自适应思考
适合开展的试验范围明确的修改和重复提取更大的资料集和需要更多规划的任务

按验收结果选择

评估 Haiku 的理由

  • 重复任务的基础单价更低: 当前模型对照表中,Haiku 的基础单价是 Sonnet 5 的一半,延迟排名也更低。这是服务商的比较,不是响应时间承诺。应记录重试次数和审阅投入,再判断总体上哪一个更便宜。
  • 在大任务中承担明确的一步: 经过审阅的计划能把宽泛需求拆成小的实现或提取步骤。每一步都保留输入资料和验收标准。Ottermind 可以把需求带入衔接的工作流;可用模型和工具取决于账号。

需要多加留意的地方

  • 及时结束反复修补: 如果补丁反复失败或产生平行实现,应重新检查计划,把困难部分交给更强的模型。比较每次验收通过的修改所花总费用,包括失败尝试,而非只看第一条回复的 token 单价。
  • 提供最新证据: 文档列出的可靠知识截止时间为 2025 年 2 月。涉及较新事实时,应提供现行政策和 API 参考资料。联网和代码执行取决于宿主工具;回答流畅不代表已经检索或测试。

社区用户的实际反馈

这些发布初期的讨论反映个人经验,并非共识或当前基准测试。使用的客户端、任务和设置各不相同。

集中执行时速度受到认可

在 Haiku 编程讨论中,有人用 Sonnet 做规划,让 Haiku 执行或完成定点修改。部分用户认可速度,另一些更喜欢 Sonnet 的代码质量。这支持尝试这种分工,不能据此认定质量相同。

小修改也可能变复杂

在 Haiku 4.5 编程能力讨论中,一位用户报告模型新增实现后仍保留旧方案作为回退;另一位遇到文件路径和工具使用混乱。也有正面回复。应将这些作为待测试的失败案例,而非普遍缺陷。

在 Ottermind 继续任务

1

确定一项交付物

加入相关原始资料、预期输出和具体核验方式。代码任务附上失败示例;客服任务附上决定回复内容的政策。

2

核查 Studio 中的可用性

前往 Studio,按需登录。若账号可用,选择 Claude Haiku 4.5 并查看用量规则。本页不会自动选中该模型,也不保证访问权限。

3

审阅结果,再继续下一步

对照原文检查输出,运行适用的测试,修正具体缺漏。将验收后的结果与证据放在一起,供下一项任务使用。

Claude Haiku 4.5 常见问题

Claude Haiku 4.5 要停用了吗?

截至 2026 年 9 月 8 日,生命周期表仍将其列为 active,退役不早于 2026 年 10 月 15 日。这是最早时间边界,不是已宣布的停用日期。合作平台可能采用不同时间表。

API 应使用哪个模型 ID?

使用 claude-haiku-4-5-20251001 指定文档中的固定快照,便捷别名为 claude-haiku-4-5。产品的模型选择器、账号权限与 API 模型 ID 是不同概念。

Haiku 一定比 Sonnet 5 便宜吗?

它的标准输入和输出单价都是 Sonnet 5 的一半,但额外尝试、更长回复和审阅成本可能抵消节省。应让两者完成同一任务,并采用相同验收标准。

打开 Studio 就能免费使用 Haiku 吗?

这里不承诺访问权限或免费额度。Studio 会接收你的提示词;模型可用性、工具和收费取决于账号。开始任务前请核实这些信息。

让下一项小任务更容易完成

带上原始资料,明确所需结果,在 Ottermind Studio 继续工作。