与 Claude Sonnet 4.5 对话

AI ChatClaude Sonnet 4.5

Claude Sonnet 4.5 是什么?

Claude Sonnet 4.5 是 Anthropic 推出的模型,支持文本和图像输入、文本输出,于 2025 年 9 月 29 日发布,主要面向编程和多步骤智能体任务。固定 API ID 为 claude-sonnet-4-5-20250929,别名为 claude-sonnet-4-5。 截至 2026 年 9 月 8 日核查:Sonnet 5 已于 2026 年 6 月 30 日发布。Sonnet 产品页的标题仍写着 4.6,但发布记录和可用性说明已介绍 5。本页只讨论 4.5,以及它目前的限制。

当前 API 能力

  • 200K 上下文,64K 输出: 该版本文档列出的上下文窗口为 200K token,最大输出为 64K token。2026 年 4 月 30 日发布记录确认 4.5 的 1M beta 已结束;旧请求头不再扩大窗口。资料过多时,应拆成可追溯的章节。
  • 为难点启用扩展思考: Sonnet 4.5 支持扩展思考,而非自适应思考。推理预算有助于梳理复杂调查,但也消耗 token 和时间。先比较额外推理能否改善诊断,再决定是否为每次请求启用。
  • 计算完成任务的总成本: 供应商标准价格为每百万输入 token 3 美元、每百万输出 token 15 美元。一次 10,000 输入、2,000 输出的请求为 0.06 美元,尚未计入缓存、工具等调整。这不是 Ottermind 定价。比较模型时,也要计算失败重试与人工复核时间。

用 Sonnet 4.5 评估哪些任务

选择真实任务,并设定清晰的验收标准。以下场景是评估起点,不代表保证成功。

  • 追踪偶发界面错误

    提供事件时间戳、缓存更新和预期界面状态。要求先列出不同解释并构建最小复现,再修改代码。测试必须覆盖出错时的时序条件;仅开发环境运行正常还不够。

  • 规划跨文件修改

    提供受影响接口、现有辅助函数和失败测试。要求梳理依赖关系,把实现拆成小步骤。检查最终 diff 是否混入无关修改,并对变更涉及的模块边界做集成验证。

  • 对照需求检查截图

    将界面截图与设计要求、相关组件代码一起提供。要求按优先级列出不符之处并标明位置。还要在浏览器中验证响应式行为;读懂截图并不能证明界面可用。

  • 根据资料整理决策简报

    提供带日期的会议记录和方案。要求列出选项、证据摘录、未解决问题,以及依据你的标准提出的建议。逐条核对事实来源,把假设与已记录的决定分开。

Claude Sonnet 4.5 与 Claude Sonnet 5 对比

选择依据Claude Sonnet 4.5Claude Sonnet 5
标准 API 输入 / 输出每百万 token 3 / 15 美元每百万 token 2 / 10 美元
上下文 / 最大输出200K / 64K token1M / 128K token
思考方式扩展思考自适应思考
评估理由复现已建立的 4.5 工作流用同一组已验收任务测试当前替代版本

继续使用 4.5,还是评估替代版本?

4.5 可以承担的角色

  • 保留已有评估基线: 如果提示词和验收测试已针对 4.5 调整,可以保留结果作为迁移基线。切换前,让替代模型运行相同案例。熟悉的表现能说明你的工作流情况,却不能证明旧模型一定更好。
  • 把分析接到实施过程: 从对话转向执行时,将诊断、来源摘录和已确认方案放在一起。Ottermind 为这份任务说明提供衔接后续工作的流程;能使用哪些模型和工具取决于你的账户。

需要核对的取舍

  • 新版本每个 token 可能更便宜: Sonnet 5 API 指南说明了更大的窗口和自适应思考。较低的基础单价值得测试,但新 tokenizer 和不同推理行为意味着同一任务的 token 用量不一定相同。
  • 继续修改前先核对证据: 看似可信的解释仍可能指向错误组件。要求说明每个推测由哪些观察支持、什么现象能推翻它。如果连续修改没有改变故障,就停止重复修补,重新检查复现过程。

社区用户怎么说

这些发布初期的讨论记录的是个人工作流,并非共识或当前的受控基准测试。客户端行为和订阅额度也会影响体验。

熟悉技术栈中的提速体验

在一篇 Node.js 与 Flutter 使用记录中,作者认为 4.5 比旧的 Opus 规划、Sonnet 编码组合更快,主观代码质量相近。其他回复提到费用和额度问题。这是单个工作流的体验,不能当作速度优势保证。

根因诊断也可能卡住

在一则生产环境排错讨论中,作者称即使提供日志,4.5 仍反复修改正常代码。最后找到的原因是较早的请求覆盖了乐观更新的界面状态。回复对速度和正确率看法不一;这个案例提示应明确测试事件顺序。

在 Ottermind 中继续工作

1

准备范围明确的任务说明

附上来源、预期结果和验证方法。排错时加入复现步骤与日志;处理文档时标记来源及所需输出。

2

在 Studio 中确认模型

前往 Studio,按需登录。若账户可用,再选择 Claude Sonnet 4.5 并查看使用条款。本页不会自动选择该模型,也不保证访问权限。

3

验证结果后继续推进

运行相关测试或核查引用段落。保留已验收结果和未解决问题,让下一步建立在核实过的证据上。

Claude Sonnet 4.5 常见问题

Sonnet 4.5 已经退役了吗?

截至 2026 年 9 月 8 日,概览将其标为 Legacy,而生命周期表仍列为 Active,退役时间不早于 2026 年 9 月 29 日。这不是已公告的停用日期。依赖持续访问前,请核对你所用供应商的时间表。

还能使用 1M 上下文 beta 吗?

Claude API 已不支持:4.5 的 beta 于 2026 年 4 月 30 日结束,超过 200K 上下文 token 的请求现在会失败。历史发布示例和社区过去使用 1M 的记录,不能证明目前仍可用。

它能自行浏览网页、运行代码或生成图片吗?

原生输出是文本。浏览网页、执行代码和文件操作需要宿主应用提供工具。图像输入让它能够分析截图,并不意味着它是图像生成模型。

Studio 提供免费的 Sonnet 4.5 访问吗?

本页不承诺免费使用或模型可用性。它会把你的提示词带入 Studio;访问权限、工具和费用取决于账户。开始任务前请先确认。

把证据变成可以验证的结果

将任务与来源带入 Ottermind Studio,按验收标准检查每一步。