4.5 可以承担的角色
- 保留已有评估基线: 如果提示词和验收测试已针对 4.5 调整,可以保留结果作为迁移基线。切换前,让替代模型运行相同案例。熟悉的表现能说明你的工作流情况,却不能证明旧模型一定更好。
- 把分析接到实施过程: 从对话转向执行时,将诊断、来源摘录和已确认方案放在一起。Ottermind 为这份任务说明提供衔接后续工作的流程;能使用哪些模型和工具取决于你的账户。
Claude Sonnet 4.5 是 Anthropic 推出的模型,支持文本和图像输入、文本输出,于 2025 年 9 月 29 日发布,主要面向编程和多步骤智能体任务。固定 API ID 为 claude-sonnet-4-5-20250929,别名为 claude-sonnet-4-5。 截至 2026 年 9 月 8 日核查:Sonnet 5 已于 2026 年 6 月 30 日发布。Sonnet 产品页的标题仍写着 4.6,但发布记录和可用性说明已介绍 5。本页只讨论 4.5,以及它目前的限制。
选择真实任务,并设定清晰的验收标准。以下场景是评估起点,不代表保证成功。
提供事件时间戳、缓存更新和预期界面状态。要求先列出不同解释并构建最小复现,再修改代码。测试必须覆盖出错时的时序条件;仅开发环境运行正常还不够。
提供受影响接口、现有辅助函数和失败测试。要求梳理依赖关系,把实现拆成小步骤。检查最终 diff 是否混入无关修改,并对变更涉及的模块边界做集成验证。
将界面截图与设计要求、相关组件代码一起提供。要求按优先级列出不符之处并标明位置。还要在浏览器中验证响应式行为;读懂截图并不能证明界面可用。
提供带日期的会议记录和方案。要求列出选项、证据摘录、未解决问题,以及依据你的标准提出的建议。逐条核对事实来源,把假设与已记录的决定分开。
| 选择依据 | Claude Sonnet 4.5 | Claude Sonnet 5 |
|---|---|---|
| 标准 API 输入 / 输出 | 每百万 token 3 / 15 美元 | 每百万 token 2 / 10 美元 |
| 上下文 / 最大输出 | 200K / 64K token | 1M / 128K token |
| 思考方式 | 扩展思考 | 自适应思考 |
| 评估理由 | 复现已建立的 4.5 工作流 | 用同一组已验收任务测试当前替代版本 |
这些发布初期的讨论记录的是个人工作流,并非共识或当前的受控基准测试。客户端行为和订阅额度也会影响体验。
在一篇 Node.js 与 Flutter 使用记录中,作者认为 4.5 比旧的 Opus 规划、Sonnet 编码组合更快,主观代码质量相近。其他回复提到费用和额度问题。这是单个工作流的体验,不能当作速度优势保证。
在一则生产环境排错讨论中,作者称即使提供日志,4.5 仍反复修改正常代码。最后找到的原因是较早的请求覆盖了乐观更新的界面状态。回复对速度和正确率看法不一;这个案例提示应明确测试事件顺序。
附上来源、预期结果和验证方法。排错时加入复现步骤与日志;处理文档时标记来源及所需输出。
前往 Studio,按需登录。若账户可用,再选择 Claude Sonnet 4.5 并查看使用条款。本页不会自动选择该模型,也不保证访问权限。
运行相关测试或核查引用段落。保留已验收结果和未解决问题,让下一步建立在核实过的证据上。
截至 2026 年 9 月 8 日,概览将其标为 Legacy,而生命周期表仍列为 Active,退役时间不早于 2026 年 9 月 29 日。这不是已公告的停用日期。依赖持续访问前,请核对你所用供应商的时间表。
Claude API 已不支持:4.5 的 beta 于 2026 年 4 月 30 日结束,超过 200K 上下文 token 的请求现在会失败。历史发布示例和社区过去使用 1M 的记录,不能证明目前仍可用。
原生输出是文本。浏览网页、执行代码和文件操作需要宿主应用提供工具。图像输入让它能够分析截图,并不意味着它是图像生成模型。
本页不承诺免费使用或模型可用性。它会把你的提示词带入 Studio;访问权限、工具和费用取决于账户。开始任务前请先确认。
将任务与来源带入 Ottermind Studio,按验收标准检查每一步。