与 Claude Sonnet 4.6 对话

AI ChatClaude Sonnet 4.6

Claude Sonnet 4.6 是什么?

Claude Sonnet 4.6 是 Anthropic 用于编程、文档分析和工具辅助工作的模型,发布于 2026 年 2 月 17 日。API ID 为 claude-sonnet-4-6,接受文本和图像,输出文本。 截至 2026 年 9 月 8 日,Sonnet 系列最新型号是 6 月 30 日发布的 Claude Sonnet 5。产品页仍保留 4.6 标题,但可用性部分已介绍 5。本页专门介绍仍可使用的 4.6,便于评估已有流程或迁移方案。

当前 Sonnet 4.6 API 事实

  • 长输入,有限输出: 模型概览列出普通 API 请求的上下文为 100 万 token,最大输出为 12.8 万 token。另有独立的 Batch API beta 支持更长输出。给文档加上标签,并预留回答空间;文件放得进上下文,不等于每个细节都能被准确检索。
  • 按任务调整推理: Sonnet 4.6 支持 adaptive thinking,effort 默认 high;但如迁移指南所述,省略 thinking 字段时不会开启思考。手动 extended thinking 已弃用。小补丁可在应用支持时尝试较低 effort,同时衡量耗时、通过验收的改动和计费用量。
  • 计算一次完整尝试的费用: 标准 API 单价为每百万输入 token 3 美元、每百万输出 token 15 美元。输入 20,000、计费输出 4,000 token 的请求,未计缓存、工具及其他调整时为 0.12 美元。这是供应商价格,不是 Ottermind 定价;反复尝试会增加账单。

Sonnet 4.6 的四项实用任务

从范围明确、完成标准可观察的工作开始。以下任务都能得到可运行、可比较或可检查的结果,便于自行验收,不必只依赖模型声称已完成。

  • 跨文件追踪错误

    提供错误信息、复现步骤和相关调用方。要求找出最早出现的错误假设,给出小补丁和修复前会失败的测试。检查它是否改变了预期行为,或只是调整测试来接受错误。

  • 按需求实现一个功能

    提供接口约定、样例数据和验收案例。先要求实现一个可运行的小范围功能,明确真实数据边界,审查后再扩展。清楚区分原型与生产行为,避免把编造的模拟数据当作完成集成。

  • 核对一组文档

    提供带日期的报告或政策版本,并标明固定页码。要求列出相互冲突的说法、支撑段落和未解决缺口。逐一核实引文,独立计算重要数字,再将表格整理为决策简报。

  • 规划多步骤表单流程

    提供字段、判断规则和信息缺失示例。要求逐步列出流程、异常分支,以及提交前的复核节点。实际浏览器操作需要应用提供兼容工具;文字计划不代表表单已经提交。

Claude Sonnet 4.6 与 Claude Sonnet 5 对比

选择依据Claude Sonnet 4.6Claude Sonnet 5
标准输入 / 输出每百万 token 3 / 15 美元每百万 token 2 / 10 美元
上下文 / 普通最大输出100 万 / 12.8 万 token100 万 / 12.8 万 token
当前定位仍可使用的旧版模型最新 Sonnet 型号
评估理由保留已验证的 4.6 工作流检验更低 token 单价下的执行改进

为工作选择合适版本

4.6 仍有价值的地方

  • 已知的行为基线: 若已有提示词或集成依赖 4.6 的行为,保留一组经过审查的输出作为参照。评估中同时纳入难题与失败案例。熟悉已有模型可以成为分阶段迁移的理由,但不能证明旧型号更好。
  • 让发现衔接下一份交付物: 在 Ottermind 中,把排错说明、证据表或流程计划带入下一阶段。保留来源引用和未解决假设,让后续修订可追溯。可用模型与工具取决于你的账户。

值得实测的取舍

  • 单价下降不等于账单同比下降: 发布记录确认 Sonnet 5 的 2/10 美元单价已于 8 月 10 日成为长期标准。其新分词器对同一文本产生的 token 约多 30%,具体取决于任务。请比较实际任务费用、重试和延迟,不要直接假设节省三分之一。
  • 迁移也会改变请求要求: Sonnet 5 概览说明其默认开启 adaptive thinking。手动 extended thinking,以及非默认的 temperature、top_p 或 top_k,都会返回 400 错误。在已有集成中替换模型 ID 前,先检查请求设置和输出质量。

用户实际报告了什么

这些个人记录不是共识,也不是受控基准。它们提示你在自己的任务中检查什么;不能将发布初期的体验或特定客户端限制视为今天的普遍行为。

独立执行更久,仍需捕捉错误假设

在 Hacker News 发布讨论中,nichochar 描述了在 Mocha 自建智能体环境里,模型可以更长时间独立构建应用。另一位用户 coder4rover 则报告模型使用了模拟数据和函数,需要追加提示纠正。应检查长时间运行是否完成了要求的集成,而不只是生成看似可信的演示。

API 容量与订阅权限不同

一位使用 Claude Code v2.1.83 的 Reddit 用户报告,Max 订阅下上下文为 20 万,使用 Sonnet 的 100 万窗口需要额外付费。这是特定套餐的历史记录,不能证明当前 API 仍限于 20 万。请检查实际客户端、套餐和用量设置。

在 Ottermind 中继续任务

1

明确范围和证据

提供关键文件或段落、所需输出以及成功标准。说明哪些接口、事实或行为必须保持不变。

2

在 Studio 中确认模型

前往 Studio,按需登录。若账户可用,再选择 Claude Sonnet 4.6 并查看使用条款。本页不会自动选中模型,也不保证访问权限。

3

复核后再推进

运行复现步骤、打开引用段落,或检查流程中的异常分支。将已验收发现与剩余问题一起带入下一次修订。

Claude Sonnet 4.6 常见问题

Sonnet 4.6 仍可使用吗?

截至 2026 年 9 月 8 日,API 概览将其标为 Active (legacy),退役不早于 2027 年 2 月 17 日。这不是已公告的停用日期。确定工作流前,请查看生命周期表及供应商的实际可用性。

100 万上下文仍需要发布时的 beta 吗?

不需要。当前上下文指南将 100 万列为默认 API 窗口,按标准价格计费,无需 beta 请求头。2 月发布时的 beta 是历史状态。订阅应用可能提供不同限制,应单独核对条款。

Sonnet 4.6 能生成图像或操作浏览器吗?

它接受文本和图像,输出文本。浏览器操作与文件修改需要应用工具。迁移指南列明两个版本均支持 computer_20251124;4.6 不支持 Sonnet 5 新增的 computer_toolset_20260801 或 browser-use 工具。文字计划并不是操作已经完成的证据。

这里的对话免费吗?是否已选中模型?

本页不承诺免费使用或 Sonnet 4.6 访问权限。提示词会带入 Studio;可用性、工具和费用取决于账户。开始前请在那里确认所选模型。

带上一个可以验收的任务

携带清晰证据和范围明确的目标,前往 Ottermind Studio 继续工作,并逐步修订结果。