与 Claude Opus 4.6 对话

AI ChatClaude Opus 4.6

Claude Opus 4.6 是什么?

Claude Opus 4.6 是 Anthropic 面向高难度编程和知识工作的模型,于 2026 年 2 月 5 日发布。API ID 为 claude-opus-4-6,接受文本和图像输入,输出文本。 截至 2026 年 9 月 8 日,Opus 系列最新已发布型号是 7 月 24 日推出的 Claude Opus 5。产品页仍显示 4.8 标题,但可用性章节已介绍 5。本页专门讨论仍可使用的 4.6。

当前 4.6 API 支持什么

  • 让相关证据放在一起: 该型号 API 概览列出 100 万 token 上下文和 12.8 万 token 最大输出。当前上下文文档已将 100 万设为默认,无需 beta 请求头,也没有长上下文加价。保留来源标签,并为回答预留空间;容量大不代表一定能准确回忆。
  • 自适应推理: 自适应思考让模型决定何时深入推理,文档默认 effort 为 high。旧式扩展思考已弃用。客户端提供选项时,可在小修改中测试较低强度。4.6 已不提供快速模式:根据价格文档,带 speed: fast 的请求仍按标准速度执行、按标准费率计费。
  • 一个具体费用例子: 标准 API 价格为每百万输入 token 5 美元、每百万输出 token 25 美元。20,000 输入加 4,000 个计费输出 token 的基础费用是 0.20 美元,未计入缓存、工具及其他调整。这是供应商费率,不是 Ottermind 定价;重试会增加任务总成本。

适合用 Opus 4.6 尝试的四类任务

发布材料重点介绍代码审查和长输入检索。以下任务把这些能力转成可检查的结果,并在关键环节保留人工复核。

  • 审查代码仓库中的跨文件改动

    提供 diff、受影响的调用方和接口行为要求。要求列出带文件引用及复现测试的故障路径,再按重要程度排序。有价值的结果是经得起核查的缺陷报告,而不是更长的推测性问题清单。

  • 在成组文档中追查一项说法

    提供带日期的报告和固定页码标签。要求找出支持或反驳某项说法的段落,包括附录中的例外。采用结论前逐一打开引用段落。大窗口有助于把相关证据放在一起,但不能保证引用正确。

  • 先解释差异,再制作演示

    提供预算、实际值以及汇总公式。要求拆解差异,区分数量、价格和数据缺失的影响,再生成简短演示提纲。展示前先在表格工具中重算;纯文本分析不会执行工作簿。

  • 按可测试的阶段实现规格

    从产品说明、验收案例和明确的排除项开始。要求拆成小步实现,每一步检查、测试后再继续。这与下方社区记录的分步工作方式一致,也让你能尽早否决不合适的设计。

Claude Opus 4.6 与 Claude Opus 5 对比

选择依据Claude Opus 4.6Claude Opus 5
标准输入 / 输出每百万 token 5 / 25 美元每百万 token 5 / 25 美元
上下文 / 最大输出100 万 / 12.8 万 token100 万 / 12.8 万 token
当前定位仍可使用的旧版模型当前 Opus 型号
评估目的保留已验证的 4.6 行为基线用相同难题检验迁移效果

今天如何定位 4.6

值得评估的理由

  • 为已有工作保留稳定参照: 如果提示词或集成依赖 4.6 的行为,一组经过复核的输出很有价值。同时保留成功与失败案例,用来比较替代型号。Opus 5 概览介绍了更新的选择;相同窗口大小不代表答案相同。
  • 让分析衔接交付物: 在 Ottermind 中,把审查说明、证据表或演示提纲带入下一阶段。让未解决的假设随工作一起保留,便于下一轮修订处理。可用模型与工具取决于账户。

需要衡量的取舍

  • 单价相同,账单未必相同: 价格文档说明,Claude 4.7 及后续版本采用的新分词器,对同一文本生成的 token 约多 30%,实际增幅取决于工作负载。比较 4.6 和 5 的实际用量与重试次数;单价相同,或只看 token 数,都不足以判断完成任务谁更便宜。
  • 客户端行为也影响体验: Anthropic 的 4 月 23 日复盘将质量问题追溯到 Claude 客户端的三项改动,已于 4 月 20 日解决,API 未受影响。比较运行结果时记录客户端版本和 effort,不要假定每次变化都来自模型。

用户实际反馈

这些是个人记录,不代表共识或受控基准。它们提示你该在自己的环境中测试什么,而不是给出通用的质量或速度排名。

分步指导仍然重要

在一则 Hacker News 评论中,Frannky 描述了从产品需求文档开始、逐步执行计划,成功完成前端、后端和算法工作的经历。作者也提到有些想法不好,需要引导。这份记录支持设置检查点,并不证明无人监督也能正确完成。

简单请求也可能思考过久

在 3 月的 Cursor 讨论中,有用户报告简单问题思考数分钟,也有人只遇到过一次。支持人员要求提供请求 ID。这说明该客户端曾有此类故障报告,不能据此认定今天的 API 总有同样延迟。

在 Ottermind 中继续

1

设定可核查的目标

提供相关证据、允许的范围和验收检查。说明需要的是问题发现、补丁计划,还是有来源依据的解释。

2

在 Studio 中确认模型

前往 Studio,按需登录。若账户可用,再选择 Claude Opus 4.6 并查看使用条款。本页不会自动选中模型,也不保证访问权限。

3

验证后再推进

运行测试、核对原文,或重新计算总数。将已验收发现与未解决问题一起带入后续工作。

Claude Opus 4.6 常见问题

Opus 4.6 已退役了吗?

截至 2026 年 9 月 8 日,概览标为 Legacy,而生命周期表列为 Active,退役不早于 2027 年 2 月 5 日。这不是已公告的停用日期。合作平台可能采用不同时间表。

100 万上下文仍需发布时的 beta 吗?

不需要。当前 Claude API 文档将 100 万列为默认,使用标准价格且无需 beta 请求头。2 月发布文章中的 beta 和加价说明描述的是当时状态。请核对实际使用应用的限制。

它能原生生成图像或编辑文件吗?

原生输入为文本和图像,原生输出为文本。浏览网页、执行代码及编辑文件需要应用提供工具。解释表格应如何修改,并不能证明修改已实际完成。

在这里使用 Opus 4.6 免费吗?

本页不承诺免费使用或模型访问权限。提示词会带入 Studio,可用性、工具和费用取决于账户。开始前请确认模型。

把难题变成经过核查的工作

将证据带入 Ottermind Studio,从能够检查和测试的发现继续推进。