值得评估的理由
- 为已有工作保留稳定参照: 如果提示词或集成依赖 4.6 的行为,一组经过复核的输出很有价值。同时保留成功与失败案例,用来比较替代型号。Opus 5 概览介绍了更新的选择;相同窗口大小不代表答案相同。
- 让分析衔接交付物: 在 Ottermind 中,把审查说明、证据表或演示提纲带入下一阶段。让未解决的假设随工作一起保留,便于下一轮修订处理。可用模型与工具取决于账户。
Claude Opus 4.6 是 Anthropic 面向高难度编程和知识工作的模型,于 2026 年 2 月 5 日发布。API ID 为 claude-opus-4-6,接受文本和图像输入,输出文本。 截至 2026 年 9 月 8 日,Opus 系列最新已发布型号是 7 月 24 日推出的 Claude Opus 5。产品页仍显示 4.8 标题,但可用性章节已介绍 5。本页专门讨论仍可使用的 4.6。
发布材料重点介绍代码审查和长输入检索。以下任务把这些能力转成可检查的结果,并在关键环节保留人工复核。
提供 diff、受影响的调用方和接口行为要求。要求列出带文件引用及复现测试的故障路径,再按重要程度排序。有价值的结果是经得起核查的缺陷报告,而不是更长的推测性问题清单。
提供带日期的报告和固定页码标签。要求找出支持或反驳某项说法的段落,包括附录中的例外。采用结论前逐一打开引用段落。大窗口有助于把相关证据放在一起,但不能保证引用正确。
提供预算、实际值以及汇总公式。要求拆解差异,区分数量、价格和数据缺失的影响,再生成简短演示提纲。展示前先在表格工具中重算;纯文本分析不会执行工作簿。
从产品说明、验收案例和明确的排除项开始。要求拆成小步实现,每一步检查、测试后再继续。这与下方社区记录的分步工作方式一致,也让你能尽早否决不合适的设计。
| 选择依据 | Claude Opus 4.6 | Claude Opus 5 |
|---|---|---|
| 标准输入 / 输出 | 每百万 token 5 / 25 美元 | 每百万 token 5 / 25 美元 |
| 上下文 / 最大输出 | 100 万 / 12.8 万 token | 100 万 / 12.8 万 token |
| 当前定位 | 仍可使用的旧版模型 | 当前 Opus 型号 |
| 评估目的 | 保留已验证的 4.6 行为基线 | 用相同难题检验迁移效果 |
这些是个人记录,不代表共识或受控基准。它们提示你该在自己的环境中测试什么,而不是给出通用的质量或速度排名。
在一则 Hacker News 评论中,Frannky 描述了从产品需求文档开始、逐步执行计划,成功完成前端、后端和算法工作的经历。作者也提到有些想法不好,需要引导。这份记录支持设置检查点,并不证明无人监督也能正确完成。
在 3 月的 Cursor 讨论中,有用户报告简单问题思考数分钟,也有人只遇到过一次。支持人员要求提供请求 ID。这说明该客户端曾有此类故障报告,不能据此认定今天的 API 总有同样延迟。
提供相关证据、允许的范围和验收检查。说明需要的是问题发现、补丁计划,还是有来源依据的解释。
前往 Studio,按需登录。若账户可用,再选择 Claude Opus 4.6 并查看使用条款。本页不会自动选中模型,也不保证访问权限。
运行测试、核对原文,或重新计算总数。将已验收发现与未解决问题一起带入后续工作。
截至 2026 年 9 月 8 日,概览标为 Legacy,而生命周期表列为 Active,退役不早于 2027 年 2 月 5 日。这不是已公告的停用日期。合作平台可能采用不同时间表。
不需要。当前 Claude API 文档将 100 万列为默认,使用标准价格且无需 beta 请求头。2 月发布文章中的 beta 和加价说明描述的是当时状态。请核对实际使用应用的限制。
原生输入为文本和图像,原生输出为文本。浏览网页、执行代码及编辑文件需要应用提供工具。解释表格应如何修改,并不能证明修改已实际完成。
本页不承诺免费使用或模型访问权限。提示词会带入 Studio,可用性、工具和费用取决于账户。开始前请确认模型。
将证据带入 Ottermind Studio,从能够检查和测试的发现继续推进。