与 Claude Opus 4.5 对话

AI ChatClaude Opus 4.5

Claude Opus 4.5 是什么?

Claude Opus 4.5 是 Anthropic 面向编程、智能体和复杂知识工作的推理模型,于 2025 年 11 月 24 日发布。固定 API ID 为 claude-opus-4-5-20251101,别名为 claude-opus-4-5。它接受文本和图像输入,输出文本。 截至 2026 年 9 月 8 日核查,Opus 系列最新已发布型号是 2026 年 7 月 24 日推出的 Claude Opus 5。Opus 产品页的标题仍是 4.8,但公告与可用性章节已介绍 5。本页只讨论文档中仍列为可用的 4.5。

4.5 API 支持哪些能力

  • 200K 上下文工作空间: 4.5 API 概览列出 200K 上下文 token 和 64K 最大输出。要为回答与工具结果预留空间。处理代码仓库或文档集合时,应挑选相关文件并保留来源索引,不要假定全部资料都能放入窗口。
  • 可以实测的推理强度: Opus 4.5 使用扩展思考。effort 控制提供 low、medium 和 high,默认 high。它会影响解释、工具调用和思考,但不是固定的支出上限。可在常规工作中测试较低档位,仅在深度推理确实改善验收结果时保留它。
  • 计算任务完成后的成本: 供应商标准价格为每百万输入 token 5 美元、每百万输出 token 25 美元。一次 10,000 输入、2,000 输出的请求为 0.10 美元,尚未计入缓存、工具等调整。这不是 Ottermind 定价。反复尝试和人工复核的成本,可能比单次回答的价格更重要。

值得用 Opus 4.5 实测的工作

当问题包含互相影响的约束时,最值得考虑它。用以下范围明确的任务判断额外推理是否真正帮助了你的工作。

  • 理清跨系统故障

    提供请求 ID、各服务日志以及最后一次正常运行的行为。要求先整理时间线、候选原因和能够区分原因的测试,再生成补丁。这样有助于辨别问题来自 API、过期的客户端状态,还是一次重试重复执行了操作。

  • 规划不改变行为的迁移

    提供新旧接口、兼容性要求和代表性测试。要求给出带回滚点的分阶段迁移,再逐个处理模块边界。除了编译,还要检查调用方与数据格式,避免看似整洁的重构悄悄改变约定。

  • 从冲突文档中形成决策

    附上带日期的提案、会议记录和决策标准。要求指出分歧、支持段落以及每个选项背后的假设。逐条核查建议的来源,否则流畅的综合表述可能掩盖两份文档之间尚未解决的矛盾。

  • 检查表格背后的假设

    提供列定义、示例行、公式和预期汇总值。要求指出单位、缺失值或重复记录可能如何改变结论。请在电子表格工具中重新计算所提修正;解释合理,并不能证明工作簿真的执行过。

Claude Opus 4.5 与 Claude Opus 5 对比

选择依据Claude Opus 4.5Claude Opus 5
标准 API 输入 / 输出每百万 token 5 / 25 美元每百万 token 5 / 25 美元
上下文 / 最大输出200K / 64K token1M / 128K token
思考方式扩展思考自适应思考
评估理由保留经过测试的 4.5 工作流,或复现历史结果用更长输入与相同验收案例测试当前 Opus

何时值得继续使用 4.5

值得评估的理由

  • 已有的行为基线: 现有提示词、已验收补丁和已复核文档,可以构成实用的 4.5 基线。也要保留有代表性的失败案例。这样才能用实际工作负载评估替代模型,而不是只凭第一次回答是否漂亮来判断。
  • 让规划衔接下一步行动: 将分析整理成范围明确的实施说明、有来源支撑的备忘录,或表格检查清单。Ottermind 帮助把这份说明接到下一阶段工作。模型和工具是否可用取决于账户;页面本身不代表你已获得访问权限。

需要衡量的取舍

  • 旧模型不一定更便宜: Opus 5 API 概览列出的基础 token 单价相同,窗口更大。若不依赖 4.5 的特定行为,也应测试 5。比较已验收结果、耗时和总 token 用量;相同单价不等于相同任务成本。
  • 更多推理也可能增加工作量: 对于小范围修改,过度规划或推测性边界情况可能拖慢结果、扩大 diff。明确允许修改的范围,并在增加改动前要求证据。若重复修补没有改变观察到的故障,就应停止继续尝试。

用户实际使用中的发现

这些讨论是 4.5 发布期及随后数周的个人记录,不代表共识或当前受控基准测试。客户端、任务和订阅都会影响体验。

减少重试可能抵消较高单价

在 Hacker News 发布讨论中,一位 Amp 团队成员表示,内部早期使用中 Opus 4.5 的平均会话成本低于 Sonnet 4.5。这是利益相关方未经控制变量的观察。它提示应衡量完成任务的成本,不能用来向所有用户保证节省费用。

小界面问题仍可能修复多次

在一位非程序员的体验记录中,作者描述修复横向筛选器滚动位置花了六次尝试,额度也消耗得更快。回复意见不一:有人认为 Opus 适合陌生问题,也有人更喜欢 Sonnet 执行精确指令。截图与看似可信的回答,不能代替实际复现交互。

在 Ottermind 中继续工作

1

准备证据

提供故障、相关来源和约束。说明需要的输出,例如附带复现步骤的诊断、迁移顺序,或带来源段落的备忘录。

2

在 Studio 中确认可用性

前往 Studio,按需登录。若账户可用,再选择 Claude Opus 4.5 并检查使用条款。本页不会自动选中模型,也不保证访问权限。

3

使用前先验证结果

运行复现步骤、检查 diff,或重新计算数字。将已验收发现和未解决问题放在一起,让后续工作建立在已核实的结果上。

Claude Opus 4.5 常见问题

Opus 4.5 已退役,还是仍可使用?

截至 2026 年 9 月 8 日,概览标为 Legacy,而生命周期表列为 Active,退役时间不早于 2026 年 11 月 24 日。这不是已公告的停用日期。依赖持续访问前,请向所用供应商核对。

Opus 4.5 也有 Opus 5 的大窗口吗?

没有。4.5 文档中的限制是 200K 上下文和 64K 最大输出。对比中的 1M 上下文、128K 输出和自适应思考属于 Opus 5。产品更新不会改变固定版本 4.5 的型号身份。

它能自行浏览网页或编辑表格吗?

原生输出是文本。浏览网页、执行代码和编辑文件需要应用提供工具。图像输入可以用于视觉分析,但它既不原生生成图像,也不能证明工作簿已被打开并重新计算。

本页包含免费的 Opus 4.5 使用权限吗?

本页不承诺免费使用或模型可用性。提示词会带入 Studio,访问权限、工具和费用取决于账户。开始前请确认可用模型。

为复杂任务找到可验证的下一步

将证据带入 Ottermind Studio,把分析变成能够检查、测试并继续推进的结果。