值得测试 Pro 的地方
- 会影响后续工作的决策: 迁移顺序和假设选择不能只靠听起来合理的文字。请 Pro 明确假设与失败条件,让你在投入后续工作前先验证决策。
- 串联多个步骤的证据: 在对话中保留来源标签和已经验收的中间结果。要求每个建议步骤标明所用证据和仍未知的内容,让长任务更容易复核和恢复。
DeepSeek-V4-Pro 是 DeepSeek 面向推理和智能体任务的模型。8 月 13 日发布公告确认其已在 App、Web 和 API 正式上线,当前主页也确认了这一点。截至 2026 年 9 月 8 日,API 名称 `deepseek-v4-pro` 对应 DeepSeek-V4-Pro-0813。本页介绍这一正式版,不混用 4 月 Preview、7 月 Flash 更新或独立 Vision 实验模型的事实。 如果某个中间判断一旦出错,就会让后续几步都失败,这类任务值得尝试 Pro。请提供证据、约束和能够推翻方案的检查方法。下方场景是建议的工作方式,并非经过实测的成功保证。
带上文本证据和明确验收条件。每项任务都先留下可核验的结果,再进入下一个决策。
提供新旧 schema、必须保持的不变量和部署约束。要求按顺序给出迁移方案、验证查询及回滚边界。在可丢弃的副本上演练,检查行数和约束。把第一个失败查询带回 Studio,只修订受影响阶段,再继续推进。
提供脱敏日志、时间线和两个合理原因。要求用假设表列出支持证据、矛盾点及每个原因对应的区分性测试。核对时间戳并执行安全测试。将真实结果带回 Studio,请它判断应排除哪个假设,以及下一步该测什么。
提供问题、输入规模限制、候选算法和示例。要求说明假设、复杂度论证和对抗性案例。用暴力参考实现对照小规模输入,检查反例。将该反例带回 Studio,要求修正算法,并保留发现问题的测试。
提供研究问题、基线结果、可用算力和成功指标。要求给出包含固定变量、消融实验和停止条件的受控实验方案。重新计算基线并检查数据泄漏。将实测数据带回 Studio,修订下一次实验,不把未经检验的假设当作发现。
| 决策因素 | DeepSeek-V4-Pro | DeepSeek-V4-Flash |
|---|---|---|
| 当前 API 版本 | DeepSeek-V4-Pro-0813 | DeepSeek-V4-Flash-0731 |
| 高峰输入:缓存命中 / 未命中 | 每百万 token 0.044 / 1.32 美元 | 每百万 token 0.014 / 0.44 美元 |
| 高峰输出 | 每百万 token 3.96 美元 | 每百万 token 1.32 美元 |
| 用自己的难题来选择 | 当更好的决策能避免后续多步失败时值得测试;衡量总成本能换来多少验收通过的结果 | 范围明确任务的低成本基线;若相同检查下 Pro 没有带来有效质量提升,就保留 Flash |
这些是正式版时期的个体报告,不是共识,也不是对当前服务商的受控比较。它们可以帮助设计试用,不能预测你的结果。
Brotherindeed 在 8 月 16 日的帖子描述了通过 OpenCode Go 和 Pi 使用 0813 进行假设、测试和验证的有用体验,并非本地部署权重。另一项 16 道 Hack The Box 挑战评测中,TheArtificalQ 表示解题表现与 0423 大致相当,但步骤中位数从 62.5 降至 12.5,难题仍会失败。这种窄范围智能体测试不能证明普遍的编程优势或 API 速度。
在 8 月 13 日的编程费用讨论中,一位 Pro-0813 用户报告了大量 token 消耗,回复则强调缓存命中率。帖子早于 8 月 16 日调价,因此个人账单不能当作当前费用估算。比较自己的工作负载时,分别记录缓存输入、新输入、输出和重试。
粘贴相关文本,指定用来判定正确性的不变量、参考结果或测量指标。在要求完整实现前,先要一个范围明确的建议,并列出尚未解决的假设。
前往 Ottermind Studio,按需登录。只有账户确实提供时才选择 DeepSeek-V4-Pro。这项交接带入文本,不会上载文件、自动选择模型,也不确认 API 权限。
在对话之外执行检查,再粘贴确切差异,要求聚焦修订。保留已验证的工作,在提高推理强度或更换模型前先设定重试上限。
不是。DeepSeek 于 2026 年 8 月 13 日宣布 Pro 在 App、Web 和 API 正式上线。截至 9 月 8 日,API 表格将 `deepseek-v4-pro` 对应为 DeepSeek-V4-Pro-0813。早期 Preview 评测不能直接代表这个版本。
不能从独立的 `deepseek-v4-flash-vision-exp` 发布推断 Pro 支持视觉。本页为 Pro 准备文本任务,不对其图片输入能力作出声明。Studio 中可用的文件或模型选项取决于你的账户实际提供什么。
同一计费时段内,Pro 未缓存输入和输出的价格是 Flash 的三倍,缓存输入的比例略有不同。比较获得一个验收通过结果的总账单,包括失败尝试。非高峰价格为高峰的一半;这些是 DeepSeek API 费率,不是 Ottermind 费用。
先用 high 搭配可复现检查。难题失败时再尝试 max,对比正确性、输出 token 和耗时。更多思考并不证明结果正确,聊天产品提供的控制项也可能与 API 文档不同。
把证据、约束和检查方法带入 Ottermind Studio。