值得评估的地方
- 相比 3.7 增加视觉输入: Qwen3.7-Max 产品页说明其公开接口仅支持文字。处理截图调试或图表审核时,3.8 可以直接接收视觉资料。用同一交付目标比较,不必预设所有文字任务都会提升。
- 分阶段规划、执行和检查: 阿里巴巴在发布公告中介绍了一次持续 16 天的内部工程演示。这是厂商实验,不是完成任务的保证。先用工具日志与验收测试验证一个有边界的阶段,再延长运行流程。
Qwen3.8-Max 是阿里巴巴面向推理、编程和长流程工作的多模态旗舰模型。阿里巴巴于 2026 年 8 月 3 日发布的公告介绍了它的混合专家架构:总参数 2.4 万亿,激活参数 950 亿,发布时已提供 API。 截至 9 月 7 日,QwenCloud 已列出 9 月 2 日快照,即 qwen3.8-max-0902,别名为 qwen3.8-max-2026-09-02。官方称更新改善了编程和协作能力。当前 API 文档同时列出它与 qwen3.8-max;实际请求落到哪个版本,仍需向所用服务核实。
先明确交付物和验收方法。每次修改都保留最初要求,方便核对有没有遗漏。
| 选择依据 | Qwen3.8-Max | Qwen3.7-Max |
|---|---|---|
| QwenCloud 公开输入能力 | 文字、图片和视频 | 仅文字接口 |
| 上下文窗口 | 100 万 token | 100 万 token |
| 新加坡 API 输入/输出 | 每百万 token 2/6 美元 | 每百万 token 2.50/7.50 美元 |
| 值得做的选择测试 | 尝试同时需要视觉证据和代码的任务 | 作为已验证文字工作流的比较基线 |
下面的讨论混合了正式版和较早预览版的体验,属于个体报告,不是社区共识、受控测评,也不能证明 0902 已解决所有问题。
一则 Qwen 社区讨论赞赏编程速度和 token 使用效率,但回复对此提出异议,部分评论讨论的是 Preview。相信节省成本的说法前,应在准确版本和服务商下复测自己的任务。
一位预览版评测者报告,海报任务中要求使用的照片被换成了排版元素。回复中的体验并不一致。这可以作为当前快照的指令遵循测试用例,不能用来推算失败率。
9 月的一则使用报告称,在 token 套餐中调用 0902 出现模型未找到错误。有回复推测自动路由,但这不是官方确认。需要核对套餐、接口地址与支持的 ID。
在上方输入目标、资料和验收条件,特别注明每次修订都必须保留的约束,例如指定图片、日期或功能行为。
进入 Studio,按需登录。如果账号提供 Qwen3.8-Max,就选择它,并核对文件、工具与用量规则。本页面不会自动选中模型或开通权限。
对照资料检查首轮结果,运行相关验证,提出具体修改要求。保留验收后的版本,再带入下一个相关任务。
0902 是 Qwen3.8-Max 中一次带日期的更新。QwenCloud 使用 qwen3.8-max-0902,别名为 qwen3.8-max-2026-09-02。截至 2026 年 9 月 7 日,文档同时列出基础 ID 和日期 ID;应向服务商核实路由,不能默认它们始终指向相同版本。
Qwen 官方权重仓库名为 Qwen3.8-2.4T-A95B。模型卡明确区分了增加视觉、非思考模式和内置工具的托管 Qwen3.8-Max 服务。不能把托管 ID 当作完全相同的可下载模型,也不能套用其他 Qwen 型号的许可。
托管模型文档列出的输出是文字。视觉输入可用于分析片段或描述图片;生成与剪辑媒体需要其他工具,具体能力请查看所选 Studio 工作流。
不是。文中引用的是阿里云新加坡 International API 价格。Ottermind 的可用模型、用量限制和费用取决于账号。前往 Studio 只会传递提示词,并不代表已获得模型权限。
在 Ottermind Studio 完善需求、核对答案,再逐步修改下一版。