与 Qwen3.8-Max 对话

AI ChatQwen3.8-Max

什么是 Qwen3.8-Max?

Qwen3.8-Max 是阿里巴巴面向推理、编程和长流程工作的多模态旗舰模型。阿里巴巴于 2026 年 8 月 3 日发布的公告介绍了它的混合专家架构:总参数 2.4 万亿,激活参数 950 亿,发布时已提供 API。 截至 9 月 7 日,QwenCloud 已列出 9 月 2 日快照,即 qwen3.8-max-0902,别名为 qwen3.8-max-2026-09-02。官方称更新改善了编程和协作能力。当前 API 文档同时列出它与 qwen3.8-max;实际请求落到哪个版本,仍需向所用服务核实。

Qwen3.8-Max 的主要能力

  • 结合文字理解视觉资料: 托管模型支持文字、图片和视频输入,输出为文字,上下文窗口为 100 万 token。为资料标注名称,并要求答案附页码或时间戳。大上下文不代表每个细节都能准确记住,Studio 的上传限制也可能不同。
  • 按需推理并连接工具: QwenCloud API 指南为两个 Max ID 列出了思考、函数调用、结构化输出及内置工具支持。工具需要由应用启用。使用结果前,应查看工具返回的证据,并校验 JSON。
  • 把推理消耗计入预算: 截至 2026 年 9 月 7 日,新加坡 International API 标价为每百万输入 token 2 美元、输出 token 6 美元,两个 ID 相同,输出计费包含推理。地域、缓存和工具费用都会影响账单;这不是 Ottermind 的报价。

适合用 Qwen3.8-Max 尝试的任务

先明确交付物和验收方法。每次修改都保留最初要求,方便核对有没有遗漏。

  • 根据截图修复界面

    提供截图、相关代码和出错行为,要求给出有针对性的补丁与测试,再将实际渲染结果与原图比较。审核后的需求可带入 AI 网站生成器,继续下一轮迭代。

  • 核对报告与图表

    同时提供报告正文和图表图片,找出文字结论与图中数值不一致的地方,并注明单位、日期和出处。重新计算关键数字;看不清的标签应标为未知,再起草修订建议。

  • 比较供应商方案

    比较各方案的范围、期限和不包含的事项,每个差异都要附原文依据。把确认后的缺口整理成问题,再用 AI 邮件生成器完善给供应商的回复。

  • 把视频整理成剪辑需求

    要求列出相关片段的时间戳、建议顺序和缺失镜头,并回看原片核验。模型可以描述如何剪辑;制作成片仍需要单独的剪辑流程。

Qwen3.8-Max 与 Qwen3.7-Max 对比

选择依据Qwen3.8-MaxQwen3.7-Max
QwenCloud 公开输入能力文字、图片和视频仅文字接口
上下文窗口100 万 token100 万 token
新加坡 API 输入/输出每百万 token 2/6 美元每百万 token 2.50/7.50 美元
值得做的选择测试尝试同时需要视觉证据和代码的任务作为已验证文字工作流的比较基线

如何判断 Qwen3.8-Max 是否合适

值得评估的地方

  • 相比 3.7 增加视觉输入: Qwen3.7-Max 产品页说明其公开接口仅支持文字。处理截图调试或图表审核时,3.8 可以直接接收视觉资料。用同一交付目标比较,不必预设所有文字任务都会提升。
  • 分阶段规划、执行和检查: 阿里巴巴在发布公告中介绍了一次持续 16 天的内部工程演示。这是厂商实验,不是完成任务的保证。先用工具日志与验收测试验证一个有边界的阶段,再延长运行流程。

仍然需要做的检查

  • 防止任务范围悄悄缩水: 看起来完整的结果可能跳过了难点。要求对照原始需求列出已完成、失败和未测试的项目。自己检验实际行为,不要只接受“全部检查通过”的文字说明。
  • 按验收通过的结果计算成本: 较低的 token 单价可能被长推理、反复调用和返工抵消。给同一任务设置时间上限和 token 预算,记录正确率、耗时及重试次数,再决定日常使用哪个模型。

用户实际反馈

下面的讨论混合了正式版和较早预览版的体验,属于个体报告,不是社区共识、受控测评,也不能证明 0902 已解决所有问题。

速度和 token 消耗评价不一

一则 Qwen 社区讨论赞赏编程速度和 token 使用效率,但回复对此提出异议,部分评论讨论的是 Preview。相信节省成本的说法前,应在准确版本和服务商下复测自己的任务。

预览版曾简化任务要求

一位预览版评测者报告,海报任务中要求使用的照片被换成了排版元素。回复中的体验并不一致。这可以作为当前快照的指令遵循测试用例,不能用来推算失败率。

公开的 ID 未必适用于套餐

9 月的一则使用报告称,在 token 套餐中调用 0902 出现模型未找到错误。有回复推测自动路由,但这不是官方确认。需要核对套餐、接口地址与支持的 ID。

在 Ottermind 开始 Qwen3.8-Max 任务

1

写清楚需要的结果

在上方输入目标、资料和验收条件,特别注明每次修订都必须保留的约束,例如指定图片、日期或功能行为。

2

在 Studio 核对模型

进入 Studio,按需登录。如果账号提供 Qwen3.8-Max,就选择它,并核对文件、工具与用量规则。本页面不会自动选中模型或开通权限。

3

审核后再继续

对照资料检查首轮结果,运行相关验证,提出具体修改要求。保留验收后的版本,再带入下一个相关任务。

Qwen3.8-Max 常见问题

Qwen3.8-Max 和 0902 是同一个版本吗?

0902 是 Qwen3.8-Max 中一次带日期的更新。QwenCloud 使用 qwen3.8-max-0902,别名为 qwen3.8-max-2026-09-02。截至 2026 年 9 月 7 日,文档同时列出基础 ID 和日期 ID;应向服务商核实路由,不能默认它们始终指向相同版本。

能下载 Qwen3.8-Max 的权重吗?

Qwen 官方权重仓库名为 Qwen3.8-2.4T-A95B。模型卡明确区分了增加视觉、非思考模式和内置工具的托管 Qwen3.8-Max 服务。不能把托管 ID 当作完全相同的可下载模型,也不能套用其他 Qwen 型号的许可。

它能生成图片或制作完整视频吗?

托管模型文档列出的输出是文字。视觉输入可用于分析片段或描述图片;生成与剪辑媒体需要其他工具,具体能力请查看所选 Studio 工作流。

这些价格就是 Ottermind 账单吗?

不是。文中引用的是阿里云新加坡 International API 价格。Ottermind 的可用模型、用量限制和费用取决于账号。前往 Studio 只会传递提示词,并不代表已获得模型权限。

带上证据,明确结果

在 Ottermind Studio 完善需求、核对答案,再逐步修改下一版。