Qwen3.8-Max-Preview 发布:2.4T 参数旗舰预览版,正式版与开放权重待定

Qwen3.8-Max-Preview 发布:2.4T 参数旗舰预览版,正式版与开放权重待定

阿里发布 Qwen3.8-Max-Preview,确认 2.4T 总参数和多模态定位,当前可通过 Token Plan 等入口体验,但 benchmark、激活参数、license 与正式开放权重日期仍待补齐。

先说结论

阿里 Qwen 在 2026 年 7 月 19 日公开 Qwen3.8-Max-Preview,官方称其总参数量达到 2.4T,并计划很快开放权重。当前版本已经通过 Token Plan、Qoder 和 QoderWork 提供体验,阿里云文档把它定位为支持推理、视觉理解和文本生成的预览模型。12
对开发者的直接判断是:可以开始做编码、文档和复杂推理任务的横向测试,但暂时不适合依据「2.4T」或「仅次于 Fable 5」的宣传语做生产迁移。激活参数、benchmark 表、model card、license、上下文长度和正式开放权重日期都还没有完整公开。3

已确认的信息

项目当前可核实信息
模型Qwen3.8-Max-Preview,模型 ID 为 qwen3.8-max-preview
发布时间2026 年 7 月 19 日
参数规模总参数量 2.4T;激活参数量未披露
模态与能力推理模型、视觉理解、文本生成;公开报道还提到文本、图像、视频和文档输入
上下文长度官方当前公开文档未给出可核实数值
版本状态Preview,预览期间模型能力会持续迭代,结束后可能下线或替换为正式版本
开放权重Qwen 官方称「soon」,没有给出具体日期
benchmark未公开完整 benchmark 表;「仅次于 Fable 5」属于厂商自述,尚无独立验证
「2.4T」是总参数规模,不等于每个 Token 都会激活 2.4T 参数,也不能直接换算成本地部署所需显存或单次调用成本。Qwen 官方帖子确认了总参数和开放权重方向,独立报道则指出 active-parameter count、model card、license 和 benchmark table 均未公开。13

能力亮点和评测缺口

阿里云百炼的模型推荐文档把 Qwen3.8-Max-Preview 放在高推理能力选项中,覆盖 AI 编程、Agent、聊天、内容生成、摘要、文档处理和复杂数据分析等场景。Token Plan 文档列出的能力类型是推理模型、视觉理解和文本生成。42
目前能看到的性能说法主要有两类:Qwen 官方称它是「最强大的模型之一」,并称其表现「仅次于 Fable 5」;第三方报道确认发布时没有随附可复核的 benchmark 表。前者可以用来理解厂商定位,不能当作跨模型排名。没有统一测试集、提示词、推理预算和工具配置,读者无法判断这句话对应的是编码、知识问答,还是 Agent 工作流。

怎么用,价格是什么

阿里 Qwen 官方给出的首发入口包括 Token Plan、Qoder 和 QoderWork;IT 之家还确认千问 PC 端提供免费体验。阿里云模型页当前把 qwen3.8-max-preview 标注为「仅 Token Plan 可用」,所以普通百炼用户不能默认拥有该模型的通用调用权限。156
Token Plan 个人版当前仅支持华北 2(北京)地域,公开的限时价格和额度如下:2
套餐限时价格每 7 天额度每 5 小时额度
Lite39 元/月2,500 Credits700 Credits
Standard139 元/月10,000 Credits3,000 Credits
Pro499 元/月40,000 Credits12,000 Credits
这些是 Token Plan 的订阅价格和 Credits 额度,不是 Qwen3.8-Max-Preview 的按 Token API 单价。官方文档还写明,活动期间模型调用 Credits 消耗最低可到标准值的 1 折,个人版每天 22:00 至次日 08:00 还有折上折;活动内容和有效期以页面最新信息为准。2
API 状态需要单独看待:阿里云 DashScope API 参考页已经出现 qwen3.8-max-preview 的参数说明,默认 reasoning_effortxhigh;但模型列表仍标注「仅 Token Plan 可用」,而 Token Plan 个人版文档明确禁止把订阅 Key 用于自动化脚本、自定义应用后端或非交互式批量调用。因此,现阶段不要把个人版 Token Plan 当成通用生产 API。72

现在适合测什么

如果团队已经有 Qoder、QoderWork 或 Token Plan 入口,可以先做一轮小规模对比:
  1. 用同一组真实代码任务比较一次完成率、返工次数和工具调用稳定性,不要只看首轮回答。
  2. 用同一批长文档测试视觉理解、表格抽取和跨文档推理,记录输入类型和文档长度。
  3. 把 Credits 消耗、等待时间、失败率和最终人工修改量一起记下来,再和现有模型比较。
  4. 暂不把生产流量迁移到预览模型,也不要根据 2.4T 总参数估算本地部署成本。
下一次值得跟踪的是正式开放权重是否落地,以及随之出现的技术报告、license、激活参数、上下文规格和可复核 benchmark。只要这些信息没有补齐,Qwen3.8-Max-Preview 更适合做候选模型测试,而不是直接替换现有生产模型。
官方入口:

関連コンテンツ

  • ログインするとコメントできます。
More from this channel