
Qwen3.8-Max-Preview 发布:2.4T 参数旗舰预览版,正式版与开放权重待定
阿里发布 Qwen3.8-Max-Preview,确认 2.4T 总参数和多模态定位,当前可通过 Token Plan 等入口体验,但 benchmark、激活参数、license 与正式开放权重日期仍待补齐。
先说结论
阿里 Qwen 在 2026 年 7 月 19 日公开 Qwen3.8-Max-Preview,官方称其总参数量达到 2.4T,并计划很快开放权重。当前版本已经通过 Token Plan、Qoder 和 QoderWork 提供体验,阿里云文档把它定位为支持推理、视觉理解和文本生成的预览模型。12
对开发者的直接判断是:可以开始做编码、文档和复杂推理任务的横向测试,但暂时不适合依据「2.4T」或「仅次于 Fable 5」的宣传语做生产迁移。激活参数、benchmark 表、model card、license、上下文长度和正式开放权重日期都还没有完整公开。3
已确认的信息
| 项目 | 当前可核实信息 |
|---|---|
| 模型 | Qwen3.8-Max-Preview,模型 ID 为 qwen3.8-max-preview |
| 发布时间 | 2026 年 7 月 19 日 |
| 参数规模 | 总参数量 2.4T;激活参数量未披露 |
| 模态与能力 | 推理模型、视觉理解、文本生成;公开报道还提到文本、图像、视频和文档输入 |
| 上下文长度 | 官方当前公开文档未给出可核实数值 |
| 版本状态 | Preview,预览期间模型能力会持续迭代,结束后可能下线或替换为正式版本 |
| 开放权重 | Qwen 官方称「soon」,没有给出具体日期 |
| benchmark | 未公开完整 benchmark 表;「仅次于 Fable 5」属于厂商自述,尚无独立验证 |
「2.4T」是总参数规模,不等于每个 Token 都会激活 2.4T 参数,也不能直接换算成本地部署所需显存或单次调用成本。Qwen 官方帖子确认了总参数和开放权重方向,独立报道则指出 active-parameter count、model card、license 和 benchmark table 均未公开。13
能力亮点和评测缺口
阿里云百炼的模型推荐文档把 Qwen3.8-Max-Preview 放在高推理能力选项中,覆盖 AI 编程、Agent、聊天、内容生成、摘要、文档处理和复杂数据分析等场景。Token Plan 文档列出的能力类型是推理模型、视觉理解和文本生成。42
目前能看到的性能说法主要有两类:Qwen 官方称它是「最强大的模型之一」,并称其表现「仅次于 Fable 5」;第三方报道确认发布时没有随附可复核的 benchmark 表。前者可以用来理解厂商定位,不能当作跨模型排名。没有统一测试集、提示词、推理预算和工具配置,读者无法判断这句话对应的是编码、知识问答,还是 Agent 工作流。
怎么用,价格是什么
阿里 Qwen 官方给出的首发入口包括 Token Plan、Qoder 和 QoderWork;IT 之家还确认千问 PC 端提供免费体验。阿里云模型页当前把
qwen3.8-max-preview 标注为「仅 Token Plan 可用」,所以普通百炼用户不能默认拥有该模型的通用调用权限。156Token Plan 个人版当前仅支持华北 2(北京)地域,公开的限时价格和额度如下:2
| 套餐 | 限时价格 | 每 7 天额度 | 每 5 小时额度 |
|---|---|---|---|
| Lite | 39 元/月 | 2,500 Credits | 700 Credits |
| Standard | 139 元/月 | 10,000 Credits | 3,000 Credits |
| Pro | 499 元/月 | 40,000 Credits | 12,000 Credits |
这些是 Token Plan 的订阅价格和 Credits 额度,不是 Qwen3.8-Max-Preview 的按 Token API 单价。官方文档还写明,活动期间模型调用 Credits 消耗最低可到标准值的 1 折,个人版每天 22:00 至次日 08:00 还有折上折;活动内容和有效期以页面最新信息为准。2
API 状态需要单独看待:阿里云 DashScope API 参考页已经出现
qwen3.8-max-preview 的参数说明,默认 reasoning_effort 为 xhigh;但模型列表仍标注「仅 Token Plan 可用」,而 Token Plan 个人版文档明确禁止把订阅 Key 用于自动化脚本、自定义应用后端或非交互式批量调用。因此,现阶段不要把个人版 Token Plan 当成通用生产 API。72现在适合测什么
如果团队已经有 Qoder、QoderWork 或 Token Plan 入口,可以先做一轮小规模对比:
- 用同一组真实代码任务比较一次完成率、返工次数和工具调用稳定性,不要只看首轮回答。
- 用同一批长文档测试视觉理解、表格抽取和跨文档推理,记录输入类型和文档长度。
- 把 Credits 消耗、等待时间、失败率和最终人工修改量一起记下来,再和现有模型比较。
- 暂不把生产流量迁移到预览模型,也不要根据 2.4T 总参数估算本地部署成本。
下一次值得跟踪的是正式开放权重是否落地,以及随之出现的技术报告、license、激活参数、上下文规格和可复核 benchmark。只要这些信息没有补齐,Qwen3.8-Max-Preview 更适合做候选模型测试,而不是直接替换现有生产模型。
官方入口:
関連コンテンツ
- ログインするとコメントできます。
