豆包 2.1 Pro 更新到 0915 版:上下文从 256K 扩到 1M,API 价格未变

豆包 2.1 Pro 更新到 0915 版:上下文从 256K 扩到 1M,API 价格未变

字节跳动把豆包旗舰模型 Doubao-Seed-2.1-Pro 升级到 0915 快照:上下文窗口从 256K 扩到 1024K 而 API 计费未变,官方交了四个自测案例与两项效率数字,标准榜单分数和参数规模都还没公布。

北京时间 2026 年 9 月 15 日,字节跳动把旗舰模型 Doubao-Seed-2.1-Pro 更新到新快照 doubao-seed-2-1-pro-260915。火山方舟的模型发布公告把这一条列进 202609 版块,版本说明一栏标记「新发布」,模型类型为深度思考模型。1官方给它的定位是:支持 1M 超长上下文,可用于 Agent 长程任务执行、异步子任务验收、多模态理解、深度调研、工具执行、Office 办公跨应用协同及 Coding 工程实践等场景。1
火山方舟的模型广场详情页把这一版和今年 6 月的 doubao-seed-2-1-pro-260628 并排放在同一个页面上,规格与价格可以逐行对照。2

先说结论:变了什么,没变什么

上下文窗口从 256K 扩到 1024K,最大输出仍是 256K,最大思考内容长度也是 256K。2
计费没有调整:输入每百万 tokens 6 元、输出 30 元、缓存命中 1.2 元,缓存存储每小时每百万 tokens 0.017 元;批量推理与低优(Flex)推理都按在线价的五折计。2
思考模式支持 enabled(默认)与 disabled 两种取值;reasoning_effort 提供 minimallowmediumhigh 四档,默认 high,其中 minimal 相当于不思考。23
官方这次没有公布总参数量,也没有给出标准榜单上的分数或第三方机构的独立评测结果。12

这次更新改了哪些能力

官方版本更新页面把 2026/09/15 这一版的变化归到六个方向。2
  • Agent:复杂多步骤、长周期任务可以持续推进,官方描述为强化任务拆解、持续规划与工具协同,把工作推进到可验收的成果;异步子任务的协同与验收更可靠,模型更多依据真实状态和返回结果确认完成,减少提前收尾与反复返工。
  • 多模态理解:图片、视频理解与视觉推理能力增强,官方称图片和视频理解任务的耗时比上一代减少 40%。
  • 深度调研:强化证据溯源、资料时效判断、来源权威性与数据核验;官方举的例子是金融投研场景下建模计算的可信度与研究报告的交付质量有提升。
  • 工具执行:官方称 Agent 幻觉大幅改善,模型会调用必要工具取证、等待真实结果并检查返回内容;遇到工具不可用或证据不足时说明边界、保留不确定性。
  • Office 办公:文档、PPT 与表格的生成、修改和核验,优化了基础版式、全局修改一致性以及修改后的回读与视觉验收;结合多模态理解与 Computer Use,衔接浏览器、文档、表格和文件操作。
  • Coding:视觉理解被用于前端开发,模型按设计图理解布局、样式与细节并还原 Web 界面;同时覆盖自然语言驱动的新项目构建、环境部署与运维。

参数、规格与计费明细

项目260915(本期新版)260628(上一版)官方说明
上下文窗口1024K256K模型广场规格表逐行给出两版数值。2
最大输入 Token1024K256K与上下文窗口同值。2
最大输出 Token256K256K两版一致。2
最大思考内容 Token256K256K两版一致。2
TPM / RPM 上限1000K / 5001000K / 500两版一致。2
输入 / 输出模态文本、图片、视频 / 文本文本、图片、视频 / 文本两版一致,任务类型含文本生成与图片内容理解。2
在线推理输入6 元 / 百万 tokens6 元 / 百万 tokens人民币计价,两版同价。2
在线推理输出30 元 / 百万 tokens30 元 / 百万 tokens两版同价。2
缓存命中输入1.2 元 / 百万 tokens1.2 元 / 百万 tokens两版同价。2
缓存存储0.017 元 / 百万 tokens / 小时0.017 元 / 百万 tokens / 小时两版同价。2
批量推理输入 3 元、输出 15 元、缓存命中 1.2 元同左按在线价的五折计。2
低优(Flex)推理输入 3 元、输出 15 元、缓存命中 1.2 元同左按在线价的五折计。2
总参数量官方未披露官方未披露发布公告与模型广场都未给出这一项。1
API 路径/v3/chat/completions/v3/responses/v3/tokenization同左模型广场的 API 支持范围列出这三条。2

官方公布的四个案例

模型广场的能力展示区给了四个案例,数字全部来自火山引擎自己的测试。2
  • VLM 加多 Agent 尽调:500 多个子 Agent 协同,检索 1000 多个网页,再结合卫星影像、航运与招聘数据交叉核验财报。2
  • 复杂仓库 Coding:在 38.7 万行的开源游戏 Luanti 仓库里,多 Agent 并行修复横跨 13 个模块的历史问题;官方给出的结果是 1000 项真实任务中 83% 达到可合并级标准。2
  • 多模态 Coding:读懂 28 万行 ERP 代码,从录屏与草图出发交付 3 个移动端页面并跑通完整采购链路,官方给出的耗时约为 2 小时。2
  • VLM 加前端:从一张庭院四季设计图出发,用代码生成可演示、可控制镜头变化的 3D 动态场景。2
媒体转述火山引擎消息时补了两个数字:Luanti 那批任务在近 36 小时内完成;图像推理和视频推理的 Token 消耗比上一代减少 30% 以上。45

哪些数字还没有

标准榜单的分数这次没有出现。官方页面用的是四个自测案例和两项效率数字,模型广场的规格表里也找不到 Terminal Bench、SWE-bench 这一类条目。12
火山方舟的发布公告、模型广场的规格表,以及转述火山引擎消息的媒体报道,都没有引用第三方评测机构的独立结果。145
要判断这版模型能不能替换手上的方案,目前只能按上面的规格表跑一轮自己场景的评测;等第三方机构公布独立结果再看横向排名。2

接入方式与切换成本

新版在火山方舟上的模型 ID 是 doubao-seed-2-1-pro-260915,API 覆盖 Chat Completions、Responses 与 Tokenization 三条路径,任务类型为文本生成与图片内容理解。2在线推理、批量推理、显式缓存(Responses API)、隐式缓存、结构化输出、函数调用、联网搜索、知识库、MCP 与模型精调也都已在模型广场页列出。2
媒体转述火山引擎消息说,新版 API 已全量上线火山方舟;豆包工作客户端升级到最新版后,可以在模型列表里选「豆包 2.1 Pro(0915 新版)」;TRAE 已同步接入。45
已经接入的团队,按调用方式分两条路:
  • 调用参数里钉着 doubao-seed-2-1-pro-260628 的,要显式换成 260915 才会拿到这次更新。
  • 通过统一 Model ID doubao-seed-evolving 调用的,官方写明 260915 与 9 月 9 日更新的 doubao-seed-evolving 是同款模型,这条链路已经跑在新版上,接入节点无需更换。25
按 1M 上下文重新估算成本时,账单取决于真实输入长度:缓存命中价 1.2 元与未命中价 6 元之间差五倍,长文档问答这类场景的缓存策略会直接改变开销。2

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel