
DeepSeek V4-Pro进了旗舰赛,低价还没封账
The Information 报道 DeepSeek 推出 V4-Pro 正式版;本文厘清其 API、Agent 跑分与价格证据,并解释低价为何更像一张尚待调价验证的市场门票。
导读
V4-Pro 的重要变化不是又多了一张跑分表,而是 DeepSeek 把旗舰 Agent 能力塞进了开发者已经在用的接口,并暂时维持远低于美国前沿模型的价格。
作者丨 AI 科技评论
编辑丨 AI 科技评论
8 月 13 日,北京时间 11 时 48 分,The Information 发布 Juro Osawa 的短简报《DeepSeek Releases Flagship V4-Pro Model in Challenge to Kimi K3》。1
简报只有四段,判断很直接。
DeepSeek 正式推出 V4-Pro;它在部分基准上接近 Kimi K3,API 价格却低得多;中国开放权重模型与 Anthropic、OpenAI 前沿模型的竞争因此继续升温。1
这条新闻真正留下的问题是:DeepSeek 已经追上了旗舰 Agent,还是先把进入赛场的门票降到了地板价?
我们的判断偏向后者。
V4-Pro 已经具备参与旗舰 Agent 竞争的产品形态,但公开证据还不足以证明它稳定追平了 Kimi K3 或 Claude。
01|正式版先到接口
V4-Pro 没有等一场发布会。
DeepSeek 的官方模型与价格页已把
deepseek-v4-pro 的实际版本更新为 DeepSeek-V4-Pro-0813,原调用名不变。2它支持 100 万 token 上下文、最高 38.4 万 token 输出,默认开启思考模式,也支持非思考模式。2
IT 之家在北京时间 8 月 13 日 0 时 05 分记录到正式版已经上线 API,并称新版增强了 Agent 能力。5
AI 科技评论注意到,这次发布最成熟的部分不是宣传,而是接口。
模型名不用换,OpenAI 与 Anthropic 两套调用格式不用拆,Codex 等工具也能直接接入。
DeepSeek 不是先让开发者理解一套新产品,而是让旧代码自动拿到一个新模型。
这像给已经铺好的高速公路换了一台发动机。
车不用下路,收费站也没有重建。
02|跑分还不能封账
The Information 引用 Vals AI 的榜单称,V4-Pro 在开放权重模型中排名第二,仅次于 Kimi K3。1
Vals AI 随后给出了更具体的口径:V4-Pro-0813 的 Vals Index 上升 11 分,每项任务成本为 0.14 美元,成本比 Kimi K3 低 17 倍。6
据流传的 DeepSeek 官方群对比表(并非官方正式基准报告),V4-Pro-0813 在 Terminal-Bench 2.1 上得到 87.9 分,Anthropic Claude Fable 5(下文简称 Fable 5)为 88.0 分;在 CyberGym 等项目上,V4-Pro 还出现了小幅领先。7
这组数字很亮眼,但不能混成一句「全面追平」。
DeepSeek 的官方更新日志尚未发布 V4-Pro-0813 的正式基准报告;从已见材料看,流传表格也没有完整交代每项测试的运行框架、推理预算与复现条件。
不同 Agent 基准像不同路况。
一辆车在码头搬箱子更快,不等于它在城市、高速和山路上都更快。
Anthropic 对 Fable 5 的官方定位覆盖软件工程、知识工作、视觉与长程任务,并称部分敏感请求会回落到 Opus 4.8;这也说明 Fable 5 的线上表现并不完全等于无条件运行的单一模型。8
V4-Pro 已经拿到了几张进入旗舰桌面的成绩单,却还没有交出一份可复现的总成绩。
这不是否定能力。
这是把供应商自测、第三方榜单和真实业务效果分开记账。
03|低价先换调用
当前价格才是 V4-Pro 最锋利的部分。
DeepSeek 官方价为每百万 token 缓存未命中输入 0.435 美元、输出 0.87 美元;缓存命中输入只有 0.003625 美元。2
Moonshot 官方给 Kimi K3 的价格是输入 3 美元、输出 15 美元,缓存命中输入 0.3 美元。9
Anthropic 的 Claude Opus 5 为输入 5 美元、输出 25 美元;该公司称 Opus 5 以一半价格接近 Fable 5 的前沿能力。10
Fable 5 的官方价格更高,为输入 10 美元、输出 50 美元。8
按未命中缓存的公开单价算,V4-Pro 的输出价约为 Kimi K3 的十七分之一、Opus 5 的二十九分之一、Fable 5 的五十七分之一。
这组价格足以把旗舰 Agent 的计价单位,从「谨慎试用」改成「可以批量跑」。
但这张价目表有一个醒目的脚注。
DeepSeek 官方写明,计划近期整体上调 API 服务价格,而且「预计涨幅较大」,具体方案等待正式通知。2
所以,今天的低价更像一张获客价签,不能直接当成 V4-Pro 的长期成本结构。
开发者现在能确认的是调用成本。
他们还不能确认调价后的预算、峰谷差异,也不能确认大规模并发下的稳定吞吐。
官方页面给 V4-Pro 的并发上限为 500,V4-Flash 为 2500,这也划出了两款模型不同的使用边界。2
Pro 负责把更难的任务做出来。
Flash 负责让大量普通任务跑得起。
04|原话与边界
The Information 对这次发布的核心描述是:
Chinese AI developer DeepSeek on Wednesday launched the official version of its most advanced model, V4-Pro, which offers capabilities comparable to Moonshot AI’s popular Kimi K3 model on some benchmarks at much lower prices.意译:DeepSeek 推出最先进模型 V4-Pro 的正式版;在部分基准上,它的能力可与 Moonshot 的 Kimi K3 相比,价格却低得多。1
DeepSeek 对价格的原话更值得开发者记住:
We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected.意译:DeepSeek 计划近期整体上调 API 服务价格,预计涨幅较大。2
在 AI 科技评论看来,下一步要补的不是更多海报,而是三张账单。
第一张是独立基准,说明 V4-Pro 在同一运行框架和推理预算下能否稳定接近 Kimi K3、Opus 5 与 Fable 5。
第二张是真实任务,说明长代码库、网页操作和工具链任务能否在多轮执行后保持成功率。
第三张是正式调价,说明今天的成本优势还有多少能留到生产环境。
V4-Pro 已经把车开上了旗舰 Agent 的公路。
现在要看的,是正式调价后,这张低价通行证还能值多少。
References
- 1
- 2DeepSeek API 文档:Models & Pricing
api-docs.deepseek.com
- 3DeepSeek API 文档:Using the Responses API
api-docs.deepseek.com
- 4DeepSeek API 文档:Integrate with Codex
api-docs.deepseek.com
- 5IT之家:DeepSeek V4 Pro 正式版 API 更新上线
ithome.com
- 6
- 7TechWeb:DeepSeek V4 Pro 正式版来了,价格还没涨
m.techweb.com.cn
- 8Anthropic:Claude Fable 5 and Claude Mythos 5
anthropic.com
- 9Moonshot AI:Kimi K3 Quickstart
platform.kimi.ai
- 10Anthropic:Introducing Claude Opus 5
anthropic.com
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
