
DeepSeek-V4-Pro-0813 落地:1M 上下文,API 价格 3/0.025/6 元,参数与 benchmark 未披露
DeepSeek 将 API 中的 deepseek-v4-pro 更新为 DeepSeek-V4-Pro-0813,支持 1M 上下文、384K 最大输出和工具调用;中文价目为输入缓存未命中/命中/输出每百万 tokens 3/0.025/6 元,但官方尚未披露参数规模与 0813 专属 benchmark。
先看结论
DeepSeek 已把 API 中的
deepseek-v4-pro 更新为 DeepSeek-V4-Pro-0813,调用名不变。对开发者来说,这是一条可以直接重跑评测的后端更新:1M 上下文、最大 384K 输出,支持思考与非思考模式、JSON Output、Tool Calls、Responses API 和 Anthropic API。官方参数规模和本次更新专属 benchmark 尚未公布。12价格也已写入中文价目页:每百万 tokens 输入缓存未命中 3 元、缓存命中 0.025 元、输出 6 元;并发限制为 500。DeepSeek 同时提示,API 服务近期计划整体上调价格,预计涨幅较大,具体方案以正式通知为准。2
这次到底更新了什么
| 项目 | 已确认信息 | 对选型的影响 |
|---|---|---|
| 模型 ID | deepseek-v4-pro 不变,后端版本更新为 DeepSeek-V4-Pro-0813 | 现有代码通常无需改模型名,但应重新固定版本、记录结果。1 |
| 发布时间 | 官方 news0813 页面与模型页已显示 0813 版本;页面正文未单独列出发布时间 | 这是 API 后端版本切换,不要把 7 月 31 日 V4-Flash 更新的日期当成 Pro 的发布日期。1 |
| 参数规模 | 官方未披露 | 不要据此推算显存、延迟或成本。 |
| 上下文长度 | 1M tokens | 长文档、代码库和多轮 Agent 任务可纳入第一轮测试。2 |
| 最大输出 | 384K tokens | 适合长报告或长代码生成,但实际可用长度仍受任务、限流和余额影响。2 |
| 模态 | 官方当前模型表未列出视觉输入能力 | 不要把 V4 其他入口或旧版传闻中的能力移植到这个 API 条目。 |
| API 入口 | OpenAI 格式 https://api.deepseek.com;Anthropic 格式 https://api.deepseek.com/anthropic | 可沿用兼容 OpenAI / Anthropic 的 SDK 或工具链。1 |
| 并发限制 | 500 | 需要压测的团队要把并发上限单独记入测试条件。2 |
页面没有给出一个可直接填写的「发布时间」字段,所以本文只把 0813 视为官方文档在本轮更新中确认的版本标识,不把页面路径当作精确发布时间。1
能力亮点:接口兼容比新名更重要
这次更新对工程团队最实际的变化,不是模型 ID 变了,而是原有 API 接口继续可用。官方示例仍使用
deepseek-v4-pro,并展示了开启思考模式和设置 reasoning_effort 的调用方式。1思考模式默认开启,也可以显式关闭;
reasoning_effort 支持 low、high 和 max,默认是 high。这给评测留下了一个必须控制的变量:比较旧版和 0813 时,不能一边使用默认思考、一边把另一边固定为非思考。3工具调用与结构化输出也在支持范围内。官方 API 参考页列出 JSON Output、最多 128 个函数工具、
tool_choice 控制,以及工具调用后的 finish_reason;Responses API 和 Anthropic API 则在模型价格页列为支持项。23Benchmark:这次没有新成绩可抄
DeepSeek 的 0813 更新说明只说明
deepseek-v4-pro 已更新到 DeepSeek-V4-Pro-0813,没有附带新的 benchmark 表。当前能确认的是版本、接口和服务规格,不能把 7 月 31 日 V4-Flash 的 Terminal Bench、DeepSWE 等成绩写到 V4-Pro-0813 名下。14因此,想判断它是否值得替换现有后端,建议至少保留三组结果:
- 能力:长上下文召回、代码库修改、工具调用成功率和结构化输出解析率。
- 成本:缓存命中率、输入与输出 tokens、单任务费用,以及思考模式带来的额外消耗。
- 稳定性:首 token 延迟、完整响应耗时、并发 500 以内的错误率和人工接管次数。
每组都要记录思考开关、
reasoning_effort、上下文长度、工具 schema 和采样参数。否则重跑出来的差异,可能只是测试条件不同。价格与可用范围
| 计费项 | deepseek-v4-pro-0813 |
|---|---|
| 输入,缓存未命中 | ¥3 / 1M tokens |
| 输入,缓存命中 | ¥0.025 / 1M tokens |
| 输出 | ¥6 / 1M tokens |
| 并发限制 | 500 |
价格单位是每百万 tokens。中文官方价目页还写明,DeepSeek 计划近期整体上调 API 服务价格,预计涨幅较大;这不是已经生效的新价格,采购预算不能把它当成确定涨价幅度。2
可用范围目前可以确认到 API:OpenAI 兼容入口为
https://api.deepseek.com,Anthropic 兼容入口为 https://api.deepseek.com/anthropic;官方更新页还列出 Claude Code、GitHub Copilot 和 OpenCode 等 Agent / 编程工具的接入说明。1现在该怎么做
如果你已经在使用
deepseek-v4-pro,最省事的做法是复制一份现有评测,不改业务提示词,只替换服务端版本并记录调用时间。重点看长上下文任务、工具调用、代码修改和缓存命中四项,先不要用旧版 V4-Pro-Preview 的结果替代 0813 的实测。如果你准备接入生产,先把三件事写进配置:实际使用的模型 ID、思考模式和
reasoning_effort。再把价格页的「近期可能整体上调」当作预算风险,设置定期复核,而不是提前假设具体涨幅。这次发布已经足够触发一轮 API 回归测试,但还不足以支持「性能全面提升」的结论:官方参数规模、0813 专属 benchmark 和更完整的安全评估仍未公开。
References
- 1DeepSeek API 官方更新说明
api-docs.deepseek.com
- 2DeepSeek API 官方模型与价格页
api-docs.deepseek.com
- 3DeepSeek Chat Completions API 官方参考
api-docs.deepseek.com
- 4DeepSeek API 官方变更日志
api-docs.deepseek.com

大模型发布追踪
追踪各大厂商最新大模型发布,第一时间推送核心信息
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
- Sign in to comment.