DeepSeek-V4-Pro-0813 落地:1M 上下文,API 价格 3/0.025/6 元,参数与 benchmark 未披露

DeepSeek-V4-Pro-0813 落地:1M 上下文,API 价格 3/0.025/6 元,参数与 benchmark 未披露

DeepSeek 将 API 中的 deepseek-v4-pro 更新为 DeepSeek-V4-Pro-0813,支持 1M 上下文、384K 最大输出和工具调用;中文价目为输入缓存未命中/命中/输出每百万 tokens 3/0.025/6 元,但官方尚未披露参数规模与 0813 专属 benchmark。

先看结论

DeepSeek 已把 API 中的 deepseek-v4-pro 更新为 DeepSeek-V4-Pro-0813,调用名不变。对开发者来说,这是一条可以直接重跑评测的后端更新:1M 上下文、最大 384K 输出,支持思考与非思考模式、JSON Output、Tool Calls、Responses API 和 Anthropic API。官方参数规模和本次更新专属 benchmark 尚未公布。12
价格也已写入中文价目页:每百万 tokens 输入缓存未命中 3 元、缓存命中 0.025 元、输出 6 元;并发限制为 500。DeepSeek 同时提示,API 服务近期计划整体上调价格,预计涨幅较大,具体方案以正式通知为准。2

这次到底更新了什么

项目已确认信息对选型的影响
模型 IDdeepseek-v4-pro 不变,后端版本更新为 DeepSeek-V4-Pro-0813现有代码通常无需改模型名,但应重新固定版本、记录结果。1
发布时间官方 news0813 页面与模型页已显示 0813 版本;页面正文未单独列出发布时间这是 API 后端版本切换,不要把 7 月 31 日 V4-Flash 更新的日期当成 Pro 的发布日期。1
参数规模官方未披露不要据此推算显存、延迟或成本。
上下文长度1M tokens长文档、代码库和多轮 Agent 任务可纳入第一轮测试。2
最大输出384K tokens适合长报告或长代码生成,但实际可用长度仍受任务、限流和余额影响。2
模态官方当前模型表未列出视觉输入能力不要把 V4 其他入口或旧版传闻中的能力移植到这个 API 条目。
API 入口OpenAI 格式 https://api.deepseek.com;Anthropic 格式 https://api.deepseek.com/anthropic可沿用兼容 OpenAI / Anthropic 的 SDK 或工具链。1
并发限制500需要压测的团队要把并发上限单独记入测试条件。2
页面没有给出一个可直接填写的「发布时间」字段,所以本文只把 0813 视为官方文档在本轮更新中确认的版本标识,不把页面路径当作精确发布时间。1

能力亮点:接口兼容比新名更重要

这次更新对工程团队最实际的变化,不是模型 ID 变了,而是原有 API 接口继续可用。官方示例仍使用 deepseek-v4-pro,并展示了开启思考模式和设置 reasoning_effort 的调用方式。1
思考模式默认开启,也可以显式关闭;reasoning_effort 支持 lowhighmax,默认是 high。这给评测留下了一个必须控制的变量:比较旧版和 0813 时,不能一边使用默认思考、一边把另一边固定为非思考。3
工具调用与结构化输出也在支持范围内。官方 API 参考页列出 JSON Output、最多 128 个函数工具、tool_choice 控制,以及工具调用后的 finish_reason;Responses API 和 Anthropic API 则在模型价格页列为支持项。23

Benchmark:这次没有新成绩可抄

DeepSeek 的 0813 更新说明只说明 deepseek-v4-pro 已更新到 DeepSeek-V4-Pro-0813,没有附带新的 benchmark 表。当前能确认的是版本、接口和服务规格,不能把 7 月 31 日 V4-Flash 的 Terminal Bench、DeepSWE 等成绩写到 V4-Pro-0813 名下。14
因此,想判断它是否值得替换现有后端,建议至少保留三组结果:
  • 能力:长上下文召回、代码库修改、工具调用成功率和结构化输出解析率。
  • 成本:缓存命中率、输入与输出 tokens、单任务费用,以及思考模式带来的额外消耗。
  • 稳定性:首 token 延迟、完整响应耗时、并发 500 以内的错误率和人工接管次数。
每组都要记录思考开关、reasoning_effort、上下文长度、工具 schema 和采样参数。否则重跑出来的差异,可能只是测试条件不同。

价格与可用范围

计费项deepseek-v4-pro-0813
输入,缓存未命中¥3 / 1M tokens
输入,缓存命中¥0.025 / 1M tokens
输出¥6 / 1M tokens
并发限制500
价格单位是每百万 tokens。中文官方价目页还写明,DeepSeek 计划近期整体上调 API 服务价格,预计涨幅较大;这不是已经生效的新价格,采购预算不能把它当成确定涨价幅度。2
可用范围目前可以确认到 API:OpenAI 兼容入口为 https://api.deepseek.com,Anthropic 兼容入口为 https://api.deepseek.com/anthropic;官方更新页还列出 Claude Code、GitHub Copilot 和 OpenCode 等 Agent / 编程工具的接入说明。1

现在该怎么做

如果你已经在使用 deepseek-v4-pro,最省事的做法是复制一份现有评测,不改业务提示词,只替换服务端版本并记录调用时间。重点看长上下文任务、工具调用、代码修改和缓存命中四项,先不要用旧版 V4-Pro-Preview 的结果替代 0813 的实测。
如果你准备接入生产,先把三件事写进配置:实际使用的模型 ID、思考模式和 reasoning_effort。再把价格页的「近期可能整体上调」当作预算风险,设置定期复核,而不是提前假设具体涨幅。
这次发布已经足够触发一轮 API 回归测试,但还不足以支持「性能全面提升」的结论:官方参数规模、0813 专属 benchmark 和更完整的安全评估仍未公开。

References

  1. 1
    DeepSeek API 官方更新说明api-docs.deepseek.com
  2. 2
  3. 3
  4. 4
    DeepSeek API 官方变更日志api-docs.deepseek.com
大模型发布追踪

大模型发布追踪

追踪各大厂商最新大模型发布,第一时间推送核心信息

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

  • Sign in to comment.