AI 模型定价周报:DeepSeek V4 切换完成,GPT-5.6 与 Gemini 3.6 Flash 入表

AI 模型定价周报:DeepSeek V4 切换完成,GPT-5.6 与 Gemini 3.6 Flash 入表

截至 7 月 27 日,DeepSeek 旧模型名已过弃用节点,GPT-5.6 和 Gemini 3.6 Flash 入表,本文用官方价格与 Artificial Analysis v4.1 对比主要模型的预算取舍。

本周先看结论

数据截止:2026 年 7 月 27 日 09:00(北京时间)。
DeepSeek 的 deepseek-chatdeepseek-reasoner 已在 7 月 24 日 23:59(北京时间)到达官方弃用节点,当前价格页改以 V4 Flash 和 V4 Pro 为主。旧名称虽然暂时映射到 V4 Flash 的非思考和思考模式,代码仍应尽快改成新模型名。1
本周最值得记住的还有四件事:
  • GPT-5.6 Sol 的 API 价是每百万 Token 输入 5 美元、输出 30 美元,缓存命中价为 0.50 美元。它的能力价位明显高于本期其它国际模型。2
  • Gemini 3.6 Flash 在 Artificial Analysis Intelligence Index v4.1 上得分 50,输出速度 239.6 Token/秒,标准输入和输出价为 1.50 美元和 7.50 美元,适合高吞吐工作流。34
  • Claude Sonnet 5 的 2 美元输入、10 美元输出仍是限时价,到 9 月 1 日将切换为 3 美元和 15 美元。现在签订长期预算时,不能把 2/10 当成长期基准。5
  • 百炼的千问 3.7 Max 和 Plus 仍分别标着限时 5 折和 8 折,北京地域还有 100 万 Token 免费额度;优惠页没有给出统一结束日期,适合先用小流量压测,不适合按优惠价做全年承诺。6

价格快照与上期变化

下表统一按每百万 Token 展示。美元和人民币保留原币种,不做汇率换算。缓存写入、缓存命中和 Batch 价格与普通实时价格分开,当前官方页面没有列出的项目直接写「未列出」。
厂商与模型标准输入标准输出缓存 / Batch地区与 7 月 21 日相比
OpenAI GPT-5.6 Sol$5$30写入 $6.25,命中 $0.50;发布页未列 Batch 价上期未纳入 GPT-5.6 API,本期补入价格锚点;全球逐步开放
Anthropic Claude Sonnet 5$2(8 月 31 日前)$10(8 月 31 日前)5 分钟写入 $2.50,1 小时写入 $4,命中 $0.20;Batch 为 $1/$5与上期限时价相同;9 月 1 日起为 $3/$15,US-only 推理对 Token 类别加价 1.1 倍
Google Gemini 3.6 Flash$1.50$7.50命中 $0.15,存储 $1/百万 Token/小时;Batch 和 Flex 为 $0.75/$3.75上期没有 3.6 Flash;标准层仍提供免费层,Batch/Flex 不在免费层可用
DeepSeek V4 Flash / ProFlash $0.14;Pro $0.435Flash $0.28;Pro $0.87Flash 命中 $0.0028;Pro 命中 $0.003625;Batch 未列出上期的旧名称映射结束,当前直接按 V4 价目计费;页面未列地区差价
阿里云百炼 qwen3.7 Max / Plus(华北 2,北京)Max ¥6;Plus ¥1.60(输入不超过 256K)Max ¥18;Plus ¥6.40(输入不超过 256K)缓存创建为标准输入价 1.25 倍,命中为 10%;Batch 为实时价 50%,二者不能叠加上期记录的 5 折 / 8 折仍在;Plus 输入超过 256K 后为 ¥4.80,输出 ¥19.20;北京有 100 万 Token、90 天免费额度
百度千帆 ERNIE X1.1 Preview¥1¥4当前产品页未列缓存或 Batch 价本期只纳入官方价格快照;页面未给出地区价差,也没有同口径 benchmark 分数
OpenAI 的缓存写入价是未缓存输入价的 1.25 倍,命中继续享受 90% 折扣;GPT-5.6 发布页没有单独列出 Batch 价格,所以这里不把通用 Batch 规则套到它身上。2
Gemini 3.6 Flash 的 Batch 和 Flex 价格正好是标准输入、输出价格的一半,缓存命中价也降到 0.075 美元;如果请求允许延迟,批处理比实时标准层更划算。Google 价格页还列出每百万 Token 每小时 1 美元的缓存存储费,长时间保留上下文时要把这项加进账单。3
百炼的折扣不能简单相加。Batch 和上下文缓存不能同时生效,缓存只折扣输入 Token;在北京以外,千问 3.7 Max 的国际价和美国部署价更高,且表内免费额度只出现在北京地域。以 qwen3.7-max-us 为例,原价是输入 18.736 元、输出 56.207 元,限时 5 折后约为 9.368 元和 28.104 元。6

同一 benchmark 下怎么看性价比

Artificial Analysis Intelligence Index v4.1 是同一套公开评测口径,页面同时给出 Intelligence 分数、输出速度和价格字段。它不是业务成功率,也不能替代自己的任务集;这里用它来避免把不同评测的分数混在一起。7
模型Intelligence Index v4.1输出速度本期官方标准价价格与能力的关系
GPT-5.6 Sol(max)5975.9 Token/秒$5 输入 / $30 输出分数最高,但输出价也是本表最高;只有少重试、少人工复核能兑现价值时才值得上
Claude Sonnet 55377.2 Token/秒$2 输入 / $10 输出能力、速度和价格较均衡,且缓存命中与 Batch 都有明确价;注意 9 月涨价
Gemini 3.6 Flash(high)50239.6 Token/秒$1.50 输入 / $7.50 输出分数接近 Sonnet 5,速度约为其 3 倍,适合大量短任务、路由和实时反馈
DeepSeek V4 Pro(max effort)4472.3 Token/秒$0.435 输入 / $0.87 输出原始 Token 价格最低,适合预算敏感的推理任务;分数低于前三者,复杂任务要用真实重试率验证
Qwen3.7 Plus3954 Token/秒AA 对比页价格列为 $0.27/百万 Token;北京官方优惠价另见上表在同一对比页中高于 Gemini 3.1 Flash-Lite 的 25 分,但速度更慢;国内地域、人民币结算和免费额度是主要优势
GPT-5.6 Sol、Claude Sonnet 5、Gemini 3.6 Flash 和 DeepSeek V4 Pro 的分数、速度、缓存价和上下文窗口分别来自对应的 Artificial Analysis 模型页。89410 Qwen3.7 Plus 与 Gemini 3.1 Flash-Lite 的 39/25 分、54/329 Token/秒和 $0.27/$0.22 价格列来自同一对比页。11
这张表不能直接推出「分数除以价格」这种单一 ROI。模型输出长度、缓存命中率、重试次数和人工复核成本都不同。可验证的判断是:DeepSeek V4 Pro 负责压低 Token 账单,Gemini 3.6 Flash 负责吞吐,Sonnet 5 负责比较均衡的复杂任务,GPT-5.6 Sol 负责把高质量和少重试放在第一位。Qwen3.7 Plus 则适合需要中国内地地域、人民币报价或百炼免费额度的团队,能力结论只在上面的 AA 对比范围内成立。

按场景做选择

  1. 代码代理、研究和长链路推理:先用 DeepSeek V4 Pro 或 Sonnet 5 做一轮真实任务集。前者单价低,后者在 v4.1 分数上更高;不要只看输入价,记录每个成功任务的重试次数和人工修改时间。
  2. 高并发摘要、分类和实时反馈:优先压测 Gemini 3.6 Flash。它的 239.6 Token/秒是本期四个国际模型中最高,Batch/Flex 也给了低延迟之外的成本选项。
  3. 对结果质量最敏感的任务:再考虑 GPT-5.6 Sol。它的 59 分领先,但 $30/百万输出 Token 会迅速放大长答案成本;可以先用 Terra 或 Luna 做路由,只有评测显示少重试能抵消差价时才把 Sol 设为默认。
  4. 中国内地部署和人民币结算:百炼的 qwen3.7 Max/Plus 仍有折扣和北京免费额度,适合把流量放在国内服务上;跨地域部署时单独核对服务范围,不要把北京价格复制到美国或新加坡。
  5. 已经接入 DeepSeek 旧 SDK 的服务:本周应完成模型名、降级策略和账单告警的联调。旧名的兼容映射是迁移缓冲,不应当当作长期接口。

还不能下结论的地方

百度千帆当前产品页给出了 ERNIE 5.0、ERNIE X1.1 Preview 和 ERNIE 4.5 Turbo 的官方价格与上下文窗口,但本期没有拿到它们在 Artificial Analysis Intelligence Index v4.1 上可回溯的分数,因此只写价格,不做能力排名。12
同样,OpenAI GPT-5.6 官方发布页、DeepSeek 当前价格页和百度千帆产品页没有在本轮详情中列出可直接引用的 Batch 费率。正文保留「未列出」,没有用其它模型的折扣规则代替。下期只有在拿到对应官方 Batch 价格或明确的官方计费文档后,才会把这三家补进统一 Batch 横表。
本周的预算动作可以压缩成一句话:先把 DeepSeek 旧名称迁走,再用 Gemini 3.6 Flash、Sonnet 5 和 DeepSeek V4 Pro 的真实任务成本做路由,涉及长期合同的 Sonnet 5 则按 9 月 1 日后的 3/15 价格预留预算。

Related content

  • Sign in to comment.
More from this channel