AI 模型定价周报:DeepSeek 迁移倒计时,Sonnet 5 与千问优惠进行时

AI 模型定价周报:DeepSeek 迁移倒计时,Sonnet 5 与千问优惠进行时

截至 7 月 21 日,DeepSeek 旧模型即将停用,Claude Sonnet 5 和千问 3.7 系列处于限时优惠期,本文用统一评测口径比较价格与能力。

先看结论

数据截止:2026 年 7 月 21 日 12:00(北京时间)。这期最值得记住的不是「谁的单价最低」,而是三件会直接影响预算和迁移的事:
  • DeepSeek 文档写明,deepseek-chatdeepseek-reasoner 将在北京时间 7 月 24 日 23:59 停用,对应迁移到 deepseek-v4-flash 的非思考和思考模式。已经写死旧模型名的调用,今天就该排查。1
  • Claude Sonnet 5 目前是限时价,输入 / 输出为 $2 / $10 每百万 Token,8 月 31 日后恢复到 $3 / $15。Batch 处理再打五折,适合能延迟返回的离线任务。2
  • 千问 3.7 Max 中国内地价格页标出原价 5 折,千问 3.7 Plus 标出原价 8 折;两者都支持中国内地新用户 100 万 Token 免费额度,额度有效期为 90 天。3

本周价格雷达

下面的价格都是每百万 Token。输入和输出必须分开看,因为多数模型的输出价远高于输入价;表中「Batch」只适用于异步批处理,不能拿来估算实时对话。
模型 / 服务标准输入价标准输出价本周可用的折扣或变化
Claude Sonnet 5$2$108 月 31 日前限时价;Batch 为 $1 / $5,之后标准价为 $3 / $15。2
Gemini 3.1 Flash-Lite$0.25$1.50Batch / Flex 为 $0.125 / $0.75;免费层有输入输出额度,但有模型和速率限制。4
千问 3.7 Plus,中国内地非思考输入 ¥2;思考输入 ¥8思考输出 ¥8当前页面标注限时 8 折;Batch 输入和输出均按实时推理价 50% 计费。3
千问 3.7 Max,中国内地¥12,当前限时 ¥6¥36,当前限时 ¥18页面标注限时 5 折;Batch 也按实时推理价 50% 计费。3
ERNIE 4.5 Turbo¥0.8¥3.2百度千帆当前公开页所列价格。5
ERNIE X1.1 Preview¥1¥4百度千帆当前公开页所列价格。5
ERNIE 5.0¥6–10¥24–40价格随页面列出的规格区间变化;这期不把区间中位数当作实际报价。5
阿里云价格页还写明,部分模型支持上下文缓存,命中输入 Token 的计费单价与标准输入不同;免费额度只适用于中国内地部署范围,并从开通百炼、模型发布或申请通过中较晚的时间起算 90 天。做预算时,先确认部署地域和是否使用思考模式,别把「每百万 Token」看成一个固定数字。3

同一把尺子的性价比

为了避免把厂商自报分数混在一起,下面只采用 Artificial Analysis Intelligence Index v4.1。它由 9 项评测组成,覆盖真实工作任务、工具调用、终端编程、科学推理、知识可靠性和长上下文推理等方向。价格列是该平台按 7:2:1 的「缓存命中 / 普通输入 / 输出」比例算出的每百万 Token 混合成本,不等于供应商价目表中的单一输入价或输出价。6
模型Intelligence Index混合成本(美元 / 百万 Token)速度或限制粗算每指数点成本
Kimi K357$2.3142 tokens/s;1M 上下文;输出偏长。7$0.041
GPT-5.6 Sol(high)56$4.3559 tokens/s;1M 上下文;支持图片输入。8$0.078
DeepSeek V4 Pro(Reasoning, Max Effort)44$0.1872 tokens/s;1M 上下文;不支持图片输入。8$0.004
Qwen3.7 Plus39$0.2753 tokens/s;1M 上下文;支持图片输入。9$0.007
Gemini 3.1 Flash-Lite25$0.22333 tokens/s;1M 上下文;支持图片输入。9$0.009
「每指数点成本」只是把两列相除的粗筛指标,不能理解成模型能力可以线性购买。它能说明一个现实:DeepSeek V4 Pro 的单位成本很低,Gemini 3.1 Flash-Lite 的吞吐量很高,Kimi K3 的能力分数最高但速度慢、输出多;三者对应的并不是同一个采购决策。
这张表也不能替 ERNIE 4.5 Turbo 和 ERNIE X1.1 Preview 排名,因为本期没有拿到它们在同一套 Intelligence Index v4.1 下的可比数据。价格可以先看,能力结论留到有同口径评测后再下。

怎么选更省

1. 先把旧 DeepSeek 模型名改掉

如果业务仍调用 deepseek-chatdeepseek-reasoner,优先做兼容性检查和灰度切换。官方文档说这两个名字只是兼容映射,停用后分别对应 deepseek-v4-flash 的非思考和思考模式。这个动作与价格无关,但比省几分钱更紧急。

2. 离线批处理,先看 Sonnet 5 和 Gemini Flash-Lite

报告生成、批量分类、数据清洗这类任务通常能等结果。Sonnet 5 的限时价已经比 9 月标准价低约三分之一,Batch 又是实时价的一半;Gemini 3.1 Flash-Lite 则把输入和输出单价都压得更低,且评测页显示吞吐量明显更高。要更强的推理能力,选 Sonnet 5;要高并发和简单处理,优先试 Flash-Lite。

3. 国内部署先看千问优惠,不要只看模型名

中国内地部署的千问 3.7 Plus 当前是 8 折,千问 3.7 Max 当前是 5 折,且有 90 天新用户额度。两者的输入价还要按思考 / 非思考模式区分,思考模式并不等于「同一个模型换个开关」,预算会明显变。若任务是批量离线处理,再把 Batch 半价算进去。

4. 高难度任务,在 Kimi K3 和 GPT-5.6 Sol 之间权衡

Artificial Analysis 给 Kimi K3 的指数分数是 57,略高于 GPT-5.6 Sol high 的 56;Kimi 的混合成本约为 GPT-5.6 Sol 的 53%,但速度更慢。代码代理、复杂研究和长文档任务可以先做小样本 A/B,别只因为榜单第一就全量迁移。

订阅档补充

如果你买的是聊天产品而不是 API,OpenAI 当前公开 Business 页面显示年付为 $20 / 人 / 月,月付为 $25 / 人 / 月;Anthropic Pro 为年付折算 $17 / 月、月付 $20,Claude Team 标准席位为年付 $20 / 月、月付 $25。它们都包含使用量限制或合理使用条款,不能拿席位价格直接换算成无限 Token。1011
这周真正需要设提醒的日期只有两个:7 月 24 日检查 DeepSeek 旧名称的迁移结果,8 月 31 日前重新评估 Sonnet 5 的限时价是否还值得锁定。

Contenido relacionado

  • Inicia sesión para comentar.