
AI 模型定价周报:DeepSeek 迁移倒计时,Sonnet 5 与千问优惠进行时
截至 7 月 21 日,DeepSeek 旧模型即将停用,Claude Sonnet 5 和千问 3.7 系列处于限时优惠期,本文用统一评测口径比较价格与能力。
先看结论
数据截止:2026 年 7 月 21 日 12:00(北京时间)。这期最值得记住的不是「谁的单价最低」,而是三件会直接影响预算和迁移的事:
- DeepSeek 文档写明,
deepseek-chat和deepseek-reasoner将在北京时间 7 月 24 日 23:59 停用,对应迁移到deepseek-v4-flash的非思考和思考模式。已经写死旧模型名的调用,今天就该排查。1 - Claude Sonnet 5 目前是限时价,输入 / 输出为 $2 / $10 每百万 Token,8 月 31 日后恢复到 $3 / $15。Batch 处理再打五折,适合能延迟返回的离线任务。2
- 千问 3.7 Max 中国内地价格页标出原价 5 折,千问 3.7 Plus 标出原价 8 折;两者都支持中国内地新用户 100 万 Token 免费额度,额度有效期为 90 天。3
本周价格雷达
下面的价格都是每百万 Token。输入和输出必须分开看,因为多数模型的输出价远高于输入价;表中「Batch」只适用于异步批处理,不能拿来估算实时对话。
| 模型 / 服务 | 标准输入价 | 标准输出价 | 本周可用的折扣或变化 |
|---|---|---|---|
| Claude Sonnet 5 | $2 | $10 | 8 月 31 日前限时价;Batch 为 $1 / $5,之后标准价为 $3 / $15。2 |
| Gemini 3.1 Flash-Lite | $0.25 | $1.50 | Batch / Flex 为 $0.125 / $0.75;免费层有输入输出额度,但有模型和速率限制。4 |
| 千问 3.7 Plus,中国内地 | 非思考输入 ¥2;思考输入 ¥8 | 思考输出 ¥8 | 当前页面标注限时 8 折;Batch 输入和输出均按实时推理价 50% 计费。3 |
| 千问 3.7 Max,中国内地 | ¥12,当前限时 ¥6 | ¥36,当前限时 ¥18 | 页面标注限时 5 折;Batch 也按实时推理价 50% 计费。3 |
| ERNIE 4.5 Turbo | ¥0.8 | ¥3.2 | 百度千帆当前公开页所列价格。5 |
| ERNIE X1.1 Preview | ¥1 | ¥4 | 百度千帆当前公开页所列价格。5 |
| ERNIE 5.0 | ¥6–10 | ¥24–40 | 价格随页面列出的规格区间变化;这期不把区间中位数当作实际报价。5 |
阿里云价格页还写明,部分模型支持上下文缓存,命中输入 Token 的计费单价与标准输入不同;免费额度只适用于中国内地部署范围,并从开通百炼、模型发布或申请通过中较晚的时间起算 90 天。做预算时,先确认部署地域和是否使用思考模式,别把「每百万 Token」看成一个固定数字。3
同一把尺子的性价比
为了避免把厂商自报分数混在一起,下面只采用 Artificial Analysis Intelligence Index v4.1。它由 9 项评测组成,覆盖真实工作任务、工具调用、终端编程、科学推理、知识可靠性和长上下文推理等方向。价格列是该平台按 7:2:1 的「缓存命中 / 普通输入 / 输出」比例算出的每百万 Token 混合成本,不等于供应商价目表中的单一输入价或输出价。6
| 模型 | Intelligence Index | 混合成本(美元 / 百万 Token) | 速度或限制 | 粗算每指数点成本 |
|---|---|---|---|---|
| Kimi K3 | 57 | $2.31 | 42 tokens/s;1M 上下文;输出偏长。7 | $0.041 |
| GPT-5.6 Sol(high) | 56 | $4.35 | 59 tokens/s;1M 上下文;支持图片输入。8 | $0.078 |
| DeepSeek V4 Pro(Reasoning, Max Effort) | 44 | $0.18 | 72 tokens/s;1M 上下文;不支持图片输入。8 | $0.004 |
| Qwen3.7 Plus | 39 | $0.27 | 53 tokens/s;1M 上下文;支持图片输入。9 | $0.007 |
| Gemini 3.1 Flash-Lite | 25 | $0.22 | 333 tokens/s;1M 上下文;支持图片输入。9 | $0.009 |
「每指数点成本」只是把两列相除的粗筛指标,不能理解成模型能力可以线性购买。它能说明一个现实:DeepSeek V4 Pro 的单位成本很低,Gemini 3.1 Flash-Lite 的吞吐量很高,Kimi K3 的能力分数最高但速度慢、输出多;三者对应的并不是同一个采购决策。
这张表也不能替 ERNIE 4.5 Turbo 和 ERNIE X1.1 Preview 排名,因为本期没有拿到它们在同一套 Intelligence Index v4.1 下的可比数据。价格可以先看,能力结论留到有同口径评测后再下。
怎么选更省
1. 先把旧 DeepSeek 模型名改掉
如果业务仍调用
deepseek-chat 或 deepseek-reasoner,优先做兼容性检查和灰度切换。官方文档说这两个名字只是兼容映射,停用后分别对应 deepseek-v4-flash 的非思考和思考模式。这个动作与价格无关,但比省几分钱更紧急。2. 离线批处理,先看 Sonnet 5 和 Gemini Flash-Lite
报告生成、批量分类、数据清洗这类任务通常能等结果。Sonnet 5 的限时价已经比 9 月标准价低约三分之一,Batch 又是实时价的一半;Gemini 3.1 Flash-Lite 则把输入和输出单价都压得更低,且评测页显示吞吐量明显更高。要更强的推理能力,选 Sonnet 5;要高并发和简单处理,优先试 Flash-Lite。
3. 国内部署先看千问优惠,不要只看模型名
中国内地部署的千问 3.7 Plus 当前是 8 折,千问 3.7 Max 当前是 5 折,且有 90 天新用户额度。两者的输入价还要按思考 / 非思考模式区分,思考模式并不等于「同一个模型换个开关」,预算会明显变。若任务是批量离线处理,再把 Batch 半价算进去。
4. 高难度任务,在 Kimi K3 和 GPT-5.6 Sol 之间权衡
Artificial Analysis 给 Kimi K3 的指数分数是 57,略高于 GPT-5.6 Sol high 的 56;Kimi 的混合成本约为 GPT-5.6 Sol 的 53%,但速度更慢。代码代理、复杂研究和长文档任务可以先做小样本 A/B,别只因为榜单第一就全量迁移。
订阅档补充
如果你买的是聊天产品而不是 API,OpenAI 当前公开 Business 页面显示年付为 $20 / 人 / 月,月付为 $25 / 人 / 月;Anthropic Pro 为年付折算 $17 / 月、月付 $20,Claude Team 标准席位为年付 $20 / 月、月付 $25。它们都包含使用量限制或合理使用条款,不能拿席位价格直接换算成无限 Token。1011
这周真正需要设提醒的日期只有两个:7 月 24 日检查 DeepSeek 旧名称的迁移结果,8 月 31 日前重新评估 Sonnet 5 的限时价是否还值得锁定。
References
- 1Your First API Call:DeepSeek API Docs
- 2Pricing - Claude Platform Docs
- 3阿里云百炼模型价格
- 4Gemini Developer API pricing
- 5千帆大模型平台
- 6Artificial Analysis benchmark methodology
- 7Kimi K3 - Intelligence, Performance & Price Analysis
- 8GPT-5.6 Sol (high) vs DeepSeek V4 Pro
- 9Qwen3.7 Plus vs Gemini 3.1 Flash-Lite
- 10Business Pricing:OpenAI
- 11Pricing:Anthropic
Related content
- Sign in to comment.
