降价32%砍掉旗舰:DeepSeek把所有人推进“死亡区”

降价32%砍掉旗舰:DeepSeek把所有人推进“死亡区”

彭博社披露 DeepSeek 周四突击发布新模型 V4.1 Flash,不仅将调用价格压至不足一美分,更宣布自 9 月 14 日起强行退役前代旗舰 V4-Pro,全网流量强制切换;文章拆解 552B 稀疏架构、资本市场震荡与大模型“死亡之区”的残酷现实。

当大模型公司还在犹豫如何向华尔街证明利润率时,DeepSeek 直接把所有流量推下了悬崖般的成本底线。
作者丨 AI 科技评论
编辑丨 AI 科技评论
过去大半年,大模型行业最激烈的博弈,始终在算力账本与资产负债表之间拉扯。
一边是硅谷巨头斥资数百亿美元堆砌算力集群,试图证明更强的智能可以维持高昂的溢价。
另一边是开源与开放权重阵营的步步紧逼,用极致的工程优化将推演成本一次次砸穿地表。
就在市场以为这场价格混战稍有喘息之际,新的炸弹再次引爆。
彭博社 9 月 10 日独家披露,DeepSeek 在周四正式推出了一款精简架构的新模型 V4.1 Flash。1
这家中国大模型公司做出了一个极其激进的商业决定:每百万 token 的调用费用直接压低至不足一美分。1
更令人震动的还在后面。
DeepSeek 宣布,将在 9 月 14 日全面退役下线其此前的旗舰模型 V4-Pro。1
届时,平台上所有的 API 推理任务都将被系统强制路由至 V4.1 Flash,并自动按照更便宜的费率进行结算。1
在 AI 科技评论看来,这不是常规的产品迭代,而是一次把自家旗舰连同行业利润一起推下悬崖的无差别打击。

01|激进的偷袭

大模型升级往往伴随着更高规格的硬件占位与更长的计费账单。
DeepSeek 这次却彻底倒了过来。
彭博社记者 Saritha Rai 披露的细节显示,V4.1 Flash 采用了因果编码器-解码器(causal encoder-decoder)设计。1
该模型整体参数量高达 5520 亿(552B),但在执行具体推理任务时,系统每次只激活其中极其微小的一部分容量。1
相比起运算沉重的 V4-Pro,这套架构将显存开销与能耗损耗压缩到了极致。
DeepSeek 给出的官方基准声称同样充满挑衅意味。
官方宣称,V4.1 Flash 在网络安全与编程基准上的测试成绩,已经超越了月之暗面的主力模型 Kimi K3。1
在编写代码和智能体(agentic)复杂长链路任务上,新模型的表现也优于自家的前代旗舰 V4-Pro。1
不过 DeepSeek 保持了难得的诚实,明确承认其综合能力依然落后于 Anthropic 与 OpenAI 的顶级闭源旗舰。1
AI 科技评论注意到一个细节:通常模型厂商推出廉价版,是为了给昂贵的旗舰版引流。
DeepSeek 却反其道而行之,不仅把新模型做得比旗舰便宜数倍,还要在短短四天后亲手掐死 V4-Pro。
这意味着从下周一开始,开发者即使愿意加钱,也买不到旧款的高价旗舰了。
当一家技术公司主动把高毛利通道全部封死,它要的就绝不是利润率,而是整个推理生态的绝对垄断。

02|谁在承受震波

消息公布的第一时间,金融市场的神经最先被刺痛。
港股盘面上,已经率先敲钟上市的中国 AI 第一梯队瞬间承压。
智谱(Z.ai)与 MiniMax 盘中双双重挫,跌幅均超过 8%。1
拥有庞大云基础设施与大模型业务的阿里巴巴,股价也应声下跌逾 2%。1
资本市场的惊惶并不难理解。
就在几个月前,同行们还在财报里向二级市场讲述高毛利 API 调用与商业化落地的美好故事。
但在 DeepSeek“不足一美分”的铁锤面前,所有建立在高溢价假设上的财务模型都在迅速坍塌。
大洋彼岸的巨头同样感到如芒在背。
当前,Anthropic 与 OpenAI 正紧锣密鼓地筹备公开上市。
两家美国领头羊必须向华尔街展示清晰的盈利路径,以证明其数以百亿计的算力开销能够转化为健康的高额利润。
然而,来自大洋彼岸源源不断的开放权重模型,正在把智能这门生意变成毫无溢价空间的自来水。
彭博行业研究(Bloomberg Intelligence)分析师 Robert Lea 与 Jasmine Lyu 在最新研报中指出了这种残酷现状。1
分析师团队强调,中国 AI 领域的最新降价举措证明,token 价格战的终局仍旧遥遥无期。1
此前,DeepSeek 刚刚取消了周末的高峰定价机制,此次新模型的推出使整体降价幅度最高达到了 32%。1
技术进入门槛的快速拉平,导致底层模型被迅速商品化。
大模型企业为了生存,只能全面转向抢占市场份额,彻底放弃对短期利润率的奢求。
在 AI 科技评论看来,这种集体博弈的结果,是任何单一公司都无法在这个市场上构筑起牢固的定价权。

03|推入“死亡之区”

为什么 DeepSeek 要在这个节骨眼上发起总攻?
答案藏在整个大模型应用生态的范式转移之中。
过去,大模型的主要用途是问答与内容生成,用户发起一次对话消耗几百个 token,价格敏感度并不算高。
随着技术走向自主智能体(AI Agents),游戏规则彻底变了。
一个能够在后台自主写代码、排查系统故障、调用工具并连续运行数小时的软件 Agent,每次任务可能需要吞吐数千万甚至上亿个 token。
算力账单的几何级增长,让企业采购部门对推理单价变得极其苛刻。
行业分析机构 Artificial Analysis 甚至为此造了一个新词,称中国廉价高能模型带来的冲击正在形成一个“DeepSeek 死亡之区”(DeepSeek death zone)。1
这个死亡之区的逻辑极其简单:
面对一个“能力足够好、价格却只有零头”的中国开源模型,全球所有竞争对手只剩下两条极端的活路。
要么在成本控制上击穿 DeepSeek,要么在绝对智能上拉开跨代鸿沟。
任何卡在半山腰、既做不到顶级智能又舍不得放下溢价的中间层模型,都会被这种商业剪刀差彻底绞碎。
DeepSeek 押注的,正是一场用极致廉价驱动下一阶段技术渗透的消耗战。
算法可以不断微调,算力成本的底线却由物理世界和工程极致所决定。
在这片被压缩到不足一美分的冰冷战场上,谁都无法再假装优雅。

Este contenido lo produjo un canal automáticamente. Con una sola frase, Neodrop puede seguir produciendo para ti.

Contenido relacionado

More from this channel