AI开始抢整条链了!Gemini冲上9.5亿,AMD硬刚英伟达

AI开始抢整条链了!Gemini冲上9.5亿,AMD硬刚英伟达

7月23日,Gemini月活逼近10亿,ChatGPT Health向美国成年用户开放,Claude语音接上外部应用,Runway和AMD则分别把模型路由与大规模推理基础设施做成产品,AI竞争正从单个模型转向完整使用链条。

AI 开始抢整条链了

7 月 23 日,AI 行业的消息很有意思:Google 把 Gemini 推到 9.5 亿月活,OpenAI 开始把 ChatGPT 接进医疗数据,Anthropic 让 Claude 的语音模式接上 Gmail、Slack 和 Canva,Runway 则干脆替开发者挑模型。另一边,AMD 拿出 72 块 GPU 组成的 Helios 机架,推理芯片创业公司 Etched 把估值推到 103 亿美元。
这几件事放在一起看,竞争已经不只是「谁的模型更强」。入口、数据、模型调度和机房,正在被一家公司一家公司地接起来。
事件7 月 23 日的新进展读者该记住什么
GeminiGoogle 披露月活超过 9.5 亿,较 2 月的 7.5 亿继续增长 1AI 助手开始比拼真实用户规模
ChatGPT Health向美国 18 岁以上用户分批开放,覆盖免费版到 Pro,可接入健康与医疗记录 2聊天入口正在碰触高敏感数据
Claude 语音Voice mode 扩展到 Opus 和 Sonnet,并尝试调用 Gmail、Slack、Canva 3语音开始成为执行任务的入口
Runway Media Router按成本、速度和质量,在 Runway、阿里、字节、Google 等模型之间自动路由 4模型太多后,选择模型本身也要产品化
AMD Helios72 块 MI455X GPU 组成一个扩展域,AMD 称系统已进入生产;Reuters 称预计三季度末出货 5 6芯片竞争开始变成整机和网络竞争
Etched 融资完成 3 亿美元 C 轮,估值 103 亿美元;公司称已拿下 10 亿美元订单 7推理专用硬件仍在吸引大额资本

Gemini 冲上 9.5 亿,AI 助手进入大用户盘

Google 在第二季度财报电话会上披露,Gemini 月活用户已经超过 9.5 亿。2 月时,这一数字还是 7.5 亿;TechCrunch 转述 Google 口径称,过去一年用户数增长了三倍。与此同时,ChatGPT 在 6 月达到 10 亿月活,Gemini 在 AI 助手市场的份额升至 27.7%。1
这个数字不等于每个人每天都在用 Gemini,也不等于模型能力已经超过 ChatGPT。它更像一张入口成绩单:Daily Brief、个性化 Agent Gemini Spark,以及 Nano Banana 带来的图像生成,都在把用户留在 Google 的产品体系里。接下来要看的不是谁先喊出更大的模型,而是谁能把搜索、手机和助手的使用习惯连成一件事。

ChatGPT 开始管健康,谨慎也写在条款里

OpenAI 正在向美国 18 岁以上用户分批开放 ChatGPT Health,免费版、Go、Plus 和 Pro 都覆盖,首批落在网页和 iOS。用户可以接入 Apple Health、MyFitnessPal,也可以连接 Epic、Oracle Health 等医院记录服务。OpenAI 称,健康相关提问量已经从每周 2.3 亿次增至 3 亿次。2
这次更新的关键不是多了一个「健康」标签,而是数据开始进入普通对话。用户可以拿着过敏信息问食物,也可以在一般聊天里调用已连接的健康资料。OpenAI 表示不会用这些数据训练模型,但条款同时写明,ChatGPT Health 不用于诊断或治疗。功能往医疗场景靠近,责任边界却没有消失,反而更需要被用户看见。

Claude 会说话了,也开始碰外部应用

Anthropic 把语音模式从 Haiku 扩展到更强的 Opus 和 Sonnet。用户可以在文字与语音之间切换,还能在对话中切换模型;语音模式也在向 Gmail、Slack 和 Canva 等应用延伸。Anthropic 列出的语言包括法语、德语、西班牙语、印地语、印尼语、意大利语、日语、韩语和葡萄牙语。3
The Verge 展示的界面里,Claude 会先弹出外部连接器授权请求,用户可以选择「允许一次」或「始终允许」。这比单纯把聊天框换成麦克风更重要:语音只是入口,真正的产品变化是模型能不能带着权限去查邮件、改日程、整理材料。声音更自然,授权也更容易被一口答应,风险同样会跟着变得更隐蔽。
Claude语音模式、语言设置和外部连接器授权界面
Claude 的语音模式支持模型切换,并在调用外部应用前请求授权。3

Runway 不再只卖模型,开始替你选模型

Runway 通过开发者平台推出 Media Router,自动为图像、视频和音频请求选择模型。开发者可以设置更看重成本、质量还是延迟,系统会在 Runway 自有模型,以及阿里、字节、Google 提供的模型之间做选择。界面还允许设置每次生成最高 300 credits 的价格上限。4
这是一个很实用的信号:当模型数量超过开发者能逐个测试的范围,模型排行榜就不够用了。真正值钱的能力变成了判断一条请求该交给谁,什么时候为了速度牺牲画质,什么时候为了合规避开某个供应商。Runway 从视频模型公司向生成式媒体基础设施靠近,路由器就是它的新控制面板。
Runway Dev的模型路由配置界面
Runway 的界面展示了成本、延迟、质量偏好,以及不同模型供应商的筛选。4

AMD 把模型竞争搬进机架

AMD 发布 Helios rack-scale AI infrastructure solution,把 72 块 Instinct MI455X GPU 放进同一个扩展域,配合第六代 EPYC Venice CPU、Pensando 网络和 ROCm 软件。AMD 给出的规格包括 40 PF FP4 算力、432GB HBM4 容量和 260TB/s 扩展带宽;这是厂商口径,不能直接当成跨平台独立评测。5
AMD 称 Helios 已经进入生产,Reuters 则报道,Lisa Su 表示系统将在第三季度末开始出货,OpenAI 计划在今年晚些时候开始使用。两种说法并不冲突,前者说的是制造状态,后者说的是客户交付时间。AMD 要对抗的也不再是一张 GPU,而是 NVIDIA Vera Rubin 那样的整机、互联、散热和软件组合。6
AMD Helios机架级AI基础设施架构图
AMD 官方图展示了 Helios 的 CPU、GPU、网络和关键带宽规格。5
同一天,推理芯片公司 Etched 完成 3 亿美元 C 轮,估值达到 103 亿美元,领投方是 Sequoia,SK Hynix、Jane Street 等参与。公司称,自研芯片已经成功制造,首批完整系统正由客户测试,并已拿下 10 亿美元订单。这里的「订单」和「系统测试」都是公司披露,尚不是大规模商业部署的证明。7
Etched联合创始人兼COO Robert Wachen肖像
Etched 目前把重点放在推理系统、内存和互联设计上。7
7 月 23 日的共同主题已经很清楚:Gemini 抢的是用户规模,ChatGPT Health 抢的是高价值数据,Claude 和 Runway 抢的是调用入口,AMD 与 Etched 抢的是模型背后的推理成本。AI 公司正在从「做出一个模型」变成「把模型放进一整条可用链路」。这条链能不能稳定赚钱,还要看用户是否真的留下来,以及每一次调用的成本能不能算过来。

관련 콘텐츠

  • 로그인하면 댓글을 작성할 수 있습니다.
More from this channel