
Gemini 3.8 Live 发布、OpenAI 洽谈 1.2 万亿美元估值、Salesforce 推出 CRM 专用模型:硅谷 AI 过去 24 小时
本期梳理硅谷 AI 过去 24 小时的三条要闻:Google 发布 Gemini 3.8 Live,语音智能体进入可以采购上线的阶段;OpenAI 洽谈逾 1.2 万亿美元估值的新一轮私募融资;Salesforce 用英伟达 Nemotron 自建 CRM 专用推理模型 Koa。
截至北京时间 2026 年 9 月 16 日 09:00,本期覆盖 9 月 15 日 09:00 至 9 月 16 日 09:00 硅谷 AI 领域发生的重要动态。本期纳入三条经过原始信源核验的事实:Google DeepMind 发布两个面向实时语音对话的新模型,把语音智能体推进到可以采购上线的阶段;《金融时报》报道 OpenAI 正在与大型投资人接触,新一轮私募融资的讨论估值约 1.2 万亿美元;Salesforce 在 Dreamforce 上发布 Koa,用英伟达的开放底座自建 CRM 专用推理模型。另有四条进展列在文末。文中凡属公司自述的指标、媒体报道的独家信息与编辑判断,均已分别注明。
先看结论
| 优先级 | 事件 | 已确认变化 | 关键数字 | 接下来观察 |
|---|---|---|---|---|
| 1 | Google 发布 Gemini 3.8 Live 与 3.8 Live Extended Thinking | 两个实时语音对话模型同日上线 Gemini API、Google AI Studio、Search Live,并以私测形式进入 Gemini Enterprise;模型可在对话进行中调起后台工具与 API,并在 97 种语言之间自动切换。1 | Extended Thinking 在 Artificial Analysis 的语音对话质量指数上拿到 82.6 分、位列第一;τ-Voice 智能体任务完成率 68.6%;Sierra 的 τ-Voice-banking 银行场景 35.1%;Big Bench Audio 97.7%。1 | 语音智能体接进客服、销售外呼等真实业务后,工具调用的失败率与每小时音频成本落在什么区间。 |
| 2 | OpenAI 洽谈逾 1.2 万亿美元估值的新一轮融资 | 《金融时报》报道称,OpenAI 已与大型投资人有过接触,讨论的是一轮在上市之前完成的私募融资;接触由投资人发起,谈判仍处早期,估值数字可能在未来几个月变化,OpenAI 拒绝置评。2 | 讨论估值约 1.2 万亿美元,对应今年 3 月那一轮的 8520 亿美元估值;3 月那轮拿到 1220 亿美元承诺资本。2 | 这轮融资是否收到正式条款清单、金额与投资人名单,以及它与 Anthropic 10 月 IPO 路演的先后顺序。 |
| 3 | Salesforce 发布 CRM 专用推理模型 Koa | Salesforce 在 Dreamforce 上发布 Koa,称其为首个面向 Agentforce 的 CRM 推理模型,基于 NVIDIA Nemotron 微调,可在 Data Cloud 模型目录、Agentforce 组织级设置和 Prompt Builder 的 Agent 与 Sub-Agent 层级选用。3 | Salesforce 自述:调用正确动作的准确率比通用模型高 11%,召回客户上下文的可靠性高 2.1 倍,长对话中的上下文记忆高 15%,在自家 CRM Bench 上错误少 3 倍。3 | 企业客户在 Agentforce 里把 Koa 与通用前沿模型混用后的实际准确率差异,以及英伟达 Nemotron 上还会出现多少同类行业模型。 |
Google 把实时语音做成可以采购的智能体底座
当地时间 9 月 15 日,Google DeepMind 发布 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两个模型,并在当天开放调用。1 两个模型的分工很清楚:3.8 Live 面向规模与成本,主打对话流畅度和对画面的实时理解;3.8 Live Extended Thinking 面向高复杂度任务,把多步推理和说话放进同一个过程。1
这次发布把三件事放进了一个模型里。
一是边说话边干活。 两个模型都能在对话继续的同时,在后台执行工具调用与 API 请求。Extended Thinking 还会先给一句口头过渡,比如“让我查一下”,再用实时的进度叙述把多步后台任务讲给用户听,对话不会因此中断。1
二是语言与画面。 3.8 Live 可以接近实时地读取视觉输入,并在对话当中自动在 97 种支持语言之间切换。用在客服或现场服务时,这一点决定了同一套系统能不能直接服务多语种客户。1
三是成绩单。 Extended Thinking 在 Artificial Analysis 的语音对话质量指数(Speech to Speech Quality Index)上拿到 82.6 分,位列第一;智能体任务完成率在 τ-Voice 上是 68.6%。1
推理能力上,Big Bench Audio 的得分是 97.7%,银行场景基准 Sierra τ-Voice-banking 的成绩是 35.1%。3.8 Live 则在 Artificial Analysis 的 Speech Agent Arena 上排在第二位。1 这些分数由 Artificial Analysis、Sierra、ServiceNow 等第三方评测方给出,Google 在发布博客中引用,测试口径由评测方设定。1
上线节奏值得单独看一眼。开发者当天就能在 Gemini API 和 Google AI Studio 里调用这两个模型;企业侧先在 Gemini Enterprise 私测;面向普通用户的入口按功能拆开,Search Live 直接用上 3.8 Live,Gemini 应用里的 Gemini Live 用上 Extended Thinking,Workspace 里则由 Google AI Pro 与 Ultra 订阅者先进 Docs、Gmail、Keep 的 Live 版本。1 所有音频输出都由 SynthID 嵌入不可感知水印。1
为什么值得看: 语音智能体的竞争点已经从“像不像人”转到“能不能在通话不中断的前提下把活干完”。把后台工具执行、实时画面输入和多语种切换放进同一个模型之后,一家公司想上线语音客服,需要自己拼的零件明显变少。采购方评估这类产品时,看的是任务完成率和每小时音频成本,这两个指标都能写进合同。
接下来观察: 一是第三方评测是否会在真实业务流量上重跑 τ-Voice 与银行场景基准,把实验室分数换算成可比的成本。二是 Gemini Enterprise 私测转公开的时间点,以及已接入 Gemini Live API 的 Salesforce、LiveKit、Pipecat 等平台会拿出什么形态的产品。1
OpenAI 洽谈 1.2 万亿美元估值,私募资金顶在 IPO 前面
9 月 15 日,《金融时报》报道 OpenAI 近期与大型投资人讨论了一轮新的融资,这轮融资会把公司估值推到约 1.2 万亿美元,并安排在上市之前完成。2 彭博社与 The Information 同日跟进。45
报道给出了三个限定条件,都值得记住:谈判还处在早期;1.2 万亿美元这个数字在未来几个月里可能变化;这轮接触由投资人主动找上公司。OpenAI 对这则报道拒绝置评。2
把时间线接起来看,这轮讨论的参照点很明确。今年 3 月,OpenAI 完成的那一轮拿到了 1220 亿美元承诺资本,对应估值 8520 亿美元;如果新一轮按 1.2 万亿美元定价,半年多时间里估值将上移约四成。2 另一个参照点是 9 月 12 日,Sam Altman 公开表示公司 2026 年内不会上市,给出的理由是 AI 安全方面的顾虑。2
同一批资金也有别的出口。路透社本月早些时候报道,Anthropic 最早 10 月中启动 IPO 路演,上市时间可能紧挨着 11 月的美国中期选举。2 两家头部实验室在同一时段各自融资与上市,对同一位出资人来说就是两个需要排队的选项。
为什么值得看: 一家已经推迟上市的公司,仍在洽谈一笔把估值推到上市目标之上的私募融资,而且据报由投资人主动发起。这说明公开市场之外,已经有资金愿意按接近公开市场定价的水平,继续买下前沿 AI 公司的股份。对这一赛道的价值判断来说,锚点正在往私募条款上移,公司当期收入与“能否上市”这个事件的关联变弱了。
接下来观察: 一是这轮融资是否走到正式条款清单与交割,以及金额、投资人名单和条款中的特殊安排。二是 OpenAI 在下一轮披露中给出的收入口径,按讨论中的估值计算,估值与收入的倍数关系是这条赛道最容易横向比较的数字。三是 Anthropic 10 月的 IPO 定价,它会给同一条赛道提供一份公开市场的对照价。
Salesforce 用英伟达底座,做出第一个 CRM 专用推理模型
当地时间 9 月 15 日,Salesforce 在 Dreamforce 上发布 Koa,称其为首个面向 Agentforce 的 CRM 推理模型,底座是英伟达的 Nemotron。3 行业媒体 SiliconANGLE 同日报道了这一发布,指出 Koa 面向 CRM 数据做推理,用来驱动 Agentforce 里的智能体。6
对企业买家来说,Koa 的接入方式比模型本身更实用。它可以在三个层级上被选中:在 Data Cloud 的生成式模型目录里作为一个受管模型,在 Agentforce 的设置里按组织整体启用,也可以在 Prompt Builder 中按单个 Agent 和 Sub-Agent 指定。3 这意味着同一家公司的不同业务线可以各挑各的模型,前提是这些模型都收在同一个目录里。
Salesforce 给出的对比数字,口径是“今天的通用智能模型”:调用正确动作的准确率高 11%,召回客户上下文的可靠性是 2.1 倍,长对话中记住上下文的能力高 15%,在自家 CRM Bench 上错误少 3 倍。这些是公司自述的测试结果。3 CRM Bench 由 Salesforce 自己维护,评测集包含更新商机、转派工单、安排跟进等真实任务。3
数据口径上,Salesforce 表示 Koa 的训练语料全部由合成场景构成,模型只读取客户主动授权提供的数据。3 页面上的客户评价来自 UChicago Medicine、Baxter Credit Union、Engine 和 1-800Accountant。3
为什么值得看: 通用前沿模型处理 CRM 这类业务时,常见的失败是动作选错和上下文丢失,这两项恰好是专用化最能改善的地方。Salesforce 把这件事放在英伟达的开源底座上完成,说明一个行业的头部软件厂商已经能靠自己微调出比通用模型更稳的领域模型。对正在选型的企业来说,这提供了一个新的采购逻辑:把通用模型留给开放性问题,把业务主链路交给在自家数据协议内训练的专用模型。
接下来观察: 一是 Koa 上线后企业客户在同一套 Agentforce 流程里的准确率对比数据,包括在 Salesforce 之外还有谁愿意公布。二是英伟达 Nemotron 上会陆续长出多少个同类行业模型,这会决定“开源底座加行业微调”成为主流路线的速度。三是 CRM Bench 这类厂商自建评测集会不会被第三方复现。
其他已核验进展
- Factory 融资 2 亿美元,估值三倍增至 50 亿美元。 这家公司为工程团队提供编写、测试与维护软件的智能体,2023 年由 Matan Grinberg 和 Eno Reyes 创立,总部在旧金山,今年 4 月刚以 15 亿美元估值融过 1.5 亿美元;本轮投资方包括 Blackstone、Khosla Ventures、Sequoia Capital、Insight Partners、Evantic Capital 和 Sound Ventures。作为对照,同赛道的 Cognition 本月早些时候以 480 亿美元估值融了 20 亿美元。7
- Profound 融资 1.8 亿美元,估值 18 亿美元。 这轮 D 轮由 Sequoia Capital 与 Kleiner Perkins 联合领投,Lightspeed Venture Partners、Khosla Ventures、Saga Ventures 等老股东跟投,距离它 9600 万美元的 C 轮不到 7 个月。这家 2024 年成立、总部在纽约的公司做的是让品牌出现在 AI 搜索回答里的工具,公司称目前服务 1000 多个企业品牌,累计融资超过 3.35 亿美元。89
- Altera 秘密递交美国 IPO 申请。 这家总部在加州圣何塞的芯片公司由 Silver Lake 与英特尔共同持有,本周二递交了申请文件;先前报道称这次上市可能募集超过 20 亿美元。10
- OpenAI 与 Anthropic、Google DeepMind 就安全议题磋商数周。 据彭博社报道,OpenAI 全球政策负责人 Chris Lehane 在华盛顿的一场说明会上表示,三家公司已就 AI 安全接触了数周,他判断三家企业协调安全工作无需反垄断豁免,OpenAI 也会支持旨在降低灾难性风险的两党立法。11 同一天,路透社报道 OpenAI 公开支持国会四项针对生物武器与合成病毒风险的两党法案,并支持 FRONTIER Act 中要求头部 AI 公司引入独立评估员的条款。12
编辑判断:三层各自往前走,三份数字的口径需要分开看
本期三件事分别落在 AI 产业的模型、资本、采购三层,各自的走向都能回到具体事实。
模型层的变化体现在上线方式上。Gemini 3.8 Live 把实时画面、后台工具执行和多语种切换合进一个模型,同一天开出了开发者、企业和普通用户三条通道。1 语音交互此前主要停留在演示和助手形态,这次的发布把评估口径换成了任务完成率、错误动作和每小时音频成本,这些都是采购部门能写进合同的指标。
资本层的变化体现在资金从哪里来。OpenAI 在公开推迟上市之后,仍在洽谈一轮把估值推到约 1.2 万亿美元的私募融资,而且据《金融时报》报道由投资人主动发起。2 同一天,Factory 的估值在五个月内从 15 亿美元升到 50 亿美元,Profound 在七个月内再融一轮。78 这三笔定价都发生在公开市场之外。
采购层的变化体现在买方怎么选型。Salesforce 在英伟达 Nemotron 上微调出 CRM 专用模型,并把它放进客户已经习惯挑选模型的目录里。3 企业买方开始按业务环节分配模型:开放性问题交给通用前沿模型,主业务链路交给专用模型,而专用模型由软件厂商自己训练。
把三件事并排看,一个共同点值得读者带走:它们都在用具体数字支撑结论,而这些数字的发布方各不相同。Google 引用的是 Artificial Analysis、Sierra 等第三方基准,Salesforce 用的是自建的 CRM Bench,OpenAI 的 1.2 万亿美元则是投资人参照上一轮 8520 亿美元估值给出的谈判区间。三组数字都可以核对,但可核对的程度不一样,比较之前先看清数字由谁给出,会省下不少误判。
本期留给下一期的问题有三个:Gemini 企业私测转公开的时间、OpenAI 这轮融资是否走到条款清单、Anthropic 10 月 IPO 的定价。
References
- 1
- 2
- 3Salesforce 官方页面:Salesforce Koa, built on Nvidia Nemotron
salesforce.com
- 4
- 5
- 6
- 7
- 8Profound 官方公告:Profound Raises $180M Series D at $1.8B Valuation
globenewswire.com
- 9
- 10
- 11
- 12
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
Related content
More from this channel›
- 特朗普宣布组建 AI 部队并任命 AI 沙皇、四家头部实验室被付费订阅用户提起反垄断诉讼、Google 称 Gemini 越界不算失准:硅谷 AI 过去 24 小时
- 三人用 Claude 攻进 OpenAI 内部代码库、Anthropic 拟 11 月上市、OpenAI 五年负现金流 2780 亿美元:硅谷 AI 过去 24 小时
- Claude 领做 Anthropic 26% 的研发、OpenAI 发布法律版 Astra、Crusoe 融资 39 亿美元:硅谷 AI 过去 24 小时
- OpenAI 开测赞助智能体并公布失准披露框架、220 亿美元芯片贷款、Cohere 合并 Aleph Alpha:硅谷 AI 过去 24 小时
- Grok Bot 启动三日造司实战、YC 涌现全光网络与硬编码芯片:硅谷 AI 过去 24 小时
- Anthropic 倡议放缓前沿、OpenAI 延期 IPO、Enigmata 走出隐身:硅谷 AI 过去 24 小时
- OpenAI 披露存储架构、Anthropic IPO 拟引入英伟达:硅谷 AI 过去 24 小时
- OpenAI 发布金融版 ChatGPT、Positron AI 融资 8.75 亿美元、Baseten 收购 Blaxel:硅谷 AI 过去 24 小时
