AI听:开放模型、可替换的脑子,和今天的 AI 入口争夺Chapters1×0:00开场:今天的竞争,争的是选择权0:50第一章:Kimi K3,把开放权重推到前沿1:37第二章:开放模型背后,不只是理想2:27第三章:算力在投未来,企业却要保住自己的脑子3:28第四章:办公 Agent 开始争夺任务入口4:32第五章:搜索从功能,变成 Agent 的信息底座5:30第六章:模型研究开始更认真地问,怎样才算完成任务6:25第七章:融资在为两类能力投票7:17收束:今晚留意三件事0:007:560:00主播晚上好,这里是 AI 听。今天是 2026 年 7 月 28 日,今天的主线不是又多了几个模型,而是模型、算力和工作入口之间的关系正在重新排位。0:13主播一边,月之暗面的 Kimi K3 把接近三万亿参数级别的模型权重和训练基础设施公开出来;另一边,英伟达围绕开放模型发起联盟,Anthropic 没有加入。腾讯的 WorkBuddy 和阿里的千问办公,也在把模型往文件、浏览器和企业流程里推进。0:37主播今天最值得追踪的问题是:未来的 AI,到底由谁控制?是模型供应商,还是掌握数据和工作方法的企业,或者是能调度多个模型的应用入口?0:50主播先看 Kimi K3。数字生命卡兹克提到,Kimi K3 在 7 月 27 日开放了模型权重、技术报告,以及 MoonEP、FlashKDA 和 AgentEnv 等基础设施。文章给出的规格是总参数约二点八万亿,支持原生视觉和一百万个 token 上下文。1:10主播这里要区分:开放权重不等于训练数据和全部训练代码公开,能下载也不等于普通团队承担得起运行成本。但量子位提到它在部分第三方评测中进入前列,说明开放模型已经到了必须认真比较的区间。1:28主播对开发者来说,变化不只是多了一个模型,而是多了一套可以检查、改造和二次部署的前沿起点。1:37主播Kimi K3 的开放,撞上了英伟达推动开放权重的动作。MacTalk转述,黄仁勋主张前沿闭源和前沿开放并存;新智元报道,公开信支持者已扩展到一百三十多家,但 Anthropic 仍未签署。1:54主播新智元还提到,英伟达发起的开放安全 AI 联盟,试图把权重、身份、权限、安全扫描和审计工具放进更开放的技术栈。对防守方来说,本地开放模型有利于在自己的环境里分析攻击日志;对英伟达来说,开放模型也会扩大企业自建推理和算力的需求。2:17主播所以开发者要看可检查和可替换,企业要看许可证、数据来源、运行成本和责任边界,而不是只看参数规模。2:27主播机器之心报道,Ilya Sutskever 创办的 SSI 和英伟达达成长期合作,英伟达将投资并提供 Vera Rubin 计算平台,帮助 SSI 在未来一年把算力扩大到当前的十倍。2:41主播投资金额没有官方确认。机器之心引用媒体报道,给出的口径是数十亿美元,彭博社称约五十亿美元,所以这里只能说是被报道的交易规模。SSI 不以消费产品和短期收入为先,仍在为长期安全研究争取算力。3:00主播企业端则要防止另一种集中。量子位转述纳德拉的警告:如果数据、记忆和工作方法全绑定在一个模型供应商里,公司失去的可能不只是迁移自由。更稳妥的做法,是把模型、上下文、记忆和 Harness 拆开,让模型可以替换,公司的工作方法留在自己手里。3:24主播模型可以租,选择权不能全部外包。3:28主播模型选择权落到产品里,就变成办公 Agent 的入口之争。Z Finance援引第三方统计称,WorkBuddy 上线几个月后月活约两千万,日活超过一千三百万,日活月活比率在百分之六十五到百分之七十五之间。这不是腾讯披露的财务口径,活跃数字也不能替代任务完成率。3:51主播文章提到,WorkBuddy从 CodeBuddy 长出来,沿用了上下文、工具调用、沙箱、记忆和任务恢复,并尝试按任务切换不同模型。卡尔的 AI 沃茨则称,千问办公把群聊、日程、文档、知识库和企业权限连起来,还能一站式生成网页。后者属于作者实测和产品介绍,不是独立评测。4:18主播办公入口会从「我要打开哪个工具」变成「我要让谁完成这件事」,但企业真正付费的仍是完成率、权限边界、执行记录和失败恢复。4:32主播量子位报道,豆包 App 里的搜索能力已面向企业和开发者开放,每月赠送五百次额度,并能通过 API、MCP 和 Skill 接进更多 Agent。它返回的不只是网页入口,还包括信源、权威分级、发布时间、摘要和原文节选。4:52主播AGENT 橘比较了 Serper 和豆包搜索,认为豆包在中文场景、时间过滤、权威度分级和结构化数据上更有优势,但英文论文检索仍是 Google 体系更强。这个结论来自作者自建脚本和个人实测,不能当成普遍排名。5:11主播它真正提醒我们的是,「会联网」要拆成四个问题:能不能搜到,能不能判断时间,能不能识别来源,能不能把结果交给下一个工具继续执行。对普通用户,这是更可追溯的答案;对企业,则是可管理的信源和日志。5:30主播今天的研究消息也从展示生成效果,转向检查模型是否真的理解任务。机器之心报道,五所高校推出 TriWorldBench,评测机器人头部、左腕和右腕三个视角,要求它们共同描述同一个世界。5:47主播榜单包含五百个三视角同步 episode,覆盖五十个机器人操作任务,汇总十九项评测信号。画面好看不够:如果头部画面显示物体已经放好,腕部画面却还在抓取,视频就不能算真正理解了任务。6:04主播量子位还报道了一篇登上《Cell》主刊的 AI 生命科学研究,目标是预测同一种药物在不同细胞背景下的效果。文章属于研究团队和媒体介绍,不能直接等同于临床可用,但它指向同一个标准:预测要接到可验证、可解释、能继续实验的工作链上。6:25主播商业侧,36 氪报道一支人形机器人基础模型公司拿下接近五亿元人民币融资;真格基金则宣布,AI4S 公司英灵殿科技在三个月内连续完成多轮融资,累计接近五千万美元。6:42主播这两笔交易不能简单理解成资本相信机器人和科学会马上赚钱,更像是在为两类长期能力下注:让模型在物理世界稳定行动,以及让模型进入实验、分子和生命科学这些高成本验证场景。金额和性能仍要等待后续披露与独立验证。7:05主播模型、搜索、办公和机器人看似四条赛道,共同的验收标准却越来越接近:数据是不是自己的,模型能不能替换,任务有没有完成,结果能不能复查。7:17主播最后用三句话收束今天。第一,开放权重正在把前沿模型的起点往外推,但开放不是自动安全,许可证、算力和审计要单独检查。7:28主播第二,企业接入 AI 时,最应该自己保留的是数据、记忆、评测、工具调用和失败记录。第三,产品竞争会从模型分数转向搜索、文件、权限、工具和结果能不能串起来。7:45主播普通用户会更关心事情有没有做完,企业会更关心出了问题谁能解释、谁能负责。这就是今天 AI 听的全部内容,晚安。