7月8日 AI 创业早间对谈:Meta 媒体 Agent、Claude 续杯和 Agent 训练场章节1×0:08开场:昨晚到今早,几个信号都在往「可交付」靠1:07第一段:Meta 的 Muse,把图片生成改成「先想再画」3:04第二段:Claude Fable 5 续杯,说明高端模型还在算订阅账4:59第三段:Agent 真正缺的,可能是训练场6:41第四段:中国侧:AI 制药拿钱,物理 AI 登陆港股8:06第五段:应用入口也在变,Agent 要随身、要有身份9:53第六段:给创业者的三张检查单11:14收尾:今天早上的共同线索0:0012:080:08主播早上好,今天是七月八号早报。昨晚十点到今早九点,AI 圈最明显的变化不是又多了几个漂亮 demo,而是四条线都在往同一个方向挤:媒体生成要变成 Agent,Claude 的高端模型要重新算账,训练 Agent 的环境开始拿钱,AI 制药和物理 AI 也在往资本市场走。0:28联合主播先把覆盖范围说清楚。X 关注源这次实际读取了三百九十三个关注账号、五千九百九十三条推文;窗口内三百六十条,相关命中二百一十一条,失败账号是零。不过单个账号最多读取一百条,所以超级高频账号仍然有上限。公众号里,量子位和三十六氪今早有新文;Founder Park 昨晚那篇日本市场,夜间期已经讲过,这期不换个说法重讲。0:55主播对,DeepSeek 自研推理芯片昨晚也已经作为主线讲过,今早量子位又发了一篇,我们只把它放进背景,不占新主题。今天真正的新东西,先从 Meta 开始。1:07联合主播Meta AI 官方博客发布了 Muse Image,同时预告 Muse Video。官方说,这是 Meta Superintelligence Labs 做出来的第一批媒体生成模型。量子位今早也跟进了这件事,标题里直接写到 MSL 连发图像和视频模型。1:23主播Muse Image 最有意思的地方,不是「又一个画图模型」。Meta 自己的说法是,它不像传统 prompt 到图片的直连模型,而是按 Agent 的方式工作:可以调用搜索工具找现实参考,可以写代码生成图表和二维码,还会对自己的图片做反思和局部修正。你可以把它想成一个会查资料、会打草稿、会返工的视觉助手。1:45联合主播这对创业者很直接。以前做营销图、产品图,模型要么好看但不准,要么准了又很死板。Muse Image 把搜索、代码和多参考图组合放到同一个流程里,目标就是让图片更接近可交付素材。官方还说,它已经可以在 Meta AI 应用和 meta.ai 里用,美国的 Instagram Stories 也能用。2:07主播Muse Video 现在只是早期预览。AI at Meta 的官方推文说,它在提示词遵循、画面质感和时间一致性上有竞争力,但音画同步和高速运动的物理准确性还在补。这句话反而很有信息量:Meta 没把视频包装成无所不能,而是承认短板还在。2:25联合主播还有一个小细节,Meta 这次强调了 Content Seal,也就是隐形水印。Muse Image 生成的图,裁剪、压缩、截图之后还应该能保留 provenance 信号。等平台广告、创作者内容和 AI 生成图混在一起,水印不再只是合规动作,也是平台自己控制内容供应链的一部分。2:45主播所以这一段我会给一个判断:Meta 不只是补一个图像模型的坑,它在把社交数据、创作者入口、广告素材和 Agent 式生成接到一起。对小团队来说,机会可能在审稿、验真、素材管理和品牌一致性,而不是再做一个图片生成壳。3:04联合主播第二条来自 Claude 官方 X。Claude 说,Fable 5 会继续对所有付费计划开放到七月十二号。这个消息看着像一个用户福利,但 X 上的反应没那么温柔。3:16主播对,关注源里 kimmonismus 的一条吐槽很典型:他认为 Anthropic 等到最后一刻才宣布延期,让很多用户已经把额度用到极限了;如果要补偿,至少应该重置额度。这个点不是小情绪,背后是高端模型的定价问题。用户把 Fable 5 当成生产力工具,平台把它当成有限算力资源,中间的契约还没稳。3:38联合主播同一时间,Artificial Analysis 上线了 Harvey LAB-AA,一个法律 Agent 基准。它用 Harvey 的一百二十个私有法律任务,覆盖二十四个法律实践领域,让模型在沙盒里读材料,产出备忘录、披露清单、证词摘要,再按 rubric 逐条打分。3:56主播结果挺冷静。Artificial Analysis 的页面和推文都写到,Claude Fable 5 在这个基准里领先,但 all-pass rate 只有百分之十四点二,也就是大约七分之一的任务能完全满足要求。第二梯队的 Claude Opus 4.8 和 GLM-5.2 都是百分之七点五。更扎眼的是成本:Fable 5 每个任务大约十九美元,GLM-5.2 大约一美元。4:20联合主播这就把「模型强」和「业务可用」之间的缝露出来了。法律这种高风险场景,过了九成单项标准还不够,少一个关键条款就可能不能交付。对创业公司来说,这说明两个方向都还有空间:一个是把模型接进真实工作流,帮它少漏;另一个是用更便宜的模型做分层,不要什么任务都拿最贵的模型硬打。4:42主播Claude 续杯和 Harvey 基准放在一起看,Fable 5 不是没有价值,恰恰是太有价值,以至于访问、额度、价格和可靠性都变成产品问题。模型公司不能只靠「效果更强」来讲故事,订阅体验和企业可交付标准也要一起交卷。4:59联合主播第三条是融资。Bespoke Labs 官方博客和 Business Wire 都披露,他们完成了四千万美元融资,包括 Wing VC 领投的 A 轮,以及八点二五百万美元种子轮。投资人名单里还有 Mayfield、The House Fund,以及来自 Anthropic、OpenAI、Meta 的 angels。5:17主播Bespoke 讲得很直:今天的 Agent 会写代码、会回答问题、会做短任务,但要像同事一样连续工作几小时、几天,还不可靠。他们押注的不是聊天框,而是给 Agent 建训练环境。这个环境里有代码库、微服务、日志、工单、邮件、Slack,尽量模拟真实公司的长链路任务。5:38联合主播这跟我们刚才讲的 Harvey LAB-AA 是同一个大问题,只是一个在法律任务里测,一个在训练基础设施里做。过去一年,大家很爱说 Agent,但 demo 往往停在「今天帮我订个会议」「改一下代码」。Bespoke 想做的是让 Agent 在像真实公司的沙盒里练习,失败了能被打分,练完还能优化。5:58主播关注源里还有一条来自 Perplexity 的 Aravind Srinivas。他说 Vera CPU 是为 agentic runtime 定制的,Perplexity 正和英伟达一起,把支撑 Perplexity Computer 的 sandbox infrastructure 跑在 Vera CPU 上,而且已经有明显改进。虽然细节还没放出来,但方向很清楚:Agent 的瓶颈不只在大模型,也在运行时、沙盒、CPU、文件系统和安全隔离。6:25联合主播这对创业公司挺残酷。只做「我接一个模型,然后给你一个 Agent」越来越难差异化。真正能收费的,可能是任务环境、行业数据、评估方法、执行安全和后训练工具。听起来不性感,但客户会为少出错付钱。6:41主播再看国内。三十六氪今早报道,德睿智药近期完成五千二百万美元 B 轮融资。报道里的关键信息是,它强调 Clinical Data-in-the-Loop,也就是把临床数据放进循环里;三十六氪还写到,AI 设计的减肥药已经进入三期临床。6:59联合主播AI 制药这几年听起来很热,但很多项目卡在「模型能不能真的改变候选药物质量」和「临床阶段是不是能兑现」。德睿智药这条的创业信号是,AI 不只停在发现阶段,而是在减肥药这样竞争很激烈的赛道,往后段临床去讲故事。对投资人来说,这比单纯讲算法好听很多,因为临床节点是硬门槛。7:22主播同样是三十六氪,今早还有一篇讲易控智驾和 Momenta 同日登陆港交所。它把这件事放在「物理 AI」和智驾投资十年的框架里。我们先不替市场下结论,但这个窗口很值得看:自动驾驶、矿山无人驾驶、机器人,正在从实验室演示和私募融资,转向公开市场定价。7:43联合主播这里有个反差。软件 Agent 还在争论能不能稳定交付,物理世界的 AI 公司反而要面对更老派的问题:车辆、安全、场景、客户、现金流。港股给出的价格,会比发布会更诚实。做具身或者智驾的团队,不妨盯一下这批公司上市后的收入结构,而不是只看「物理 AI 第一股」这种标签。8:06主播在 Claude 这条线上,还有一个容易被 Fable 5 热度盖住的产品更新:Claude Cowork 正在扩到移动端和网页。Claude 官方博客说,用户可以在桌面上把一个任务交给 Claude,之后在手机上检查进度;关掉电脑后,任务仍然可以在后台继续跑,遇到需要人判断的节点,再把问题推到手机上。8:26联合主播这比「手机上也能聊天」大一点。Cowork 的描述是跨文件、日历、邮件、消息、网页和已连接工具持续工作。官方还说,从他们看到的使用方式看,超过九成不是软件开发,而是日常知识工作,尤其是业务运营和内容创作。换句话说,Anthropic 想让 Agent 从程序员工具,挤进办公室里的杂活。8:50主播这个方向也解释了为什么额度和审计会变得敏感。一个后台 Agent 如果会整理合同、准备客户 briefing、写邮件草稿,它消耗的就不只是 token,而是组织里的信任。什么时候能自动做,什么时候必须停下来问人,谁来审批,成本记到哪个团队,这些都会变成企业购买时的关键问题。9:10联合主播X 上还有一条开发者生态的小信号。Vercel 的 Guillermo Rauch 欢迎 Better Auth 的作者加入 Vercel,说要一起推进 Open SDK 愿景,并且 auth 要同时服务 humans and agents。听起来像一句欢迎词,但它点中了一个很实际的问题:当 Agent 替人执行动作,身份、权限、会话和撤销能力都要重新设计。9:33主播所以我会把 Cowork 和 Better Auth 放在同一类观察里:应用入口正在从「人打开一个界面」变成「人委托一个流程」。如果 Agent 没有稳定身份和清楚边界,它就只能停在 demo;如果身份和审批做得好,很多原来碎在邮件、表格和聊天里的工作,才可能被真正搬走。9:53联合主播把这些新闻落到执行层,今天其实有三张检查单。第一张给做内容和营销工具的团队:如果你的产品只会生成一张好看的图,危险了。客户真正要的是能不能按品牌规范找参考、写版本、改局部、留证据、批量出素材。Meta Muse 把这些动作放进官方模型,第三方就要往工作流更深处走。10:16主播第二张给做企业 Agent 的团队:别急着说「全自动」。Claude Cowork 的产品语言很谨慎,工作可以在后台跑,但关键决定仍然回到人。Harvey LAB-AA 的结果也说明,专业交付不是八九成就能过关。你要能告诉客户,哪些步骤自动,哪些步骤人工确认,错了之后怎么追责和回滚。10:39联合主播第三张给做基础设施和开发者工具的团队:Agent 时代的基础设施不只是模型调用。Bespoke 讲训练环境,Perplexity 讲运行时硬件,Vercel 讲 humans and agents 的 auth。也就是说,沙盒、权限、身份、日志、成本归因,都会变成新卖点。10:59主播如果把这三张表压成一句话:今年下半年,AI 创业的竞争点会从「我能不能把结果做出来」,转到「我能不能把结果交付、解释、审计、重跑」。这听起来像企业软件老问题,但现在每个 Agent 公司都要重新做一遍。11:14主播今天早上的共同线索很清楚:AI 从「能生成」往「能交付」走。Meta 把图片和视频生成做成会查资料、会返工的 Agent;Claude 的高端模型要同时面对用户额度和法律任务的硬评分;Bespoke 把钱投到 Agent 训练环境;国内则把 AI 制药和物理 AI 推向临床节点和公开市场。11:34联合主播如果你是创业者,今天可以问自己一个很具体的问题:你的产品是在展示一次聪明的输出,还是在帮客户稳定完成一个可以验收的任务?前者越来越便宜,后者才开始变贵。11:48主播好,早报就到这里。晚上十点我们再看今天白天有没有新的产品发布、融资和 X 关注源增量。祝你今天少开点会,多交付一点真东西。