7月19日 AI 创业早报:工具调用、物理模型与 Agent 工厂チャプター1×0:07扫描口径与今日头条2:58独立开发者的功能清单6:38Kimi、推理速度与价格讨论8:15收尾与来源0:009:120:07稳定男主播早上好,今天是七月十九日的 AI 创业早报。我们覆盖的时间是北京时间昨晚十点到今天早上九点,先把扫描口径报清楚:X 关注列表本轮读取四百个账号,分八批完成,全部成功;一共读取六千一百零一条推文,窗口内命中二百零五条,关键词初筛一百零三条,最后引用十三条。接口单个账号最多读取一百条,所以每个账号的窗口素材以这条上限为边界。0:35明快女主播今天的十三条 X 信息,集中在五个话题:Gemma 四的工具调用更新,LangChain 的开源 Agent 工厂,独立开发者的产品功能,机器人和世界模型的新帖子,还有 Kimi、GPT 五点六和 ChatGPT Work 的使用讨论。机器之心在昨晚发了两篇新文,也放在对应话题里。0:56稳定男主播先从开发者工具开始。Berryxia.AI 的简介是「Building AI tools、AI System Prompt,分享设计和编程」。他发帖说,Google 更新了 Gemma 四,重点处理历史轮次、思考保留、工具输出延续和工具调用一致性,预填充速度提升百分之二十五到百分之七十。1:15明快女主播他还提到,Unsloth 随后更新了 GGUF、MLX 和 NVFP4 量化版本,让这组模型改进可以在本地运行。这里节目只转述帖子的两层信息:Google 更新了 Gemma 四,Unsloth 更新了量化版本。1:31稳定男主播LangChain 的 X 个人简介写的是「推动 Agent 开发生命周期,制作 LangSmith、LangChain OSS 和 LangChain JS」。它先推荐了基于 deepagents 的 GPT Researcher,称这是开始构建深度研究 Agent 的入口。1:48明快女主播几个小时后,LangChain 又发帖说,他们在内部做了一套完整的软件工程 Agent 工厂,并把每一个组件都开源,Brace Sproul 的博客会逐项介绍这些组件、用途和开源方式。两条信息合起来,就是一个深度研究 Agent 入口,加上一套软件工程 Agent 工厂。2:06稳定男主播Grok 的官方账号也发了一条很短的产品信息:付费 SuperGrok 或 X Premium 订阅,可以在 Pi Agent 里使用。帖子没有展开功能清单,节目就只报这一句,不把它扩写成更多能力。2:20明快女主播还有一条来自 AI 工程师宝玉。他的 X 简介是「专注学习和传播 AI、软件工程和工程管理」。他发帖说,Claude 之前把每周限额临时提高百分之五十,这个活动原本要到期,现在又延期一个月;他同时比较了 Opus 四点八和 GPT 五点六的使用耐久度。2:39稳定男主播OpenAI 的 Codex 和 ChatGPT 团队成员 Tibo,简介就是「Codex and ChatGPT at OpenAI」。他在今天早上发帖,准备找五十到一百名 ChatGPT Work 用户提前体验功能,并收集使用方式和需要修复的问题,招募对象这次不是开发者。2:58稳定男主播HiTw93 的 X 账号简介列着 Kaku、Pake、MiaoYan、Waza 和 Kami 等产品。他分享自己使用 Mole 的四个功能:AI 主动提醒 AirPods 电量不足,清理 Rust 项目留下的八十六 GB 构建文件,新增三种屏幕常亮行为,以及在状态页显示 iPhone 电量。3:16明快女主播他还说,这四个功能都来自早期用户反馈,用户提出需求,他再把功能加进产品。另一位开发者 lxfater 的简介写着「用 AI 协助创业,维护三万 Star 项目,写过一千二百万浏览文章」。他发帖说,vibecoding 新手最后一道难关是接支付,并把能不能放心给产品接上支付,称为一个成熟度指标。3:41稳定男主播创业节目主持人 Greg Isenberg 的简介是「每天发布创业点子,主持 Startup Ideas Podcast,负责多家创业产品」。他发帖列了一套批评型 Agent 的用法:写一个专门挑错的 Skill,让一个 Agent 构建、另一个 Agent 反驳;再用明确评分表、证据要求和停止条件,检查结果。4:02明快女主播他的帖子还要求,每条批评都给出作品里的具体例子,项目达不到预设条件时,Agent 要直接建议停止。今天只把这套公开步骤列出来,不延伸成节目自己的方法论。4:14明快女主播接下来是物理 AI。机器之心的 X 简介是「中国领先的 AI 和机器学习媒体与信息提供方」。它转发了一项蚂蚁集团的研究,名字是 LingBot-VA 二点零,定位是面向真实世界控制的视频动作基础模型。4:30稳定男主播这条帖子列了四个设计:用语义动作分词器连接机器人看到的内容和下一步动作;用因果训练减少过去动作被遗忘;用稀疏混合专家骨干提升容量;再用异步推理一边行动一边预测后续步骤。帖子还说,在复杂操作任务的少样本泛化上,它超过了此前的视频动作模型,并附上论文和项目链接。4:54明快女主播机器之心公众号昨晚十点四十八分也发了两篇文章。第一篇来自 WAIC 现场,标题是「极佳视界通用世界模型成 WAIC 焦点:从生成到行动,这才是物理 AGI 的最佳打开方式」。文章列出一粟 YiSu、DriveDreamer、GigaWorld、GigaBrain、GigaWorld-Policy、拾光 S1 和 Maker H01 这组产品。5:18稳定男主播文章写到,GigaWorld 面向具身智能,GigaBrain 面向跨本体、多任务和长时程操作,GigaWorld-Policy 尝试直接输出动作;拾光 S1 在家庭环境演示取餐备餐、收拾餐桌、整理餐具、制作咖啡和整理衣物,Maker H01 演示上下料、搬运和关节组装。5:39明快女主播同一篇文章还写到,展台把世界模型展区、家庭场景展区和智能制造展区放在一起,产品从内容创作、自动驾驶数据与仿真,延伸到家庭服务和工业作业。我们把这些都按文章里的现场产品信息来讲,不补充文章之外的性能数字。5:57稳定男主播机器之心第二篇文章介绍 ECCV 二零二六论文 InfraNet。论文来自北航、中关村学院、传媒大学和 KAUST,主题是 RGB 退化时,怎样把 RGB 作为训练阶段的辅助信息,同时保留红外作为部署主路径。6:16明快女主播文章写到,InfraNet-IR 训练时读取 RGB 和红外图像,推理时删除 RGB 分支和融合模块;QualGate 用一个端到端学习的控制量,减少退化 RGB 特征进入主路径,同时增强红外特征。文章报告,在 LLVIP 的 YOLOv八设置下,完整 QualGate 的 mAP 是百分之六十八点八。6:38稳定男主播再看模型比较。Chubby 的 X 简介是「科技分析师和内容创作者,SuperIntel 主编」。他转述 Bloomberg 的说法,Kimi K 三让硅谷重新讨论中国开源模型和前沿模型的差距,帖子的原话是,差距可能从六到九个月缩短到两到三个月。6:56明快女主播同一个账号还发帖说,GPT 五点六 Sol 如果在 Cerebras 上达到每秒七百五十个 Token,项目完成速度可以快十倍,用户会为此支付溢价。这个句子是他对一个产品组合的判断,节目不把它改写成官方性能结论。7:13稳定男主播Kimi K 三这个话题在前几期已经讲过发布和早期评测,今天只保留这两条窗口内的新帖子:一条转述 Bloomberg 的时间差说法,一条讨论 Cerebras 上的推理速度。此前讲过的发布信息不重复。7:27明快女主播这里还有一条创业圈的长帖。@levelsio 的简介是一组产品和月收入信息,他引用 Carta 数据,列出单创始人在种子轮、中一轮到 E 轮的大致持股中位数,分别约为百分之五十六、百分之三十六、百分之二十三点五、百分之十六点五、百分之十和低于百分之十。7:46稳定男主播他还按一名联合创始人和四名联合创始人的情况,列出了不同轮次的持股比例,并用七千一百万美元的被收购中位数和百分之十五的收购概率,计算创始人可能得到的金额。帖子最后注明,没有把税和清算优先权完整放进计算。8:04明快女主播这部分不是融资新闻,而是创业者对股权稀释和退出结果的公开算表。我们把它放在创业话题里,数字都按原帖的口径说。8:15稳定男主播今天早报就到这里。再重复一次,本期 X 关注源覆盖四百个账号,读取六千一百零一条,窗口命中二百零五条,初筛一百零三条,实际引用十三条;公众号窗口内命中两篇,来自机器之心。没有纳入的帖子,主要是重复前几期事件、个人闲聊,或者缺少窗口内新事实的转发。8:36明快女主播来源按话题列在节目正文里:开发工具有 Berryxia.AI、LangChain、Grok、宝玉和 Tibo;独立开发者有 HiTw93、lxfater 和 Greg Isenberg;物理 AI 有机器之心的 LingBot-VA 二点零帖子,以及机器之心公众号的两篇文章;模型讨论有 Chubby 的两条帖子;创业股权有 @levelsio 的原帖。9:01稳定男主播感谢收听,晚上十点我们再见。