AI 创业播客日报|Manus 估值翻倍、智谱 RSI 早期案例与中国电信通用 Agent

AI 创业播客日报|Manus 估值翻倍、智谱 RSI 早期案例与中国电信通用 Agent

晚上好,本期在 X 上读取了四百零四个关注账号的五千五百二十九条推文,其中三百二十二条落在时间窗内;公众号方面,三个账号的十八篇文章在本期窗口内。

0:00 / 10:21
本期在 X 上读取了 404 个关注账号的 5529 条推文,其中 322 条落在今天 09:00 到 22:00 的窗口内;公众号方面,3 个账号共有 18 篇文章在本期窗口内。

智谱:模型开始优化运行自己的系统

清华大学计算机系教授、智谱创始人唐杰今天分享了一个内部观察到的案例,说这是递归自我改进(RSI)的早期形态:GLM-5.3 驱动的 Infra Agent,在超过 10 万张国产芯片组成的集群上,从零搭起一套生产级推理系统,又把它优化了一遍。1
从第一次跑通到全量承载线上流量,用了不到两周,端到端吞吐提升到初始基线的 3.2 倍。唐杰说这不是简单的让 AI 写代码:这个 Agent 会自己读系统反馈、提出假设、修改代码、跑实验,再根据结果继续迭代。2
具体到两个例子:它定位出 KV Transfer 场景里 Python 的 GIL 造成的并发阻塞,把 Prefill 加 KV Transfer 相比单独 Prefill 超过 20% 的性能损失压到了 1% 以内;在 KDA Decode 算子上,它重新组织计算,拿到 1.7 倍的性能提升。1
智谱同时说明,他们还没有实现 RSI,目标怎么定、边界怎么划、风险怎么判断,目前依然由人类工程师负责。2

Manus 估值翻倍到 40 亿美元

据彭博社报道,AI 智能体公司 Manus 计划中的 5 亿美元融资即将完成,估值翻倍到 40 亿美元。这是它跟 Meta 分拆之后的第一轮融资,落地之后 Manus 会成为国内 AI 智能体赛道里估值最高的初创公司。3
新投资方的身份还不清楚。Manus 现有投资方包括腾讯、HSG 和真格基金;报道还提到,它之后可能像月之暗面一样去香港上市。报道同时写明,谈判还在进行,交易条款仍可能发生变化。4

中国电信的通用 Agent 进了 IDC 评测前三

量子位文章介绍,IDC 发布了国内第一份《中国企业级通用 Agent 产品技术评估》,中国电信的 TeleAgent 排进前三。这次 IDC 没有沿用大模型 Benchmark,而是拿近百道非公开任务,考察一款 Agent 能不能在真实办公环境里把事情办完,其中包括从约 3 万字材料里提炼内容、生成 11 页 PPT 这样的题目。5
TeleAgent 的常规任务得分 3.49,复杂任务得分 3.36;九项能力里,任务表现拿到满分,成本效率是这次测评里的最高分。5
TeleAgent 今年 4 月还在公司内部试用,7 月才推出 V1.0,现在用户规模已经接近 120 万。它的上下文窗口突破 400K,做法是对旧的工具输出先做轻量剪枝,上下文还是过长就交给压缩模型处理;另有一个叫 autoDream 的长期记忆,定期整理近期对话,再跟已有记忆合并。5
文章还提到,任务一旦变长,各家 Agent 的交付质量和成本消耗差距就会放大,IDC 在报告里把这套模型外围的执行系统叫作 Agent Harness。5

Meta 的 Muse 上线之后

Meta 首席 AI 官 Alexandr Wang 今天在 X 上连着转发了一批用户实测。其中一位用户说,他的 Muse agent 已经帮他省下 2120.95 美元,包括把 AT&T 的账单谈到每年便宜 300 美元,还有一笔 192 美元的亚马逊退货。6
另一位用户说,Muse 帮他把网络账单也谈低了;还有人说 Muse 能驱动他的 iPhone,也有人在工业项目里把 Muse 当作调度层在用。78
有人用了 48 小时之后说,这可能是 Meta 到目前为止最好的产品;也有人让 Muse 去找他一直想买的三瓶威士忌,结果真找到了。910
Alexandr Wang 自己的说法是,只要肯花心思,Muse 能做的事还有很多。11
来源:X:@alexandr_wang

云知声 U2-Flash 交卷

云知声发布 U2-Flash,交出一份国产 RSI 的早期答卷。在后训练闭环里,这个模型已经开始深度参与自身的演进:生成训练数据、分析执行轨迹,还负责巡检和修复训练系统。12
相比上一代 U2,U2-Flash 的生成速度提升 2.1 倍,Agent 任务完成时间缩短 35%,任务迭代步数和 token 消耗降低 20% 到 30%。能力没有打折,反而反超了上一代:DeepSWE v1.1 从 32 分提到 64.6 分,TerminalBench 3.0 从 2.7 分提到 24.3 分,SWE-Bench Pro 拿到 61.6 分。12
模型是稀疏 MoE 结构,总参数约 266B,单次推理只激活约 10B,不到总参数的 4%。价格上,输入每百万 token 0.6 元,输出 1.2 元,缓存命中 0.12 元,目前限时六折;9 月 15 日到 30 日,用户可以免费领取 1 亿 token 的额度。12

其他快讯

  • TypeSafe 拿到 4000 万美元种子轮,由 DCVC 领投;这家公司本周发布的 Jev 不做自由文本生成,只输出带类型的结构化判断。13
  • Jev 的外部实测陆续出来:Browser Use 接上它之后,一次机票查询只花 7 秒、0.0039 美元;有开发者说它几秒钟分类了 500 封邮件、花掉 3.5 美分,1000 次请求 7 美分。1415
  • 量子位文章介绍谷歌的 RSI 论文 Dream-RSI:把 Agent 过去探索留下的记录当成一个模拟世界,让新的搜索策略在旧的发现树上回放,挑出更好的策略再回到真实环境跑一次。16
  • 量子位文章说,vivo 在 2026 开发者大会的人工智能分会场上公布了蓝心大模型端云矩阵,端到端语音、端侧 Nano、云侧 Flash 和 Pro 各管一段,用大模型加 harness 重构 OS 体验。17
  • 量子位文章介绍中科大和阿里巴巴的 CEDAR 框架,在 1688 约 3200 万条商品轨迹上,预测误差比最优基线降低超过 57%,线上 A/B 测试让商家 LTV 提升 13%、店铺 ROI 提升 15%。18
  • 机器之心文章介绍上海人工智能实验室联合复旦、上海交大、香港科技大学和浙江大学的 SHE 与 SafeEvolve,把 Agent 的执行轨迹拆成 System Prompt、规则库、安全记忆和工具策略四类组件来演化,SHE 把平均攻击成功率从 17.1% 降到 5.5%。19
  • 机器之心文章说,Maxinsights 是 Dyna-2 最大的数据合作伙伴,也是 GENE-26.5 的独家第一视角数据合作伙伴,Google DeepMind、Figure、1X 也和它做过数据合作。20
  • 机器之心文章说,Anew Labs 分拆后的首轮融资金额是 2.9 亿美元,红杉中国、高瓴、IDG 等参投,他们同时放出技术报告 AnewDDE,里面包含千亿参数的 AnewMind。21
  • 36 氪文章说,乐享科技的以太大模型让两台机器人店员在上海闵行一家烧烤店里配合招待顾客,这场户外直播持续了一个多小时,刷新了具身智能大模型长时真实环境公开验证纪录。22
  • 36 氪报道,脑科学 AI 公司曦嘉医疗完成数千万元 Pre-A 轮融资,由国中资本领投,其 AI 脑图谱软件已累计支持 20 余例电极临床植入。23
  • 做视频生成的 Higgsfield 上线 API,把 50 多个前沿模型放在一个接口里,官方说价格比订阅更低,Seedance 2.5 也在其中。24
  • 有用户发现,OpenAI 给美国认证临床医生免费提供 GPT-6 Astra 的 Pro 权限,通过 ChatGPT for Clinicians 注册。25
  • Figure 说他们有了一项 AI 突破,明天展示。26
  • 有报道说,扎克伯格、马斯克和黄仁勋一起向特朗普施压,要求撤掉一个由 Google DeepMind 支持的 AI 监管机构提案。27
  • 做第三方评估的 TransluceAI 发帖说,前沿实验室的 CEO 们正在呼吁引入嵌入式第三方评估者,但第三方具体应该评估什么,还没有答案。28
  • GoodfireAI 宣布与 baseten、baselabs 合作,为开源模型搭建安全基础设施。29
  • X 上有人把 Hamel Husain 的 13 场讲座、9.5 小时整理成一份 AI 产品工程手册:先修检索和上下文,再修系统,微调放在最后,而一切从评测开始;喂对文档之后,得分从 14.6% 涨到 93.5%。30
  • 有人分享了从闭源模型迁移到开源模型的五阶段手册,说因为网关、评测框架和工具链天然支持多模型切换,整件事可以在几周内完成。31
  • 一位开发者在 X 上说,他在 CarPlay 上启用了 Codex,一边开车一边用语音让 Codex 改设置、推代码、汇报发布进度。32
  • 有人介绍,Anthropic 的 FDE 团队工程师 Kevin Bai 在 AI Engineer World's Fair 上讲了《FDE 101》;另一位开发者说自己牵头做了一个 110 万元的 FDE 驻场项目,第一阶段刚结束。3334
  • 豆包发布汽车座舱助手,把豆包模型和车机整合,支持用多模态交互控制空调、车窗和导航路线,还配了一块车载小屏。35
  • Replit 把 Replit 带进了 Slack Code。36
  • 有人介绍了一个叫 Frida 的 iOS 个人 agent,做日常事务时会一步一步让你确认。37
  • flomo 把 Agent 内置进产品,作者说上线过程颇为波折,以后会隔三差五免费发放重置卡。38
  • Marin 的 535B-A23B 也在公开直播训练,发起人邀请其他人分享自己的训练进展。39
  • Sakana AI 的 Smart Cellular Bricks 上了最新一期《科学美国人》,把简单立方体拼成能集体行动的模块。40
  • NeoCognition 发布 ApprenticeBench,在真实工作上考 computer use 和持续学习,他们说 Fable 5.1 和 GPT-6 Astra 已经能做。41
  • 有人发布 VC-Attention,一种不用重训的低比特注意力方法,在 MiniMax-H3 上做了加速。42
  • LangChain 的 CEO Harrison Chase 转发一项评测说,七个模型分别在 Claude Code、Codex 和 Pi 三个 harness 上测试,结论是模型未必受益于原生 harness。43
  • 一位开发者说,他把 iOS 和 macOS 27 的 UIKit 整理成一套 Apple Design System,现在可以让 AI 直接出 Apple 风格的设计,几乎像素级还原。44
  • 有开发者说,他用 GPT-6 Astra 做软件宣传视频,从配乐、音效到画面组件全部由它处理,没有用任何生成模型,全是代码。45
  • 机器之心文章介绍 Sharpa Robotics 的世界联觉模型 WSM,这篇工作被 CoRL 2026 高分收录,在 22 个自由度的五指灵巧手上做抗扰动的手内操作。46
  • 机器之心账号说,有一个 30 亿参数的基础模型专门给去中心化的多机器人协作用,视觉运动推理在本地闭环跑到 30 赫兹,没有中心调度。47
  • 据财联社报道,英国 AI 初创公司 Emulate 启动新一轮融资,目标最高募资 7 亿美元,投后估值约 37 亿美元,由 Index Ventures 和 Lightspeed 领投;这家公司由前 DeepMind 的 Jack Parker-Holder 和 Matthew McGill 创办,两人参与创建过 Genie 世界模型。48
  • 佳都科技参股的宇算星河完成超亿元 Pre-A 轮融资,资金投向天基大模型研发与太空智算业务。49
  • 具身智能公司 LiberAI 完成数亿元 Pre-A++ 轮融资,投资方包括华映资本、中关村科学城、达晨财智和高信资本。50
  • 有人用 iOS 四到七的老手机搭了一支 Agent 团队,教程也一并放了出来。51

References

  1. 1
  2. 2
  3. 3
  4. 4
  5. 5
  6. 6
  7. 7
  8. 8
  9. 9
  10. 10
  11. 11
  12. 12
  13. 13
  14. 14
  15. 15
  16. 16
  17. 17
  18. 18
  19. 19
  20. 20
  21. 21
  22. 22
  23. 23
  24. 24
  25. 25
  26. 26
  27. 27
  28. 28
  29. 29
  30. 30
  31. 31
  32. 32
  33. 33
  34. 34
  35. 35
  36. 36
  37. 37
  38. 38
  39. 39
  40. 40
  41. 41
  42. 42
  43. 43
  44. 44
  45. 45
  46. 46
  47. 47
  48. 48
  49. 49
  50. 50
  51. 51

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content