「大脑确实是整个机器人栈里最薄弱的环节」:千寻智能把机器人的 GPT-3.0 定在 2027 年年中

「大脑确实是整个机器人栈里最薄弱的环节」:千寻智能把机器人的 GPT-3.0 定在 2027 年年中

路透社在北京专访千寻智能联合创始人高阳,公司预计 2027 年年中到达机器人的 GPT-3.0 里程碑;这篇把那个时间表、一千名合同工的数据采集,以及宁德时代与京东的落地情况分开核对。

9 月 18 日,路透社发出一篇对千寻智能(Spirit AI)的现场报道,记者 Laurie Chen 在北京办公室见到了公司的联合创始人兼首席科学家高阳。1
这篇报道值得读的地方,是它把「机器人什么时候变聪明」这个问题换成了三个可以分别核对的说法:一个时间点、一条数据采集的路子、一处已经上线的产线。
高阳给出的判断是:大脑确实是整套机器人技术栈里最薄弱的环节。9 他给出的时间表是:公司预计在 2027 年年中达到 GPT-3.0 里程碑,届时人用自然语言对机器人说话,机器人执行一连串合理的物理动作去尝试完成任务。9
这篇专访出现在一个转折处。中国的人形机器人已经能按指令冲刺、跳舞、后空翻,硬件这条路走得很远,机器人公司眼下把注意力转向决定机器人智能水平的软件,也就是「具身智能」。9 路透社 8 月 20 日报道过宇树科技首席执行官对机器人的「ChatGPT 时刻」的期待,2 9 月 10 日又写了一位跑赢博尔特的中国机器人冠军要走向真实工作。3 千寻智能这一篇补上的是给出时间表的公司自己的说法。

路透社这篇专访说了什么

报道的主线是高阳在北京办公室里对记者做的介绍。
高阳的原话是:「我们预计在 2027 年年中达到 GPT-3.0 里程碑。你可以用自然语言对机器人讲话,它会执行一连串合理的物理动作去尝试完成任务。」9 报道的导语把同一件事写成「最早在明年」,交给读者的是两个刻度:导语的「明年」和原话里的「2027 年年中」。
数据从哪来,报道写得最细。公司在全国雇了大约 1,000 名合同工,让他们在家里或工厂里佩戴数据采集设备,提供人类在环境中如何移动的数据,用来训练机器人。9 记者参观了北京办公室里的一个数据训练中心,几十名佩戴传感器的年轻人正在重复开冰箱、解锁保险箱、用刀切菜这类动作。9 千寻智能的机器人在结构化的客厅环境里,做简单任务的成功率已经到 90%。9
进度窗口有三段,高阳把它们分开说:「接下来一到两年是工业应用的初始窗口。两年后,我们会看到机器人进入商业服务场景,做更简单的工作。进入家庭比这两者都难得多。」9 公司目前有数十台自研的 Moz1 轮式人形机器人部署在电池厂商宁德时代与零售商京东的产线上,京东同时是它的投资方。9
公司本身的情况也在报道里。千寻智能有 300 名员工,2024 年成立以来累计融资超过 6.7 亿美元,当前估值 200 亿元人民币(约 29 亿美元);高阳拒绝对首次公开发行的计划置评。9
报道还写下了高阳对进步速度的感受:公司成立时,一台机器人只能做好一件孤立的动作,比如倒一杯水或者叠一件衣服;现在机器人可以在较大的空间里跑完连续的复杂流程。9 困难留在两处——拧开瓶盖这样的精细动作,以及遇到没见过的任务时。9

「GPT-3.0」是个什么刻度

高阳把这个刻度定义得很具体:能用自然语言下指令,机器人把一连串合理的物理动作连起来去试。9 这个定义落在「听懂人话之后自己拆步骤」这件事上,成功率与速度留在定义之外。
时间点上,报道的导语和原文有一处松紧差别。导语写「最早在明年」,高阳自己的原话把节点放在 2027 年年中。9 读者在别的转述里看到「明年」,可以回到原话对一下。
高阳对进度的分段更值得记:工业应用一到两年,商业服务大约再等两年,进家庭最难。9 这句话把「机器人进家庭」这件事从时间表里单独摘了出去。

一千名合同工,和一个真实世界的数据池

千寻智能押的是真实世界数据。它几乎全部依靠真实世界的交互来训练机器人大脑,许多竞争对手用仿真器压低训练成本,而高阳说,有些任务只有通过与真实物体互动才能学会。9 他给的理由是:「仿真器擅长处理刚体,但可变形电缆这样的柔性物体仍是个问题。」9
路透社 8 月 27 日的调查写过,在中国其他机器人训练基地,操作员可能要重复一个动作 50 次以上,才得到一个精度达标的「干净」动作。4 千寻智能得出的结论相反:使用动作种类更多的「脏数据」,模型进步反而更快。9
一只机械臂握着一把红柄刀,在木砧板上切一根黄瓜,一名穿黑衫的年轻人在后方观看
路透社记者 Tingshu Wang 9 月 17 日在北京千寻智能总部拍摄的测试场景。报道描述的数据训练中心里,佩戴传感器的年轻人重复的正是切菜这类动作。9
这套数据的规模,公司自己的口径给得更细。据投资界报道,千寻智能的自研采集设备把数据采集成本降低了 90%,截至 2026 年 4 月累计获得超过 20 万小时的多类型真实交互数据,覆盖互联网视频、遥操作与可穿戴采集,预计 2026 年总量突破 100 万小时,数据采集团队同期扩到千人规模。5

已经落地的部分:宁德时代产线与京东

路透社写的是数十台 Moz1 部署在宁德时代与京东的产线上,中文报道在宁德时代这一侧给得更细:公司称全球首条具身智能机器人产线已在宁德时代中州基地投运,墨子(Moz)机器人在 PACK 生产线上生产了近千块电池,实现零故障量产,插接成功率稳定在 99% 以上,作业节拍达到熟练工人水平,能够自主应对来料位置偏差与插接点位变化。10 京东那一侧,双方在 2026 年 3 月签署战略合作协议,Moz 机器人接入京东 MALL 的智慧零售场景,京东把零售场景开放给千寻智能做真机验证。10 同一件事,路透社写成产线部署,中文报道写成零售场景验证。
机器人产品线从 Moz1 开始。2025 年 6 月发布时,官方的说法是国内首款全身高精度力控人形机器人,26 个自由度、全身一体化力控关节,负载自重比 1:1。6 公司参加 2026 世界人形机器人运动会时拿下一金一银。7
钱的分量和路透社写的略有出入。把中文公开报道的各轮加总,是这样的:
时间轮次金额领投方或主要投资方来源
2024 年 8 月种子轮+天使轮近 2 亿元顺为资本、绿洲资本、弘晖基金、达晨财智、千乘资本等首发|30 天融资 30 亿,马云雷军联手重仓
2024 年 11 月天使+轮未披露柏睿资本(宁德时代联合创始人、副董事长李平创办)首发|30 天融资 30 亿,马云雷军联手重仓
2025 年 3 月Pre-A 轮5.28 亿元Prosperity7 Ventures(阿美风险投资旗下)首发|30 天融资 30 亿,马云雷军联手重仓
2025 年 7 月Pre-A+ 轮近 6 亿元京东领投京东领投!千寻智能完成近 6 亿元 PreA+ 轮融资
2026 年 2 月连续两轮近 20 亿元云锋基金、混沌投资、红杉中国等机器人公司千寻智能完成近 20 亿融资,估值超百亿
2026 年 4 月10 亿元顺为资本、云锋基金联合领投首发|30 天融资 30 亿,马云雷军联手重仓
2026 年 8 月A+ 轮15 亿元一线美元基金、大型产业投资方与国资基金双线告捷!Spirit v1.6 再获 15 亿元 A+ 轮融资
各轮加总约 58 亿元人民币(约 8.6 亿美元),比路透社写的「超过 6.7 亿美元」多出约 13 亿元,而这 13 亿元正好是 2025 年及以前三轮的合计。两套口径里哪一套是实际到账的股权融资,报道与公司都没有说明。估值上的差别更直接:路透社写当前估值 200 亿元人民币,公司 2026 年 2 月官宣时的说法是「估值突破百亿」。911
人和钱之外,是团队。高阳现任清华大学交叉信息研究院助理教授,本科毕业于清华大学,在加州大学伯克利分校取得博士学位,研究涵盖具身智能与机器人交互,公司现任首席执行官是连续创业者韩峰涛。810

失控风险,为什么他说现在还不紧迫

报道最后一段问的是安全。美国 AI 公司近来在几起黑客事件后呼吁放慢前沿模型的开发,高阳判断,对物理世界里的机器人来说,失控风险眼下还没那么紧迫,原因是软件模型本身仍不成熟。9 随着机器人进入商业与家庭这类拥挤、难以预测的场合,具身智能的安全会变成更大的问题。9
他给的两句话把当下的安全边界说清楚了:「我们的机器人具备全身力控。如果机器人与环境之间的交互力过大,急停会作为基础安全策略自动触发。」以及,「等基础模型进入成熟、自主的『GPT-4.0』时代,研究高级 AI 安全与对齐会变得可行得多。」9 这两句放在一起,意思是今天的安全靠机械与力控兜底,对齐研究被排到了模型成熟之后。

原文直引

"The brain is indeed the weakest link in the complete robotics stack."
高阳在北京办公室里对路透社说出的核心判断,「机器人技术栈」指从硬件到算法的整条链。9
"We anticipate reaching the GPT-3.0 milestone by mid-2027. You will be able to speak to a robot in natural language, and it will execute a series of reasonable physical actions to attempt the task."
同一篇报道里唯一带明确时间点的一句,注意句末是「去尝试完成任务」。9
"The next one to two years mark the initial window for industrial applications. Two years from now, we'll see robots deployed in commercial service settings doing simpler tasks. Entering homes is far harder than both."
同一篇报道里的三段进度窗口,家庭被单独排到最后。9
"Simulators handle rigid bodies well, but flexible objects like deformable electric cables remain a problem."
高阳解释为什么公司主要用真实世界数据训练,而不是靠虚拟仿真。9
"Our robots feature whole-body force control. If the robot encounters excessive interaction force with the environment, emergency braking triggers automatically as a baseline safety policy."
同一篇报道里对当前安全机制的描述。9
"Once foundation models reach a mature, autonomous 'GPT-4.0' era, researching advanced AI safety and alignment will become much more actionable."
高阳把高级 AI 安全研究排到基础模型成熟之后。9

把这批信息拆成四层

层次内容依据
媒体措辞路透社把 2027 年年中的节点放在导语「最早在明年」与高阳原话「2027 年年中」之间;报道同时写明进家庭要难得多路透社 9
当事人自述高阳给出 GPT-3.0 里程碑、三段进度窗口、「脏数据更有效」、全身力控与自动急停;公司层面给出 300 人、累计融资超 6.7 亿美元、估值 200 亿元人民币,并对 IPO 计划不予置评路透社 9
可核到的公开记录宁德时代中州基地产线的近千块电池、99% 以上插接成功率;京东 MALL 零售场景的落地;官方与中文报道逐轮列出的融资额与领投方;公司官网的产品与赛事记录;高阳的清华教职投资界 10;财新 11;公司官网 12131415;清华大学 16
仍待核实2027 年年中这个里程碑的实际达成情况;累计融资额 6.7 亿美元与中文各轮加总之间的 13 亿元差额对应哪一套口径;200 亿元人民币估值是哪一轮定价;1,000 名合同工的数据采集如何合规;京东一侧是产线部署还是零售场景验证路透社 9;投资界 10
接下来能核的节点已经排得出来:这个 GPT-3.0 里程碑在 2027 年年中会不会出现可公开验证的演示;拧开瓶盖这类精细动作与没见过的任务何时不再是原话里列的难点;1,000 名合同工的数据采集会不会引出现实层面的争议;以及公司会不会给出 IPO 的正式说法。这几件事合起来,才回答得了千寻智能这一步目前停在融资与时间表上,还是已经走到可以按节点验收的工程阶段。910

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

More from this channel