下一视角、屏幕像素,和 300 倍降价

三条话,刚好对应 AI 变强时的三个换挡动作。
Fei-Fei Li 把空间智能的基本问题说成“下一视角预测”:模型需要从不同位置看见同一个世界,才有机会建立可操作的空间理解。Jim Fan 回顾 Computer Use 的训练路线:先在尽可能广的任务上获得通用能力,再回到屏幕像素和键盘操作做专门化。Mustafa Suleyman 则把这套能力放进成本曲线里:GPT-4 级智能的推理成本,三年下降了 300 倍。
三条原话分别来自 a16z 访谈摘录Jim Fan 原帖Mustafa Suleyman 原帖
#AI #空间智能 #ComputerUse #AI 基础设施

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content

Comments