北京和杭州的两场讨论,给出了 Agent 的两种时间感:工业现场已经把部分片场扫描进线上 3D 空间,学术现场却提醒,能点亮一盏灯,还不等于电网已经建成。1
文章把进度差异落到了具体场景:Coding Agent 已经能接手一部分真实开发工作;到了具身智能和开放世界,稳定性、泛化、持续学习仍然难。杭州学术场反复追问的,是 Agent 能不能检查结果、修正错误、保留经验,再把反馈变成下一轮能力。1
北京工业场关心的是另一件事:结果能不能交付。群核科技分享的路线,是先把人物、道具、场地和摄像机固定在 3D 空间里,再让视频模型负责审美和语言控制;美图则把策划、设计、修图、调色和执行拆给不同 Agent,向可直接使用的成果推进。1
所以两边并不矛盾:北京在补流程、空间和行业规则,杭州在追问执行、验证、反馈、更新能否连成长期闭环。局部能力可以很科幻,完整系统仍然要靠稳定交付和持续学习来证明。
图集说明:首图和虚拟片场图是原文中的 AI 生成视觉,不是现场照片;第三张为原文活动现场图。1




Comments
Sign in to comment.