返回全部动态

北大卢宗青:隐空间才是具身智能的可行路径

原标题:国内第一视角数据最早押注者,北大卢宗青:隐空间才是具身的路

雷峰网 AI科技评论研究质量 78

AI 摘要

北京大学副教授卢宗青创立具身智能公司BeingBeyond智在无界,坚持隐空间世界动作模型路线,已积累超50万小时人类第一视角视频数据,并发布全球首个隐式触觉世界动作模型Being-H0.8。他认为视频生成路线成本高且难以实时控制,而隐空间路线训练成本仅为前者的1%,并预测具身基础模型的确定性技术尚未出现,行业需2-3年实现商业化落地。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

0 作者丨邓哲敏 编辑丨齐铖湧 25 年 6 月,卢宗青在智源大会上提出一个判断:人类视频,是具身智能唯一可以 scale up 的数据路径。 彼时,行业的注意力集中在机器人本体、素材场搭建、数据飞轮上,没有多少模型公司把目光投向第一视角人类视频。卢宗青不一样,他不仅提出这个判断,而且按这个方向积累数据,到现在已经积累了超过 50 万小时。 卢宗青是北京大学计算机学院长聘副教授,长期担任 ICML、NeurIPS、ICLR 高级领域主席,也是国内隐空间路线最早的系统性推进者。 2025 年,他创立了 BeingBeyond 智在无界,走的是一条与主流视频生成路线截然不同的技术路径——隐空间世界动作模型(Latent World-Action Model):不生成画面,直接在 embedding space 里联合预测机器人下一步做什么、世界将如何响应。 这条路线训练成本是视频生成路线的约 1%,推理速度足以支撑实时控制,但有一个缺点——没有画面,不好展示。在具身智能融资热、demo 竞赛激烈的当下,这是一个需要定力才能坚持的选择。 不过卢宗青本人并不把这当成笃定的押注。 他在采访中说了


发布时间:2026-08-17 11:31
抓取时间:2026-08-17 14:03
来源机构:雷峰网
阅读原文leiphone.com