返回全部动态

攀爬AGI的南北坡:语言模型之外,生数从世界模型出发

智东西模型发布质量 38

AI 摘要

生数科技在外滩大会预告发布面向灵巧操作的自进化通用世界模型Motus2,将评估与反馈显式纳入统一模型,使机器人能预测动作后果并据此优化策略。文章以智谱(语言模型路线)与生数(世界模型路线)为对照,称二者为攀爬AGI的南北坡。生数已形成Vidu Q3生成世界、Vidu S1实时交互、Motubrain世界动作模型三类核心模型布局,创始人朱军团队在概率机器学习与世界模型领域有长期学术积累。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

智东西(公众号:zhidxcom) 作者 | Ada 编辑 | 漠影 过去三年,通往AGI的主叙事,几乎都从语言开始:更多文本、更大参数、更长上下文、更强推理,再加上工具调用与智能体。 这条路已经证明了自己的力量。它让机器能够读写、编程、检索、规划,并开始接管一部分原本只存在于电脑屏幕里的复杂工作。 但当任务从“在网页上完成一份表格”变成“把一个灯泡稳稳拧进灯座”,问题忽然变了。机器人不仅要看见物体,还要判断手指该怎样接触、这一下转动会发生什么、拧偏了是否应该停下、下一步怎样纠正。它需要的,不只是一个能描述世界的模型,而是一套能在行动前预演后果、在行动后复盘得失的内部世界。 这正是当下AGI竞争开始出现分岔的地方。 同样脱胎于清华实验室的智谱与生数,恰好提供了两组值得观察的中国样本:前者以语言模型与智能体为核心组织能力,后者以世界生成、实时交互与世界动作模型为线索推进。它们像在同一座山的两面攀爬:一面从人类已编码的语言和知识出发,另一面从世界持续发生的变化与反馈出发。 一条路从语言出发,一条路从世界出发。地貌不同,难题不同,却指向同一座山。 而要看清第二条路究竟难在哪里,最好先把镜头从


发布时间:—
抓取时间:2026-09-11 01:15
来源机构:智东西
阅读原文zhidx.com