星尘智能发布SmoothRL框架,实现异步在线强化学习
星尘智能发布异步在线强化学习框架SmoothRL,解决大模型异步推理下机器人动作与计划不一致的问题。该框架仅对实际执行的动作进行强化学习,并在真实高动态投掷任务中验证,成功率显著提升。SmoothRL强调在部署中强化学习,使机器人能持续从真实执行结果中修正策略。
技术方向 · AI 走进物理世界:人形机器人、具身基础模型与真实环境操作 · 共 270 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
星尘智能发布异步在线强化学习框架SmoothRL,解决大模型异步推理下机器人动作与计划不一致的问题。该框架仅对实际执行的动作进行强化学习,并在真实高动态投掷任务中验证,成功率显著提升。SmoothRL强调在部署中强化学习,使机器人能持续从真实执行结果中修正策略。
云鲸智能于2026年9月3日在德国柏林举办秋季全球品牌发布会,创始人兼CEO张峻彬发表主题演讲,回顾十年产品创新历程,并发布覆盖扫地机器人、洗地机、吸尘器、除螨仪的全屋智能清洁产品矩阵。公司强调以用户需求为原点,推出NarMind™全智能场景感知系统2.0和热活水履带拖地系统等技术,并展望向具身智能与更复杂家庭服务延伸。
泳池机器人行业在中国经历了从爆发到内卷的周期,早期因无线化和电商红利吸引大量玩家涌入,但产品成熟度不足导致高退货率,行业迅速进入淘汰赛。元鼎、望圆、星迈等头部公司分别以渠道、制造和高端产品切入,如今都在补齐短板,并面临渠道、技术、资本等多重挑战。行业判断出现分歧,有人认为战争已结束,有人则认为技术探索仍长路漫漫。
2026年9月2日,灵心巧手与星源智联合20余家产业链企业成立中国具身智能Tier1产业联盟,覆盖灵巧手、视觉、激光雷达等关键环节。联盟旨在通过跨硬件适配、数据共享和联合预研,解决行业集成成本高、数据孤岛等问题。灵心巧手作为创始成员,将发挥其全栈自研的灵巧操作能力,推动具身智能从单点领先走向系统领先。
物理AI公司ZINOVA联合建筑机器人公司RIC Robotics,基于逐际动力TRON 2双臂具身机器人,完成了混凝土倾覆板缩比施工场景演示,覆盖支模、钢筋铺设与绑扎等工序。此次POC验证了具身机器人使用现有工具参与复杂施工流程的可行性,并探索了创新机器人构型。ZINOVA聚焦工具智能,计划将应用扩展至制造、能源等领域,逐际动力则通过开放平台支持行业应用开
华东师范大学与上海交通大学团队提出S²-VLA模型,通过信念状态和自适应动态门控机制,使2B参数模型在长程机械臂任务中达到96.4%成功率,超越多数7B甚至8.5B模型。该模型动态调整视觉、意图和动作注意力权重,有效缓解累积误差,推理显存约7GB,吞吐量80.8Hz,适合端侧部署。研究强调阶段自适应调度比单纯扩大参数更具价值。
Hugging Face旗下Pollen Robotics发布的Microduck开源双足机器人,售价399美元,引发对端侧AI的关注。文章指出,端侧AI需从简单小模型向复杂大模型演进,后摩智能的存算一体芯片M50已应用于联想AI主机P7和长城N90 Pro笔记本,支持本地大模型运行,展示了端边大模型的落地可能。
它石智航发布通用具身大模型AWE3.7,通过同一模型在工业产线、物流、家庭等多场景中实现精细操作和动态作业,展示了跨场景泛化能力。该模型基于超百万小时真实数据训练,已在真实产线落地,并获得吉尼斯世界纪录和WAIC奖项。
神秘具身智能团队发布多个演示视频,展示其内部代号为MVP(Make Veritable People)的自进化模型。视频中机器人表现出物理理解、空间认知、长程任务和跨本体协作能力,团队称zero-shot成功率达80%,并计划让机器人上街测试。该模型旨在统一物理世界理解与人类行为逻辑,引发业界对具身智能ChatGPT时刻的讨论。
自变量机器人发布灵巧操作系统TwinDex,通过三指九自由度设计和数采与执行同构的硬件,在无真机遥操数据的情况下完成精细操作。该系统将数据采集端与执行端对齐,减少数据迁移损耗,使无本体数据可替代真机数据,采集效率提升5.3倍。此举挑战了传统遥操数据在具身智能中的核心地位,推动高质量数据与真机遥操解绑。
TechCrunch Disrupt 2026 将新增“Real World AI”舞台,聚焦人工智能与物理世界的融合,涵盖机器人、国防、太空和生物技术等领域。该舞台将邀请 Nvidia、Shield AI、Colossal Biosciences 等公司的负责人发表演讲,讨论机器人数据缺口、AI 安全部署、物种灭绝逆转等话题。活动将于 2026 年 10
本末科技推出模块化机器人D1及D1-SET负载箱方案,通过自研拼接机构支持多单元组合,系统可自动识别新构型并更新动力学模型,实现负载、越障等核心性能随构型变化。该方案旨在减少整机重复开发,拓展机器人进入物流、巡检等碎片化场景的能力。
World Labs 发布了名为 Atlas 的单一 AI 模型,能够从少量照片中生成、重建和模拟 3D 世界。该模型在相机可控生成和少视图 3D 重建任务上优于专用模型,并支持原生 3D 输出和机器人仿真。Atlas 目前通过早期访问计划向部分合作伙伴提供,并将驱动未来的 Marble 版本。
乐享科技旗下元点机器人宣布即将推出首款人形机器人Zeroth Bridge“小桥”及全球首个具身Physical AI开源生态OpenBridge。OpenBridge将开源底层代码,提供Skill Hub技能商店和Bridge Builder开发者计划,旨在连接开发者与用户,推动具身智能的“安卓时刻”。Zeroth Bridge重量仅12公斤,售价8888
港股上市公司弘毅文化集团旗下AIROBO与中国科学院力学研究所签署五年合作协议,共同研究机器人运营技术,包括复杂场景运行机理、空间智能、仿真推演等。合作旨在解决异构机器人规模化进入真实空间的共性问题,推动机器人运营从设备管理向智能运营演进。
9月2日,前字节跳动强化学习专家、前腾讯Robotics X智能体中心负责人孙鹏博士正式加入星尘智能,将重点负责机器人强化学习方向的技术研发与应用探索。孙鹏拥有十余年强化学习与智能体研究经验,曾主导开发字节核心强化学习基础设施ByteRL,并参与大模型RLHF与预训练。他的加入将强化星尘智能在机器人强化学习方向的布局,与AI模型、具身OS和绳驱机器人本体形成
ZimaBlue 是一个从大规模视频中学习通用世界动作模型(WAM)的可扩展框架,采用三阶段训练课程:因果具身视频预训练、视频-动作中间训练和针对目标机器人的微调。其异步慢-快双系统架构支持在 RTX 4090 上实现 30 Hz 的实时动作预测。在真实机器人零样本评估中,将训练数据从仅目标机器人数据扩展到超过 12 万小时的具身视频,成功率从 36.1%
智平方(AI² Robotics)宣布其搭载类脑架构具身大模型NeuroVLA的AlphaBot 2(爱宝)机器人正式入驻香港兰桂坊酒吧,提供调酒与互动服务,成为香港首个真实开放场景服务机器人。此举标志着智平方跑通中国具身智能出海的全链路闭环,包括硬件出关、清关合规、取得本地饮品售卖资质及建立付费服务体系。NeuroVLA通过模拟人脑皮层-小脑-脊髓协同机制
李飞飞创立的World Labs发布了全球首个多模态世界模型Atlas,该模型能够基于单张图片生成具有像素级相机控制的视频,并完成3D重建和时空模拟。Atlas采用多模态自回归扩散Transformer架构,支持机器人Real-to-Sim工作流,为具身智能训练提供新途径。目前Atlas已向部分合作伙伴开放早期访问。
Apple 研究团队提出 REFACTOR-VLA 系统,通过“唤醒/睡眠”架构学习可复用的机器人技能,利用行为等价核和潜在世界模型进行聚类,并生成类型化 lambda 程序。在 LIBERO 基准测试中发现,增大世界模型规模反而降低性能,而添加 InfoNCE 对比损失能显著提升技能聚类质量。