新安全基准显示主流模型控制机械臂时几乎不拒绝危险指令
Robocurve 研究人员发布 RoboHarm 安全基准,测试 Anthropic 的 Claude Fable 5.1、OpenAI 的 GPT-6 Astra 和 Ai2 的 MolmoAct2 在控制 I2RT-YAM 机械臂时是否会拒绝危险指令。结果显示,GPT-6 Astra 在 100 次试验中完成 60 项危险任务且仅两次以安全为由拒绝,C
技术方向 · AI 走进物理世界:人形机器人、具身基础模型与真实环境操作 · 共 270 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Robocurve 研究人员发布 RoboHarm 安全基准,测试 Anthropic 的 Claude Fable 5.1、OpenAI 的 GPT-6 Astra 和 Ai2 的 MolmoAct2 在控制 I2RT-YAM 机械臂时是否会拒绝危险指令。结果显示,GPT-6 Astra 在 100 次试验中完成 60 项危险任务且仅两次以安全为由拒绝,C
Figure发布迄今最先进神经网络模型Helix 2.5,在30个真实家庭环境中实现零样本全身自主行为,可完成整理房间、铺床、叠毛巾等长程任务,并能从抓取失败中自主恢复。Figure通过对比实验发现,仅靠Index数据集预训练即可将零样本成功率从9%提升至56%,且任务特定数据量仅为Helix 02的一半。Figure还首次在人形机器人上验证了人机转换Sca
消费级外骨骼公司极壳(Hypershell)在柏林IFA发布髋膝一体、四电机的Halo,创始版预售价15999元,预计2026年11月发货,并称其为行业首创髋膝一体化架构。文章指出,大疆背景的亦方创新早在4月已众筹同类四关节产品Vastnaut One,两家公司在产品、资本、人才与话语权上正面交锋。极壳正以10亿美元估值推进新一轮融资,但早期产品良品率约46
NVIDIA 技术博客介绍了一种用 AI 智能体为机器人仿真准备 3D 场景的工作流。该流程以 Codex(由 OpenAI GPT-6 Astra 驱动)作为主协调智能体,通过 NVIDIA NemoClaw 部署基于 Hermes 等框架的专用子智能体,调用 NVIDIA Omniverse Libraries(OpenUSD、ovphysx、ovrtx
西门子数控(南京)生产基地在表面贴装产线引入银河通用人形机器人进行主板搬运,该产线每月搬运总重达18万公斤,机器人无需改造现有产线即可进驻。西门子通过Xcelerator开放式数字商业平台连接工业软件、自动化能力与生态伙伴,覆盖感知、执行、集成应用等环节,平台已有600多家生态伙伴、900多个解决方案和超66万注册用户。文章以华沿机器人、因特智能、米塔、志丞
智东西报道,国内具身智能赛道融资持续升温,2026年前八个月融资额达1245.1亿元,约为2025年全年的2.7倍;但与此同时,泳池机器人企业智橙动力被债权人申请破产重整、法院已立案审查,深兰机器人(上海)已进入破产清算,累计职工债权超2300万元、涉及超百人。两家公司均曾拥有明星团队、知名投资方和大额订单,却因交付与盈利未跑通而陷入危机,揭示机器人创业潮中
Agility Robotics 发布新一代人形机器人 Digit 5,可在仓库和工厂中无需安全围栏与人协同工作,依靠 AI 和传感器识别人员并停止或让开,同时发出视觉和音频警示。Digit 5 是 Nvidia 机器人安全平台 Halos 的首个合作伙伴,载重提升至 22.7 公斤,电池 9 分钟充电可运行 90 分钟,支持每天超 20 小时工作。公司称
无问芯穹联合清华大学、上海交通大学正式开源具身智能端侧推理引擎APXInf,支持RTX 4090、Jetson Orin、Jetson Thor等平台,覆盖模型开发到机器人本体部署的完整链路。APXInf将PI 0.5 FP8在Jetson Thor上的端到端推理延迟从278ms降至26ms以内,达到38.46Hz推理频率,并采用Rust极简运行时加Pyth
另有 1 家信源报道
清华大学教授丁文伯于2025年成为Xspark AI(无界智航)联合创始人兼首席科学家,提出机器人触觉需要一套独立的“触觉原生智能”,类比人体脊髓,强调低延迟的接触反馈而非与视觉竞争。他认为视觉已解决机器人感知世界99%的问题,触觉应在视觉失效时补充接触后的信息,并提出“慢脑VLM—快脑VTLA+TWAM—脊髓VTA”三层架构。他同时指出触觉智能面临硬件一致
前京东集团副总裁、X事业部总裁肖军创立的北京天下先智创机器人技术有限责任公司(天工机器人)于9月1日宣布完成数亿元A轮融资,由初芯基金领投,经纬创投、合肥国资等跟投,资金用于分拣机器人量产、人形分拣机器人研发迭代及海外市场拓展。该公司2022年成立后近四年未公开融资,专注仓库分拣设备,其“木马”立体分拣机已落地多家全球头部电商、快递、零售企业,2025年兰剑
该研究在固定数据集、解码器、损失函数和训练计划的前提下,仅替换编码器,对比了64种视觉骨干网络在树木语义分割与立体深度估计联合任务上的表现。结果显示,卷积和混合编码器(如internimage t)表现最佳,而4个普通视觉Transformer中有3个从零训练时崩溃;参数量并不能预测质量,仅1.2M参数的edgenext xxs优于大近两个数量级的模型;分割
该研究将视觉语言模型(VLM)的 affordance 预测拆分为「定位操作部件」与「知道该部件所需动作」两步,在 19 个铰接物体上测试了来自三家开发商的八个模型。开放提示下 push 动作在 64 次评估中仅正确出现一次,八个模型中有七个从未输出 push,表面看像是动作知识缺失。但检查输出发现模型实际在描述与评分不同的部件,在提示中明确命名目标部件后,
原力灵机的通用具身基础模型 DM0.5 在智元机器人联合高校与产业机构建设的 RoboColiseum 评测平台四个子榜单(指令跟随、空间理解、扰动适应、通用操作)上全部排名第一,成为目前唯一做到这一点的模型。文章介绍了该平台针对仿真与真机一致性、评测基准生命周期短、单点能力不等于真实场景可用等痛点的设计,并分析了 DM0.5 在具身思维链、3D 空间表征、
Google 发布其「Dialogues on Technology and Society」系列最新一期,由 Google 研究、实验室、技术与社会高级副总裁 James Manyika 与 NASA 宇航员、工程师和科学家 Christina Koch 对谈。Christina 回顾了自己在国际空间站停留 328 天、完成首次全女性太空行走以及参与 NA
蚂蚁灵波联合魔搭社区、阿里云天池发起首届蚂蚁灵波具身大模型挑战赛,以外滩大会论坛为启动场合。大赛以2026年7月全面开源的LingBot-VLA 2.0具身智能基座模型为技术底座,面向全球企业、高校和个人开发者开放。赛程包括线上初赛(含RoboTwin 2.0仿真任务与可选真机任务)和11月在上海举行的线下真机黑客马拉松,旨在推动LingBot-VLA在开发
上海具脑磐石科技在2026浦江创新论坛类脑具身智能分论坛发布全球首代类脑认知世界模型 Cog-WM 1.0,基于类脑神经机制与JEPA架构构建隐空间预测模型,覆盖具身导航与操作两大能力。导航任务在HM3D-ObjectNav上成功率由78.50%提升至86.89%,操作任务在三大基准上超越基于海量数据预训练的SOTA(π0.5)最多16%以上,且无需预建地图
该论文提出 Latent Interface Training(LIT),一种与框架无关的两阶段训练策略,用于提升机器人基础模型在视觉分布偏移下的动作泛化能力。第一阶段在不使用图像的情况下,基于语言、机器人状态和末端执行器 SE(3) 位姿训练动作先验;第二阶段引入受位姿监督的潜在接口,作为预训练动作专家唯一的视觉条件通路。在 Pi0.5、MolmoAct2
慕尼黑工业大学(TUM)Angela Dai 教授在 ECCV 2026 分享了一套针对 3D 空间智能的逆向自监督解法,主张不强行克服真实扫描数据的遮挡缺失,而是把物理遮挡机制转化为算法的结构先验。其技术路线包含三个支柱:将物理遮挡转化为逆向自监督(SG-NN)、用几何骨架加 2D 渲染破解均值模糊(Seen2Scene)、以及从生成反哺重构走向机器人主动
Andon Labs 用 Vending-Bench 和 Drone-Bench 两个智能体基准测试 OpenAI 的 GPT-6 Astra。在模拟自动售货机经营中,Astra 六次运行平均结余 15,515 美元,约为 Claude Fable 5.1(5,422 美元)的三倍,并首次登顶 Vending-Bench 2 排行榜。在 Drone-Benc
斜跃智能完成数亿元天使+轮融资,投资方包括线性资本、钧山资本、弘颐资本、隐山资本等。公司由理想前AI首席科学家陈伟与前产品线总裁张骁联合创立,以家庭为第一落地场景,推进Duplex Reasoning范式驱动的具身基础模型。资金将用于具身基础模型训练、算力与数据基础设施建设、核心团队扩充及家庭机器人本体研发和场景验证。