中国出现AI循环融资模式,宇树科技IPO估值500亿美元
中国机器人制造商宇树科技在上海IPO后估值约500亿美元,股价大涨。据英国《金融时报》报道,其需求依赖循环模式:制造商向国有培训中心出售机器人,再购回训练数据。分析师质疑高估值和数据实用性,宇树近四分之三的人形机器人收入来自教育和研究领域。
公司与模型 · DeepSeek(深度求索)的模型发布、开源权重与技术报告——开源大模型价格与能力的搅局者
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 19:03
中国机器人制造商宇树科技在上海IPO后估值约500亿美元,股价大涨。据英国《金融时报》报道,其需求依赖循环模式:制造商向国有培训中心出售机器人,再购回训练数据。分析师质疑高估值和数据实用性,宇树近四分之三的人形机器人收入来自教育和研究领域。
雷峰网报道了开源项目J-Space Cognition Suite被指造假,其宣称通过外部Harness让小模型追平甚至超越顶级大模型,但独立复测结果相反。OpenAI思维链发明者Jason Wei发文指出小模型加工具无法替代大模型的内化能力,引发行业对Scaling Law与工程路线的讨论。
中国允许英伟达H200芯片小批量进入大陆,字节跳动和腾讯各获得约1万颗,以帮助国内AI企业追赶美国。H200比英伟达最先进芯片落后至少两代,因美国出口管制无法购买更先进的。中国还支持华为等本土制造商,但国内AI公司在推理能力上仍落后于美国,且需求激增导致部分公司如Moonshot不得不拒绝客户。
本文以GLM-5为例,探讨九章智算云如何通过强化学习系统实现训推一致。文章指出,随着预训练边际收益递减,模型能力Scaling正转向后训练强化学习,RL成为模型能力持续提升的关键。九章智算云通过将Generator、Environment和Trainer纳入统一工作流,实现动态调度和状态资源化,提升有效Token产出率,并与模型厂商形成算法与基础设施双向RL
小米发布2026年第二季度财报,营收约1089亿元,同比下降6.1%,经调整净利润约62亿元,同比下降42.6%。智能电动汽车及AI等创新业务收入同比增长17.1%至249亿元,但经营亏损26亿元,仍处于战略投入期。小米在AI领域密集发布多项技术,包括MiMo大模型、MiMoCode、澎湃OS 4、超级小爱2.0及具身智能模型,同时手机高端化战略见效,ASP
支付公司 Stripe 以 70 亿美元收购 AI 模型路由平台 OpenRouter,交易在 90 天前其 13 亿美元 B 轮融资后完成。OpenRouter 年化收入 1.4 亿美元,毛利率约 70%,月处理 250 万亿 token,拥有 800 万开发者。该交易凸显模型聚合层的价值,但也引发对中间层利润压缩的担忧。
Nvidia 正大力投资近乎开源的模型(如 Nemotron),通过发布训练数据和代码,鼓励更多公司构建自己的模型,从而扩大对其芯片的需求。文章指出,开源模型生态的未来取决于能否形成经济回报闭环,否则可能转向效率优先的细分市场。同时,训练复杂度的提升和开源社区对后训练的关注,可能改变传统训练流程的划分。
美团LongCat团队开源了搜索智能体评测基准LoHoSearch,基于覆盖762万维基百科实体的知识图谱自动生成题目,通过控制搜索空间和结构复杂度来提升难度。评测显示,最强模型GPT-5.5准确率仅34.74%,远低于在BrowseComp上的表现,且现有上下文管理策略提升有限。该基准旨在提供更具区分度的评测标准,并推动下一代上下文管理技术研究。
魔搭 ms-swift 发布 v4.5.0 版本,新增对 Qwen3.8、NVIDIA Nemotron 3.5 Lightning 和 Meta Muse Glimmer 等模型的支持,并改进推理、训练和 RLHF 功能。该版本还修复了多个 bug,并支持 OpenAI 和 Anthropic 消息处理器。
谷歌在DeepMind换帅后开始拆分其非技术团队,将其划归公司总部,以减少中间环节并加速Gemini进入产品。联合创始人谢尔盖·布林重新介入AI权力中心,推动资源向递归自我改进等方向倾斜。新负责人Koray Kavukcuoglu获得最终决策权,成为Gemini发展的核心人物。Gemini发布已推迟两个月,内部测试显示其编码能力落后于竞争对手,谷歌面临组织问
智谱发布GLM-5.3模型,在基座不变的情况下,通过后训练技术使编程能力提升50%,并宣称在安全领域发现2436个漏洞,包括潜伏40年的DNS协议漏洞。该模型在多个评测中逼近或超越Claude Fable 5,并开源,同时推出编程工具ZCode和AutoClaw。
智谱今日发布GLM-5.3模型,在Coding能力上接近Claude Fable 5,并成为最强开源安全模型。该模型在CyberGym白盒代码审查中得分84.5%,高于前代及GPT-5.6 Sol。智谱联合清华、南开等机构进行了密集红队测试,累计发现2404个漏洞,其中1088个为中高危。实测显示GLM-5.3能完成可交付的模拟游戏开发,并能自主发现、修复安
本研究针对量化混合专家模型(MoE)中的路由翻转问题,提出了一种因果分析框架,并发现检测路由翻转比判断其是否需要修复更容易。实验表明,在4位KV缓存量化下,约三分之一的性能损失由路由中介引起,但现有推理可观测的统计量无法预测翻转的损失符号,存在经验性的收益检测障碍。研究还发现参考保真度的修复效果因架构而异,且门控归一化约定仅影响损伤幅度而非路由可恢复性。
本文提出一种在笔记本电脑上模拟大规模LLM智能体社会的低成本方法,用低参数代理模型替代昂贵的大模型智能体,并引入交互顺序记忆分类法预测替代误差趋势。作者在EconAgent等八个LLM模拟上验证了该方法,发现EconAgent对奥肯定律的复现实为会计恒等式,而菲利普斯曲线才是真正的行为特征。该方法使宏观模拟成本大幅降低,并揭示了推理步骤而非提示词措辞是涌现宏
蚂蚁集团旗下 inclusionAI 发布了开源模型 Ling 3.0 Flash,在 Artificial Analysis 智能指数上得分 38,与其前身相比大幅提升,与 Qwen3.6 27B 相当,但活跃参数更少。该模型在幻觉率上显著下降,从 97% 降至 44%,并在代理任务上表现强劲。Ling 3.0 Flash 以 MIT 许可证发布,可通过
Backtrader-Bench 是一个用于评估 LLM 智能体在算法交易中能力的基准框架,包含确定性 MCQ 管道和生成器-求解器过滤管道,可自动生成并验证问题。在 30 道精选题目上,工具增强的智能体(如 GPT-5.5 和 Opus 4.7)单次准确率达 90.0%,比最佳无工具基线(73.0%)高出 17 个百分点。该框架旨在生成训练语料,用于强化学
AWS 在 SageMaker HyperPod 上推出分层 KV 缓存架构,结合 Curvine 分布式缓存文件系统,将 KV 缓存从 GPU 扩展到 CPU 和共享 NVMe 池,实现跨副本缓存复用。测试显示,该方案可将跨 Pod 缓存命中率提升至 100%,TTFT 改善最高达 2.7 倍,并允许在更低成本的 G6e 实例上运行原本需要 P5 实例的工
英伟达正在开发新一代开源权重模型 Nemotron 4,其最大版本参数规模至少达一万亿,是 Nemotron 3 Ultra 的两倍,最早可能于今年秋季发布。为此,英伟达已将其用于内部模型训练的云支出增加至 2031 年的 280 亿美元。尽管规模庞大,但中国实验室已超越这一水平,如 Moonshot AI 的 Kimi K3 有 2.8 万亿参数,Deep
本文是Hugging Face博客关于2026年前沿模型训练方式的补充材料,梳理了OpenAI、DeepSeek、Meta等实验室在强化学习(RL)后训练中的公开做法。文章指出,可验证奖励(RLVR)已成为主流,GRPO算法被广泛采用但多有修改,且RL正从单答案转向环境交互。作者通过引用各实验室报告,展示了这些模式如何贯穿从7B模型到前沿系统的训练流程。
AMD宣布收购AI推理芯片公司Taalas,计划将其技术纳入加速器路线图。Taalas采用模型硬化路线,将模型权重固化进硬件,以降低推理成本和提高速度,首款芯片HC1运行Llama 3.1 8B时生成速度达1.7万Token/s。该路线面临模型迭代风险,但Taalas通过可编程SRAM和掩膜修改应对。业内专家认为,AMD此举如同购买拖拉机,其价值取决于是否存