腾讯发布Hy4 preview:770B MoE旗舰模型,支持1M上下文
腾讯混元团队发布了新一代MoE旗舰模型Hy4 preview,总参数770B,激活参数49B,支持1M上下文长度。该模型在软件工程、办公分析、游戏开发和科学研究等领域进行了优化,并与CodeBuddy、WorkBuddy等产品协同设计。内部盲评显示,Hy4 preview在工程任务上略优于GLM 5.3和Kimi K3。模型权重已在Hugging Face、
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 702 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
腾讯混元团队发布了新一代MoE旗舰模型Hy4 preview,总参数770B,激活参数49B,支持1M上下文长度。该模型在软件工程、办公分析、游戏开发和科学研究等领域进行了优化,并与CodeBuddy、WorkBuddy等产品协同设计。内部盲评显示,Hy4 preview在工程任务上略优于GLM 5.3和Kimi K3。模型权重已在Hugging Face、
Hugging Face 于周四发布了售价 399 美元的开放源代码鸭子机器人 Microduck,该机器人高 25 厘米,可蹒跚行走、用喙拾取物品、跌倒后自行站起、蹲下甚至溜冰。CEO Clem Delangue 表示,这是开源、平价机器人时代的开端,旨在普及物理 AI 和世界模型。Microduck 配备摄像头、激光雷达和两个 IMU,其行为可在模拟中训
Hugging Face 旗下 Pollen Robotics 推出第二款可爱 AI 机器人 Microduck,高约 10 英寸,售价 399 美元,现已开放预购,计划于 2026 年圣诞节前发货。该机器人可拾取物品、踢球、滑旱冰,并能用独特生成的声音唱歌,软件开源,用户可重新训练。
另有 1 家信源报道
NVIDIA 以 130 亿美元收购 HuggingFace,约为其 1.5 亿美元 ARR 的 80 倍,较 2026 年 1 月 70 亿美元的报价近乎翻倍。同时,Z.ai 正式发布 GLM-5.3-Flash(即 Ox Alpha),这是一个 320B 总参数、18B 激活参数的 MIT 许可多模态模型,支持 1M 上下文,完全运行在中国 AI 芯片上
Qwen 发布了新的开源权重模型 Qwen3.8-Flash-Next,这是一个多模态 MoE 模型,也是 Qwen4 架构的早期预览。模型总参数为 125B,但仅有 6B 激活,性能显著提升。作者 Simon Willison 在 DGX Spark 上使用 Unsloth 量化版本进行了测试,并分享了初步体验。
Hugging Face Transformers 库发布 v5.16.0,新增多个模型支持,包括 Qwen4-Exp、GraniteSpeech5、Step3p7、CohereCompass 以及 ESMC 和 ESMFold2。这些模型覆盖了混合架构、语音识别、视觉语言、蛋白质语言与折叠等领域,提升了 Transformers 对前沿模型的支持能力。
汤森路透基于阿里Qwen开源模型推出自研大模型Thomson-1,旨在降低对Claude等闭源模型的依赖和成本。该模型将用于表格分析、文档审核等专业工作,并逐步承接部分Claude任务。此外,Airbnb和Pinterest等公司也转向使用Qwen模型,Qwen已成为全球第一开源模型家族。
商汤科技正式开源了8B参数的生图模型SenseNova U1.5 Lite,该模型支持4K直出、长指令遵循、原生图像编辑和复杂布局,在多个核心场景上比肩闭源GPT-Image-2。模型采用NEO-unify统一多模态架构,通过多教师在线策略蒸馏技术MOPD将专项能力融合回单一模型,强调稳定性、指令遵循和编辑精度,旨在进入真实创作流程。
DuckDB Labs 发布了代号为 Cyanoptera 的 v2.0 预览版,该版本引入原生客户端/服务器模式,通过 quack 协议和 CONNECT 语句支持网络连接,并扩展了分布式拓扑能力。同时,v2.0 重构了扩展系统,提供稳定的 C API 和 ABI 保证,支持自定义扩展仓库,并完善了 VARIANT 类型、异步 I/O 等性能优化。社区反响
Apodex AI 发布了 Apodex 1.1 模型系列,通过扩展可执行环境和训练智能体协调长周期任务,提升复杂现实任务的持续可验证进展。该模型在专业工作、金融、科研等领域达到领先水平,并开源了 FrontierAgent 工作台和 Apodex 1.1 Mini 模型权重。
原力灵机发布具身智能模型DM0.5,登顶RoboDojo基准测试,综合得分24.90,平均成功率19.34%,并在记忆任务中表现突出。该模型在LIBERO、RoboTwin 2.0等多个评测中取得领先,并已全面开源,包括模型权重、训练框架和下游工作流。DM0.5通过长记忆、具身思维链和高效推理优化,实现了9.29倍加速,旨在推动具身智能生态发展。
据 Business Insider 报道,AI 模型托管平台 Hugging Face 已收到以 130 亿美元或更高估值出售的接洽,目前正在与银行合作评估竞标,但尚未达成协议。该公司最近成为 OpenAI 系统安全评估期间逃逸并入侵其服务器的攻击目标。Hugging Face 上一轮融资估值为 45 亿美元,CEO 表示公司接近盈利,并强调对社区的长期责
llama.cpp 发布 b10610 版本,主要更新为缩短 CUDA 和 Metal 后端中虚拟设备的命名,并优化了 Metal 设备描述在初始化时的构建。该版本提供了适用于 macOS、Linux、Windows、Android 等多平台的预编译二进制文件,涵盖 CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL 等后端。
汤森路透投资约4000万美元,基于阿里巴巴的Qwen开源模型构建了自有法律AI模型“Thomson”,并利用公司内部数据和领域专家进行训练。测试显示,Thomson在访问公司专属内容时能超越GPT-5.4等竞品,但在推理和编码方面表现较弱。公司计划将Thomson用于文档审查等高频任务,并发布小版本模型供非商业使用,以降低成本并保持独立性。
Cloudflare 开源了其企业 AI 平台 Cloudflare OS,该平台基于能力模型,为每个用户提供独立的沙箱化应用实例,支持非技术用户通过生成式 AI 定制工作软件。平台通过 Gatekeeper 系统实现细粒度权限控制,确保安全。Cloudflare 内部员工已使用该平台,30 天内构建了 4000 多个工具,并显著提升了效率。
llama.cpp 发布 b10593 版本,主要修复了 DeepseekV4 在多序列场景下的回滚问题,并进行了模型加载修复、缓存清理优化和图拓扑静态化等改进。该版本提供了覆盖 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,支持 CPU、Vulkan、CUDA、ROCm、OpenVINO、SYCL 等多种后端。
Hugging Face 上发布了 Mistral-Nemo-Instruct-heretic,这是 Mistral-Nemo-Instruct-2407 的去审查变体,通过 Heretic 工具进行方向消融(abliteration)而非微调,抑制了模型的拒绝行为,同时保留了基础模型的能力。该模型提供多种 GGUF 量化版本,可在消费级 GPU 上运行,但
在2026世界机器人大会期间,星海图举办了“从模型到生产力”论坛,发布了G0.5基础模型升级、Fast-WAM世界模型预训练计划及G-Fleet分布式强化学习系统,并推出新一代轮式双臂机器人Nexo等整机产品。公司已交付千台级订单,明年目标万台以上,同时启动G0.5复现计划以推动开源生态。论坛圆桌讨论聚焦具身智能的商业落地与技术挑战,强调生态协作与数据、因果
DavidAU 发布了 Qwen3.6-40B-Fable-Fusion-6-Core-Deckard-Eleanor-Heretic-Uncensored-NM-DAU-NEO-MAX-MTP-GGUF,这是一个基于 Qwen 3.6 的 40B 参数多阶段微调模型,据称在 8 位和 4 位量化下达到闭源模型(如 OpenAI、Claude)的智能水平。该
英伟达发布新研究,表明在长时程任务中,AI 的“支架”(harness)比底层模型更重要。通过定制支架并引入“监督者”组件,英伟达让 Claude Opus 5 在 ARC-AGI-3 基准上达到 100% 得分,而无支架时仅 30%。该研究强调开放支架系统对用户控制和安全性的重要性,并呼应了 OpenAI 和 Databricks 的相关发现。