考拉悠然无界世界模型登WorldArena 2.0全球第二,两项指标第一
考拉悠然旗下悠然无界世界模型在9月16日揭晓的WorldArena 2.0全球终榜中,于Track 1视频质量赛道综合得分位列全球第二,并在Background Consistency与JEPA Similarity两项核心指标中排名第一。该评测汇集阿里巴巴、中国科学院等机构的80个模型。考拉悠然采用结构化4D世界建模与动态场景记忆技术,并将该模型与Geek
公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14
考拉悠然旗下悠然无界世界模型在9月16日揭晓的WorldArena 2.0全球终榜中,于Track 1视频质量赛道综合得分位列全球第二,并在Background Consistency与JEPA Similarity两项核心指标中排名第一。该评测汇集阿里巴巴、中国科学院等机构的80个模型。考拉悠然采用结构化4D世界建模与动态场景记忆技术,并将该模型与Geek
DeepBeepMeep 在 Hugging Face 上发布了 Wan2.1 视频生成模型的单文件版本,基于 Wan-AI/Wan2.1-T2V-1.3B,用于配合其开源项目 WanGP 使用。WanGP 支持 Wan、Hunyuan Video、Flux 1 & 2、Qwen、Z-Image 和 LTV 等视频生成模型,主打低显存需求(最低 6GB 即可
Moonshot AI 的 Kimi K3 模型在 Amazon Bedrock 上线,据 Moonshot AI 称这是其最强模型,也是首个达到 2.8 万亿参数的开源模型,具备原生视觉能力和 100 万 token 上下文窗口,相比 Kimi K2 扩展效率提升约 2.5 倍。Kimi K3 是 Bedrock 上首个支持显式提示缓存的开源权重模型,可降
AWS Machine Learning Blog 介绍如何用编码代理(Kiro、Claude Code)在 Amazon SageMaker AI 上部署 Hugging Face 模型。文章指出无引导的代理会因部署知识过时而选错服务容器(如 TGI 无法加载 Qwen3),导致健康检查失败和 GPU 浪费;为此 Hugging Face Skills 提
智谱于9月13日晚间公告完成约50亿美元融资,包含约20亿美元股份配售及约30亿美元可转债发行,资金主要投向模型研发与算力基础设施。文章梳理了智谱从GLM-4.6到GLM-5.3约两个月一次的迭代节奏,以及上半年收入9.54亿元、同比增长399.7%的商业化进展,并分析其下一代GLM研发、完全自训练(Fully Self-Training)路线与国产算力布局
Steve Yegge 关闭了 Gas Town 项目,承认尽管每月花费数千美元订阅编码代理,却只用它构建了 Gas Town。Databricks 报告称约 3500 名工程师切换到 GPT-6 Astra 后,整体编码支出增加约 60%,尽管 Astra 在复杂长周期任务上表现优于 Opus 5 和 Sol 5.6。OpenAI 发布了模型失准事件披露框
DeepBeepMeep 发布了 LTX-2 视频模型,用于其 WanGP 工具,该工具支持多种开源视频生成模型,包括 Wan、Hunyuan Video、Flux 1 & 2、Qwen、Z-Image 和 LTV。WanGP 旨在降低视频生成的硬件门槛,支持低至 6GB 显存和旧款 GPU,并提供 Web 界面、自动下载模型、Lora 支持等功能。
杭州AI蛋白质设计公司力文所发布Lévin™ Harness,一款面向科研社区的Agent工作台,将数据、模型、插件工具、算力和工作流整合到同一环境,支持蛋白质结构预测、序列设计等任务,并允许用户通过插件接入自有模型与算力。该产品旨在解决AI for Science中模型之外的流程衔接问题,让Agent组织科研闭环。力文所此前自研全原子蛋白质生成模型Pall
Salesforce 在 Dreamforce 大会上发布首个推理模型 Koa,基于 Nvidia 开源权重模型 Nemotron 后训练而成,专攻销售、营销和客服任务。Koa 以开源权重、不摄入客户数据、token 消耗更少等特性,作为 Agentforce 平台中 Claude、ChatGPT 等前沿模型的替代选项。Salesforce 高管称此前缺乏具
另有 1 家信源报道
无问芯穹联合清华大学、上海交通大学正式开源具身智能端侧推理引擎APXInf,支持RTX 4090、Jetson Orin、Jetson Thor等平台,覆盖模型开发到机器人本体部署的完整链路。APXInf将PI 0.5 FP8在Jetson Thor上的端到端推理延迟从278ms降至26ms以内,达到38.46Hz推理频率,并采用Rust极简运行时加Pyth
另有 1 家信源报道
该研究系统比较了混合专家(MoE)与稠密LLM作为一阶段检索器的效果与效率。在相同训练流程下,MoE检索器在BEIR上比激活参数量相当的稠密模型高1.4–3.0 nDCG@10,其中一个MoE检索器以少59%的激活参数和低18%的查询编码时间匹配8B稠密检索器。研究还表明,无需重训练或重建索引即可减少查询编码使用的专家数,保留99%以上效果并将查询编码时间最
Arm在Arm Everywhere China年度大会上发布Neoverse CSS N4平台,并展示Arm AGI CPU在中国生态的进展。Arm称AGI CPU在同等性能下TDP为300瓦,而x86方案通常为500瓦,可缓解数据中心电力与机架空间压力。同时Arm上线Arm AI Portal开发者平台,首批预优化模型包括通义千问、Google Gemm
llama.cpp 发布 v0.4.1,新增 Maple 20B-A1B 三元 MoE、腾讯 Hy 4 预览版和 Spark2.5 模型支持,并改进 JSON schema 处理、聊天解析、日志和服务器子进程管理。核心变更包括修复 DeepSeek2、GLM-MoE 等模型的 MTP KV 缓存分配,以及 Qwen/Kimi/GLM 的 GDN 归一化问题。
NVIDIA 技术博客介绍如何利用 JAX 和 NVIDIA Transformer Engine 加速无丢弃(dropless)MoE 训练。文章指出 MoE 训练面临动态路由、不规则张量、all-to-all 通信等瓶颈,在 DeepSeek-V3 于 GB200 上的基线仅 103 TFLOPS/GPU,通信占内核时间 84%。通过 Transform
Perplexity 将其本地智能体 Perplexity Computer 的便携版本 Portable Computer 扩展到 Windows 平台,支持配备 24GB 及以上显存的 NVIDIA GeForce RTX 和 RTX PRO 显卡。该版本由 NVIDIA GPU 加速,使用本地模型(如 Qwen 3.8 27B)在设备端分析数据、整合文
Hugging Face 用户 gbuzhf 发布了 Ornith-1.5-35B-A3B 的 abliterated(去审查)GGUF 量化版本,基于 huihui-ai 的 abliterated 权重,提供 19G/21G/23G/25G 四档 ICE 量化及 BF16 主模型。该版本使用 27,513 条全语料重要性矩阵校准,并嵌入模型自带的 MTP
一位作者在 Hugging Face 博客中回顾自己从使用 ChatGPT 转向开源模型 DeepSeek 和 Qwen 的经历,并分享了自己尝试训练超小模型(如 Single Floppy、floppyx3、floppyx4)的失败过程。作者认为开源模型可检查内部机制,比闭源服务更可信,并提到因图书馆屏蔽 DeepSeek 而短暂使用 Claude,但受限
9月12日,杭州云谷学校与《三联生活周刊》在上海外滩大会举办教育专场论坛,主题为“认知增强,还是认知外包?——AI时代的教育选择”。清华大学汪民安、北京大学汪琼、阿里鲁肃、策展人陆蓉之等嘉宾围绕AI与人的边界、认知懒惰、师生如何使用AI展开激辩。论坛最后发起“教育AI使用说明书”倡议,主张AI进入基础教育应像药品一样标注“副作用与禁忌”,明确谁在用、解决什么
AgentionAI 在 Hugging Face 发布了 Qwen/Qwen3.8-Flash-Next 的 Agention Precision (AP) GGUF 量化版本,兼容主线 llama.cpp,无需 fork。该系列提供从 AP-Q5 K XL 到 AP-IQ2 S 共 7 个量化档位,按每 GiB 显存精度优化,并给出各档位的 KL 散度与
Interconnects AI 作者 Nathan Lambert 发布并持续更新一份关于开源 AI 与开放模型的阅读清单,汇总近几年的代表性文章。清单按基础概念、中美竞争、技术细节等主题组织,涵盖开放模型的定义、发布动机、商业战略、安全风险、数据缩减以及中国模型(如 Kimi K3、GLM-5.2)对生态的影响。文中还提到西方公司采用中国模型引发监管关注