Import AI 470:机器无权利;SPADE 自动化环境生成;Hawkeye 优化 GPU 内核
METR 的研究显示,AI 在网络安全领域显著加速了漏洞发现,在数学领域贡献有限,而在 AI 研究本身未见明显加速。SPADE 框架通过自博弈生成可执行环境,用于训练 LLM,在 30B 规模模型上提升了基准表现。
公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14
METR 的研究显示,AI 在网络安全领域显著加速了漏洞发现,在数学领域贡献有限,而在 AI 研究本身未见明显加速。SPADE 框架通过自博弈生成可执行环境,用于训练 LLM,在 30B 规模模型上提升了基准表现。
汤森路透投资约4000万美元,基于阿里巴巴的Qwen开源模型构建了自有法律AI模型“Thomson”,并利用公司内部数据和领域专家进行训练。测试显示,Thomson在访问公司专属内容时能超越GPT-5.4等竞品,但在推理和编码方面表现较弱。公司计划将Thomson用于文档审查等高频任务,并发布小版本模型供非商业使用,以降低成本并保持独立性。
Hugging Face 上发布了名为 Qwen3.8-27B-OBLITERATED 的模型,基于 Qwen3.8-27B 进行去审查(abliteration)处理,旨在消除安全拒绝和说教式回应。V3 版本通过迭代细化和定向语料库,在 MMLU 上仅下降 2.1 个百分点,同时实现了对受限查询的真实回答,并在代码生成任务中表现良好。该模型提供 GGUF、
香港大学副教授张富创立硅羽科技,致力于开发不依赖GPS和飞手遥控的空中智能体,将具身智能从地面拓展到空中,用于危险环境作业。公司半年内完成四轮融资,累计数亿元,投资方包括阿里巴巴等。硅羽科技计划年底量产第一阶段产品,并利用Real-to-Sim技术解决数据稀缺问题。
DavidAU 发布了 Qwen3.6-40B-Fable-Fusion-6-Core-Deckard-Eleanor-Heretic-Uncensored-NM-DAU-NEO-MAX-MTP-GGUF,这是一个基于 Qwen 3.6 的 40B 参数多阶段微调模型,据称在 8 位和 4 位量化下达到闭源模型(如 OpenAI、Claude)的智能水平。该
Hugging Face 博客作者发布了新的 imatrix 校准数据集,并详细介绍了与 LTT Labs 团队合作进行的实验,测试不同数据集对量化模型性能的影响。实验发现,在低比特量化(如 Q2 K)下,imatrix 数据集的选择对 MoE 模型性能影响显著,但对高比特量化影响不大。作者公开了数据集和渲染脚本,并计划继续迭代。
阿里最新财报显示,阿里云营收达487.37亿元,同比增长45%,经调整EBITA同比增长133%,利润率升至11.6%。增长主要来自AI算力需求激增和MaaS收入增加,同时自研芯片出货和全栈优化提升利润。阿里全栈AI布局使其在商业化中更具优势,云厂商成为AI浪潮中的受益者。
阿里巴巴高德地图团队提出SceneGTMM框架,一种基于共形映射的场景感知可迁移GNN-Transformer双图交互地图匹配方法。该框架通过共形映射场景相对策略、GNN-Transformer双图交互架构和CRF增强结构化预测,在跨区域迁移和噪声鲁棒性上取得突破。实验表明,在定位误差16-50米的多源轨迹数据上,准确率超过80%,比传统HMM提升5.3%,
THE DECODER 的 Frontier Radar 第四期指出,中国 AI 模型如 Kimi K3 和 GLM-5.3 已接近美国顶尖模型水平,西方实验室指责中国通过蒸馏和刷分追赶,但模型领先优势难以维持。西方在抽象测试、可靠性和前沿领域仍有优势,但整体领先已转向系统层面。文章还提到欧洲在 AI 竞赛中落后。
Unsloth 发布了基于 Qwen3.8-27B 的 GGUF 量化模型,采用 Dynamic V3.0 技术,宣称在精度和量化性能上优于其他量化方案。Qwen3.8-27B 是 Qwen 系列最新开源模型,具备原生视觉语言理解、灵活思考控制、长上下文(262K 原生,可扩展至 1M)和增强的智能体执行能力。该模型支持在 Unsloth Desktop 中
malaiwah 发布了 Qwen3.8-27B 的 EXL3 量化版本,其中注意力权重在磁盘上以 K6 精度序列化,相比 BF16 注意力版本,下载体积减少 29%,冷启动速度提升 5.4 倍,且与 BF16 的 KL 散度更低。该模型需要特定的 Gilded Gnosis vLLM 分支才能运行,属于实验性研究产物。
诺基亚计划关闭杭州研发中心并裁员1600人,因中国业务持续下滑。DeepSeek API峰谷定价方案生效,高峰时段价格翻倍。苹果与阿里合作深化,阿里参与训练面向中国市场的更强模型。Claude出现大规模服务故障,影响Claude.ai、Claude Code等服务。
AtomicChat 发布了 Qwen3.8-27B 的 GGUF 量化版本,基于 Qwen 原始权重并使用自己的重要性矩阵进行量化。该模型支持文本生成和多模态(图像)输入,提供了多种量化级别,并附有详细的量化分析、运行指南和速度测试。用户可通过 llama.cpp 或 Atomic Chat 应用本地运行该模型。
Ollama 发布了 v0.32.14 版本,主要修复了 llama-server 对 WebP 图像的转码问题,并让 Qwen 渲染器能容忍非开头的系统消息。该版本更新了变更日志,用户可通过 GitHub 查看完整变更。
LuffyTheFox 发布了基于 Qwen3.6-35B-A3B 的未审查多模态 MoE 模型 GGUF 版本,名为 Genesis Hermes V7。该模型通过其自研的 Genesis 算法对张量进行噪声修复,并融合了 Hermes 微调数据,旨在提升模型稳定性和指令遵循能力。模型支持多语言和视觉任务,并提供了量化脚本和推荐配置。
据路透社报道,苹果与阿里巴巴合作,为中国市场训练了一款定制AI模型,这标志着苹果在华策略的转变,从使用国内模型转向自主开发。该模型将在未来几个月内随iOS系统更新推出,苹果已向中国网信办注册该服务。此举使苹果成为首家获准在华提供专有AI模型的美国公司。
阿里巴巴发布了其最大的开源权重模型 Qwen3.8-2.4T-A95B(Qwen3.8-Max),总参数达 2.4T,每个 token 激活 95B 参数,采用细粒度 MoE 架构和全注意力与线性注意力混合设计,支持百万 token 上下文。NVIDIA 宣布该模型可在 GB300 NVL72 平台上以 FP8 精度实现每 GPU 每秒超 4K tokens
llama.cpp 发布 b10375 版本,主要更新为收紧 Qwen 模型的 bare function 解析逻辑。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,并支持多种硬件加速后端。
DavidAU 发布了 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF 模型,这是基于 Qwen3.6-27B 的多阶段微调模型,据称在 8 位和 4 位量化下 ARC-C 得分均超过 700,达到闭源模型水平。该模型在 7 项基准测试中 6 项超过基础模型,并支
该研究提出无监督在线策略自蒸馏方法(U-OPSD),仅利用模型自身生成和内部一致性(多数投票)构建伪解决方案,无需外部监督即可纠正模型自信的错误。在多个数学推理基准上,U-OPSD 在 Qwen3 非思考模式下相比基础模型提升 8.5% 和 10.7%,并优于或持平于有监督方法 OPSD 和 GRPO。代码已开源。