阿里云韩国第三座数据中心上线,推出Agentic AI服务
阿里云在韩国第三座数据中心正式上线,并推出Agentic AI相关服务,以满足当地AI及云计算需求。本轮扩建后,阿里云全球基础设施覆盖30个地域、104个可用区,并计划拓展至巴西。阿里云在亚太云计算市场排名第一,Qwen模型家族全球下载量超20亿次,衍生模型超30万个。韩国AI公司Gendive和Naver旗下Zepeto已采用阿里云相关服务。
公司与模型 · 阿里通义千问 Qwen 系列的开源发布与迭代:从旗舰模型到端侧小模型的全谱系
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 18:14
阿里云在韩国第三座数据中心正式上线,并推出Agentic AI相关服务,以满足当地AI及云计算需求。本轮扩建后,阿里云全球基础设施覆盖30个地域、104个可用区,并计划拓展至巴西。阿里云在亚太云计算市场排名第一,Qwen模型家族全球下载量超20亿次,衍生模型超30万个。韩国AI公司Gendive和Naver旗下Zepeto已采用阿里云相关服务。
VibeWorlding 是一个用于基准测试和训练多模态智能体的统一框架,旨在从用户查询端到端构建交互式 3D 开放世界。该框架包含 VWE-BENCH 基准(含 2,616 个 3D 资产、323 个种子世界和 6,828 个查询)和 VibeWorlding-Gym 强化学习训练环境。实验表明,当前前沿多模态大模型(如 GPT-5.5 和 Qwen3.8
DeepBeepMeep 发布了 WanGP,一个开源视频生成工具,支持 Wan、Hunyuan Video、Flux 1 & 2、Qwen、Z-Image 和 LTV Video 等模型,最低仅需 6GB 显存,兼容旧 GPU,并提供 Web 界面、Lora 支持、队列系统等功能。该工具旨在让低配置用户也能使用先进的视频生成模型。
阿里云官方AI博客发布了一篇关于Tair KVCache仿真分析的技术文章,详细介绍了LLM推理性能模拟系统的设计与实现。文章分析了推理引擎的架构、调度策略及计算模型,并提出了高精度模拟远端KVCache配置对推理性能影响的方案。该方案旨在通过CPU平台快速预测不同配置下的TTFT、TPOT等关键指标,为推理系统优化提供决策依据。
BatiAI 发布了 Qwen3.6-27B 的 GGUF 量化版本,该模型基于阿里巴巴 2026 年 4 月 22 日开源的 Qwen3.6-27B 稠密模型,支持多语言、多模态和 262K 上下文。量化版本针对苹果芯片优化,提供多种量化等级,可在 Ollama 上运行,并宣称在智能体编码基准上媲美或超越 Qwen 3.5-397B-A17B MoE 模型
阿里千问于8月14日晚正式开源Qwen3.8系列模型,其中Qwen3.8-27B为原生多模态稠密模型,仅270亿参数,性能超越Qwen3.7-Plus,在编程和办公场景表现出色,支持消费级显卡量化部署,采用Apache2.0协议。此前旗舰模型Qwen3.8-Max也已开源权重。阿里累计开源460余个模型,Qwen全球下载量超30亿次,衍生模型超30万个,稳居
中国AI初创公司智谱AI发布了GLM-5.3模型,声称其是最强大的开源权重编码模型,所有改进均来自扩展的后训练。该模型在基于代理的任务上表现突出,并在网络安全方面通过训练发现软件漏洞,共发现2436个漏洞。GLM-5.3现已通过GLM编码计划提供,权重将在两周后开源。
IJCAI 2026 将于 8 月在德国不莱梅举行,中国机构论文贡献比例未因 CCF 评级下调而下降,反而在知识表示、规划等符号推理方向占比显著。中国企业如蚂蚁、美团、京东、腾讯等虽未赞助,但深度参与技术研究,聚焦可解释性、组合优化、逻辑强化学习等方向。会议风向标包括多智能体协作、神经符号计算和可解释性安全,反映产业界从参数竞赛转向逻辑攻坚。
荣耀于2026年8月12日发布全球首款机器人手机荣耀Robot Phone,该手机配备四自由度钛合金灵巧云台和系统级Agent架构,支持多模态具身交互。荣耀与ARRI合作引入电影级影像技术,并搭载第五代骁龙8至尊版平台,售价9999元起。该产品旨在推动AI终端从数字智能迈向具身智能,开启人机伙伴关系新阶段。
AWS 在 SageMaker HyperPod 上推出分层 KV 缓存架构,结合 Curvine 分布式缓存文件系统,将 KV 缓存从 GPU 扩展到 CPU 和共享 NVMe 池,实现跨副本缓存复用。测试显示,该方案可将跨 Pod 缓存命中率提升至 100%,TTFT 改善最高达 2.7 倍,并允许在更低成本的 G6e 实例上运行原本需要 P5 实例的工
本文是Hugging Face博客关于2026年前沿模型训练方式的补充材料,梳理了OpenAI、DeepSeek、Meta等实验室在强化学习(RL)后训练中的公开做法。文章指出,可验证奖励(RLVR)已成为主流,GRPO算法被广泛采用但多有修改,且RL正从单答案转向环境交互。作者通过引用各实验室报告,展示了这些模式如何贯穿从7B模型到前沿系统的训练流程。
本研究通过进化迭代囚徒困境实验,比较了四款中国前沿大模型(DeepSeek V4 Pro、Qwen3-Max、Kimi K2.5、GLM-5.1)的合作倾向。研究发现,这些模型并非铁板一块,实验室间差异显著,且中国模型内部的差异大于中国与西方生态系统之间的平均差异。研究还发现,中国模型的合作倾向普遍性较弱,但这一结论受转换器选择影响。
本期资讯涵盖多个AI相关动态:DeepSeek回应了用户被取外号的争议,解释为临时对话标签;千问办公助理推出收费服务;DeepSeek-V4-Flash正式版周调用量全球第一;英伟达计划筹集5000亿美元用于AI基建;扎克伯格呼吁美国放宽开源AI限制。此外,还包括携程反垄断罚单、苹果测试长鑫存储芯片、宇树科技IPO等商业新闻。
Meta CEO 马克·扎克伯格发布长篇宣言《未来属于每个人》,阐述其对超级智能 AI 发展的愿景,包括推动数据中心建设、开放 AI 模型、呼吁减少政府监管但加强网络安全合作。该宣言旨在塑造 Meta 作为负责任 AI 领导者的形象,并影响公众和政策制定者。
Meta 发布了 30B 参数的开放权重模型 Muse Glimmer,采用 Apache 2.0 许可,可在消费级 GPU 上本地运行,并在多数基准测试中优于同类竞品。扎克伯格同时发表文章,捍卫模型蒸馏的合法性,并呼吁美国在开放模型领域保持领先。Meta 计划未来几周发布更强模型 Muse Spark 1.2 的开放权重版本,并考虑通过云业务变现其数据中心
另有 2 家信源报道
Hugging Face 团队发表论文,提出两种系统优化方法:离线缓存教师模型的 Top-K logits,以及融合分块 KL 损失,以大幅降低大语言模型知识蒸馏的显存占用和训练成本。该方法使长上下文蒸馏可在单 GPU 上运行,并支持大规模实验。
DeepBeepMeep 发布了 WanGP,一个开源视频生成工具,支持 Wan 2.2 等模型,最低仅需 6GB 显存,兼容旧 GPU,并提供 Web 界面、Lora 支持等功能。该工具旨在降低视频生成门槛,使更多用户能够使用高质量开源模型。
Hugging Face 博客发布了一篇技术文章,介绍如何通过分析公开的模型配置文件(config.json)、分词器(tokenizer)和权重(embedding CKA)来客观判断一个大型语言模型是从零训练还是基于开源基础模型衍生而来。文章指出,架构指纹和分词器重叠是主要证据,而权重相似性因旋转不变性等原因不可靠。作者将该方法应用于韩国九个组织的公开基
xAI 发布了 Imagine Image 2.0 模型,作为 Grok 平台的新“质量模式”,提供精细指令遵循、排版布局优化和跨生成一致性。该模型在 Arena 基准测试中排名第二,仅次于 OpenAI 的 GPT-Image-2。新模型包含 Magic Wand、区域分割、背景移除、多参考编辑和智能调整大小等编辑工具,并推出模板和视频预制作功能。API
字节跳动创始人张一鸣在Seed全员会上明确拒绝通过蒸馏方式追赶前沿大模型,坚持从头训练以追求长期技术主权。尽管字节在算力、数据和资金上具备优势,其Seed 2.1 Pro在全球榜单仅列第21位,落后于其他中国模型。字节计划训练10万亿参数的超大模型,并投入超2000亿元建设算力基础设施,以规模跃迁实现技术领先。