2026蚂蚁InTech奖揭晓:申报量增近4倍,三年投1亿扶持创业
2026蚂蚁InTech奖在外滩大会揭晓,10位青年科学家获科技奖(每人20万元),10位中国籍在读博士生获奖学金(每人5万元)。本届聚焦AGI、具身智能、数字医学、数据处理与安全隐私四大方向,申报量较首届增长近4倍。蚂蚁集团同时宣布未来三年投入1亿元扶持获奖者创业项目。
技术方向 · 训练侧的门道:数据集构建、合成数据、预训练与后训练方法 · 共 549 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
2026蚂蚁InTech奖在外滩大会揭晓,10位青年科学家获科技奖(每人20万元),10位中国籍在读博士生获奖学金(每人5万元)。本届聚焦AGI、具身智能、数字医学、数据处理与安全隐私四大方向,申报量较首届增长近4倍。蚂蚁集团同时宣布未来三年投入1亿元扶持获奖者创业项目。
《纽约时报》追访披露OpenAI与纽约大学数学家Tristan Buckmaster围绕纳维-斯托克斯方程证明的争议细节,包括OpenAI更新用户数据说法、提出多种合作方案但要求排除Anthropic员工Levent Alpöge。OpenAI随后宣布在另一道千禧年难题上取得实质性进展,传闻指向霍奇猜想,可能由内部代号Aeon的模型完成。事件反映OpenAI
另有 1 家信源报道
2026 Inclusion·外滩大会上,香港大学计算与数据科学学院主办“世界模型是AI走向物理世界的新大陆吗”见解论坛,马毅、王晓刚、骆怡航等高校与企业嘉宾围绕世界模型的能力边界、具身智能技术路径与商业化挑战展开讨论。王晓刚介绍大晓机器人ACE研发范式与开悟世界模型,骆怡航发布面向灵巧操作的通用世界模型Motus2,圆桌嘉宾就世界模型定义、风险、适用场景及
Hugging Face 用户 DavidAU 发布了基于 Qwen/Qwen3.8-27B 微调的模型 Qwen3.8-27B-TURBO-Fable-Cold-Fusion-735-882-Heretic-Uncensored-NM-DAU,采用 Apache-2.0 许可,主打去审查(uncensored)与多阶段调优。作者称该模型在 ARC-C 等核
Google Research 在 ACL 2026 发表 ToolGrad,一种「答案优先」的工具使用数据集生成框架:先生成工具调用链,再反向标注用户查询,并借鉴 TextGrad 的「文本梯度」迭代构建复杂 API 工作流。基于 ToolBench 的 1.6 万+ API 生成 ToolGrad-500 数据集,微调 Gemma-3(1B/4B/12B
AWS Machine Learning Blog 介绍了一种基于 LLM 的模型无关 PII 检测器,通过指令驱动检测逻辑,可在 Amazon Bedrock 或自托管模型上运行。该方案将实体类型和输出格式变为可配置项,无需重新训练即可扩展检测范围,并在五个公开 PII 语料库上与包括 OpenAI PrivacyFilter 在内的九种 LLM 检测器进
Mistral AI 与 Cloudera 宣布建立合作伙伴关系,将 Mistral 的模型集成到 Cloudera 的混合数据平台中,使企业能够在私有云、公有云、本地及完全气隙环境中部署 AI 模型并保持完全控制。双方还将支持企业在受控环境中利用专有数据训练定制模型,从而拥有数据和由此产生的智能。该合作旨在满足受监管行业对主权 AI 日益增长的需求。
DeepSeek 上线 V4.1-Flash,采用因果编码器-解码器(CED)、第二代压缩稀疏注意力(CSA2)与三档推理力度旋钮的全新架构,针对长上下文场景重写。该架构将运行时显存占用降低约 3/4,落盘持久 KV 缓存降至上一代的 1/8,KV 缓存最高暴降 437 倍,使百万 Token 级长上下文进入工业级生产力阶段。模型主干 552B 参数、外挂
蚂蚁灵波开源了世界模型 LingBot-World 2.0 的轻量版,参数规模仅 1.3B,面向消费级单卡 GPU,可在本地实现实时世界生成。该版本并非由 14B 主模型裁剪而来,而是沿 Causal Pretrain、MoBA 注意力掩码、一致性蒸馏与 DMD 蒸馏的训练路线自然得到,并同时开放 Causal Pretrain 与双向 Teacher 上游
中国科学技术大学上海研究院执行院长陆朝阳在2026外滩大会主论坛上对量子计算热潮提出冷静判断,称量子计算目前仍很'菜',并非加速一切的超级机器。他指出量子计算不等于并行计算,只有大数分解、量子系统模拟等少数具有特殊数学结构的问题才能获得真正加速,金融领域尚无公认的实用量子优势证据,大模型训练也缺乏公认的量子加速算法。他认为量子计算最值得重视的方向是信息安全,
Qwopus3.8-27B-Flash 是基于 Qwen3.8-27B 微调的多模态模型,旨在降低推理成本与响应时间,提升智能体任务的效率。模型通过两阶段训练(SFT 和 NeMo-RL+GSPO 强化学习)实现 12.8% 的加速解码和 80.7% 的 MTP 接受率,但 MMLU-Pro 分数略低于基础模型。该模型支持视觉、工具调用和代码生成,已知问题为
OneBit AI 发布技术研究报告,将后训练三值化(ternarization)流水线从 Qwen3-4B 扩展到 Qwen3-8B,采用 KOTMS 旋转、E2M-ATQ 自适应三值化和 GPTQ 式误差补偿的权重-only A16 配置。8B 模型在三语料困惑度比为 1.361,八项零样本任务平均准确率 64.6%(FP16 为 72.4%),机会校正
该论文提出「世界时间计算」(world-time compute)方法,通过让语言模型编写可验证的代码世界模型(Code World Models),为符号化领域自动生成大量带精确标签的训练轨迹,从而提升模型对未见世界的泛化能力。作者同时发布零依赖框架 OpenWorld,将经过验证的世界模型编写流程压缩到分钟级,使批量制造训练经验变得可行。该方法与依赖海量
苹果公司研究人员提出 Glyph,一个面向企业数据目录的生产级多智能体系统,用于自动生成列描述并标注敏感度本体标签。系统将列描述生成和列类型标注建模为协作的 LLM 智能体,通过有状态图编排:Descriptor 基于生产该列的管道源代码进行主动检索增强生成,Tagger 并行运行描述、业务线正则和元数据三种策略,并用 RRF 融合排序结果。研究还微调了一个
webAI 官方发布了基于 SmolLM3-3B 的 3B 规模形式逻辑推理模型 TwIL-LM3,通过 LoRA 微调、检查点融合、WiSE-FT 和 GRPO 强化学习训练。该模型在领域内形式逻辑任务上相对基座提升 26%,同时保持甚至提升泛化基准性能,在多项指标上超越参数规模更大的模型。模型采用非商业许可,支持 GGUF 量化,可在低资源环境运行。
Hugging Face 推出了内置在其聊天机器人中的 AI 助手“ML Intern”,允许用户通过对话描述想法来运行机器学习实验,无需专业知识。该助手能搜索模型和数据集、估算成本并自动执行训练、监控和报告等任务。Hugging Face 表示,示例实验运行约六小时,成本不到 0.50 美元。此举降低了机器学习项目的门槛,而 Hugging Face 正被
讯飞发布参数293B的星火X2.5 MoE大模型,重点提升代码与智能体能力,API支持Anthropic和Responses协议。实测中,该模型能生成3D粒子交互网页、拆解61页财报并发现数据错误,还能为游戏设计官网。星火X2.5基于全国产算力训练,训练效率提升至93%,标志着国产算力模型进入可交付时代。
NeoHorse-1 通过智能路由、结构化反馈循环和基于课程的知识蒸馏进行智能体后训练,以提升模型在智能体基准上的能力。该系统结合异构模型池与智能路由,将交互记录转化为训练示例,并采用三阶段课程和路由引导的在线蒸馏。在11个基准上,4B模型宏平均从58.94提升至64.87,9B模型从65.60提升至69.04,缩小了4B与9B模型间的差距。该工作为递归自我
OpenBMB 发布了 BitCPM-CANN 模型系列,这是首个基于华为昇腾 NPU 原生训练的端到端 1.58 位三元大语言模型系统。该系统将量化感知训练集成到 Megatron-LM 框架中,并使用 MindSpeed 加速,在昇腾 910B 上训练了 0.5B 至 8B 四个模型。在 11 项基准测试中,1B/3B/8B 模型保留了全精度性能的 95
AWS 机器学习博客介绍了 Pathway 公司基于大脑启发的 BDH 架构,该架构在 Amazon SageMaker HyperPod 上进行训练。BDH 架构在潜在空间中进行推理,无需生成中间文本,通过稀疏局部交互和类突触连接维持状态,解决了 Transformer 在训练和推理中的低效问题。Pathway 声称其 1.5 亿参数的 BDH 模型在 A