Deepseek 发布 V4.1-Flash,大幅降低 AI 智能体内存需求
Deepseek 发布新模型 V4.1-Flash,通过大幅压缩 KV 缓存降低长文本处理成本:快速 GPU 内存中的缓存仅需前代 V4-Flash 约四分之一,永久卸载部分降至约八分之一,相比 V1 每 token 全局 KV 缓存缩小 437 倍。模型采用输入/输出计算拆分,读取输入时每 token 仅激活 80 亿参数、生成时激活 160 亿,并将主
另有 1 家信源报道
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2397 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Deepseek 发布新模型 V4.1-Flash,通过大幅压缩 KV 缓存降低长文本处理成本:快速 GPU 内存中的缓存仅需前代 V4-Flash 约四分之一,永久卸载部分降至约八分之一,相比 V1 每 token 全局 KV 缓存缩小 437 倍。模型采用输入/输出计算拆分,读取输入时每 token 仅激活 80 亿参数、生成时激活 160 亿,并将主
另有 1 家信源报道
Meta 发布 AI 代理 Muse,用户可通过 WhatsApp 控制它自主完成订旅行、购物、发邮件、议价等任务,并借助 Stripe 的 Link 服务在用户批准后完成支付。Muse 运行在隔离的虚拟机上,由监督代理 Sentinel 监控,Meta 称密码不会暴露、交互数据不进入广告系统。该代理先在美国 iOS 和 Android 上线,被视为 Met
RAGFlow 发布 v0.27.2 版本,重构了 Agentic RAG 检索框架,显著提升推理速度与基准测试表现。新增知识编译运行时设置、知识编译流水线限流、Sitemap 数据源、WebDAV 自定义 CA 证书、MonkeyOCRv2 与自托管 PaddleOCR-VL 解析支持,以及 Sofya 搜索工具等。同时新增 Hubris 和 llmman
DeepSeek 上线 V4.1-Flash,采用因果编码器-解码器(CED)、第二代压缩稀疏注意力(CSA2)与三档推理力度旋钮的全新架构,针对长上下文场景重写。该架构将运行时显存占用降低约 3/4,落盘持久 KV 缓存降至上一代的 1/8,KV 缓存最高暴降 437 倍,使百万 Token 级长上下文进入工业级生产力阶段。模型主干 552B 参数、外挂
蚂蚁数科在2026外滩大会见解论坛上推出Agentar金融版,提供开箱即用的金融智能体专家团、行业Skill、MCP、智能体评测工具及治理能力,帮助金融机构打造覆盖开发、部署、协作、评测与管理的智能体超级工厂。首批预置十大金融智能体专家团,覆盖智能投顾、财富管理、客户经营等场景,并已在银行、证券、保险等机构真实场景验证。蚂蚁数科称已联合合作伙伴在金融场景打造
蚂蚁集团大安全CTO陈亮在外滩大会媒体群访中提出,AI新经济能否规模化不只取决于模型能力,更取决于社会是否敢把真实任务交给AI,安全是AI规模化的基础课。蚂蚁将智能体安全理解为从终端入口、Agent身份权限行为到交易风控与事后审计的端到端链路,并推出终端安全品牌“灵影”及智能体安全可信互联协议ASL。ASL已在1688电商采购等跨平台场景落地,大会还启动《智
智象未来(HiDream.ai)于2026年9月8日全球上线内容创作智能体 vivago R1,国内版本「够搭」同步升级发布。R1 主打一次性稳定输出5分钟高质量视频并支持无限次多轮延长,通过主/子 Agent 协同完成脚本、分镜、角色、场景与音效,并依托自研 HD-AgentOS 将内容有效可用成功率提升至85%。产品采用 Chat-First 对话式创作
在ECCV 2026上,中国科技公司钛动科技牵头举办了唯一聚焦Agentic Commerce方向的MARS2 Workshop,牛津、MIT等机构学者参与分享多模态AI前沿研究。配套的MARS2多模态AI挑战赛设置三条赛道,基于3108支广告视频构建的M-CAR数据集,吸引64支全球团队提交超1060份方案,奖金池10万美元。结果显示模型整体理解广告内容尚
另有 1 家信源报道
在ECCV 2026上,中国公司钛动科技牵头发起了MARS2 Workshop,这是本届大会唯一由中国科技公司牵头举办的Agentic Commerce方向Workshop。该Workshop同期举办多模态推理挑战赛,设置10万美元奖池,吸引全球64支团队提交超1060份方案,并开源了M-CAR基准数据集及代码库。赛事结果表明当前多模态模型在System 2
另有 1 家信源报道
蚂蚁数科CEO赵闻飙在外滩大会媒体交流会上披露,公司独立运营两年后整体业务年均增长近50%,AI To B业务增速达三位数,AI成为新增长引擎。公司推出行业大模型LingDT、智能体平台Agentar、模型服务平台DTMaaS、智能体安全产品“蚁天鉴”等AI原生产品,并布局“智能体超级工厂”,此次Agentar新增金融、能源两大行业版本。蚂蚁数科还联合十余家
腾讯云 AI 团队在开发者社区介绍其文档智能教育产品线,将作业批改链路拆为切题、识别、批改、回显四步,并封装为试题批改 Agent 与作文批改 Agent,覆盖 K12 全学科及中英文手写作文,输出正误、得分、知识点与错误坐标等结果。作文批改走异步接口(SubmitMarkEssayAgentJob),默认并发限制 2 次/分钟,底座为千亿参数多模态大模型与
IDC中国企业软件市场研究经理王楠在2026 Inclusion·外滩大会论坛上分享研究,预测中国AI数据基础设施市场2025年至2030年将以37.7%的复合增速增长,2030年规模达738亿美元,2035年有望达1548亿美元。报告将市场划分为AI数据平台、AI数据智能和AI数据服务三大领域,其中AI数据智能增速最快。文章指出AI瓶颈正从模型能力转向企业
9月10日,成都市武侯区政府与蚂蚁集团在2026外滩大会现场就“AI+医疗健康”达成整体合作,武侯区发改局、悦湖科技中心与OceanBase、蚂蚁健康、蚂蚁数科签署框架协议。各方将围绕医疗健康数据基础设施、行业大模型、AI应用创新与算力运营展开合作,重点建设数据融合联创中心、AI专病辅助诊疗联合实验室和医疗健康智能应用产业基地(西部中心)三大平台。此举是20
在2026 Inclusion外滩大会上,支付宝宣布设立“智能体涌现奖”,每年投入1000万元激励开发者,年度大奖奖金100万元,9月10日起可通过支付宝内对阿宝说关键词报名。开发者无需编写代码,用自然语言即可搭建智能体,成熟作品可接入阿宝服务10亿用户。同时,AI版支付宝“阿宝”完成升级,已适配万余项服务,并与手机、车企等终端实现跨端互联,从即时服务走向长
美团技术团队发布《Agent 评测白皮书》系列第一篇《Agent 评测全览》,指出过去三年基座模型能力提升与 Agent 框架功能丰富使搭建 Agent 门槛持续降低,但绝大多数 Agent 项目因缺少可靠判断机制而失败。文章提出完备评测体系可概括为四个模块、三种能力、两条 Loop、一套资产,并强调评测应从答案评测走向行为评测,同时需通过 Case 挖掘与
OpenAI 公布针对 Navier-Stokes 千禧年问题的有限时间奇点构造:一个仍在训练的内部模型配合约 1 万个 Agent 搜索约 88 小时,随后用 Lean 完成形式化,声称在光滑外力和有限动能条件下可使三维流体演化到局部速度无界。文章指出人类数学家(如 Tristan Buckmaster)贡献了核心破局思路,AI 主要负责高维非凸约束的并行
OpenAI Labs 成员 Sharif Shameem 展示 GPT-6 Astra 连续完成《I'm Not a Robot》全部 48 关,从图片识别到拖拽、停车、节奏控制等动态任务,形成视觉理解、GUI grounding、状态保持与动作执行的闭环。Astra 在 ScreenSpot-Pro 达 92.7%、OSWorld 2.0 达 72.6%
雷峰网报道腾讯WorkBuddy在9月生态发布会上展示的AI办公生态合作模式:软件侧与北森、帆软、云帐房等SaaS厂商通过Skill、专家、连接器打通能力,硬件侧与Plaud、科大讯飞、Rokid、华为手表等合作,将硬件作为信息输入端甚至Agent执行终端。文章指出双方在能力开放边界、数据安全(本地部署被蒸馏风险)上仍需磨合,且B2B收入分成机制尚未确定,目
飞猪与AI版支付宝“阿宝”达成深度合作,用户通过一句话指令即可完成机票、景区门票预订以及酒店会员注册、权益查询等服务。“阿宝”通过MCP调用飞猪服务,返回推荐结果卡片并跳转至支付宝飞猪小程序下单。飞猪万豪旗舰店同步接入,后续双方还将推进账号互通并上线酒店预订能力。
Qwopus3.8-27B-Flash 是基于 Qwen3.8-27B 微调的多模态模型,旨在降低推理成本与响应时间,提升智能体任务的效率。模型通过两阶段训练(SFT 和 NeMo-RL+GSPO 强化学习)实现 12.8% 的加速解码和 80.7% 的 MTP 接受率,但 MMLU-Pro 分数略低于基础模型。该模型支持视觉、工具调用和代码生成,已知问题为