返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2397 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月10日周四 · 20 条
正文结构化主题已通过公开置信门槛
THE DECODER模型发布

Deepseek 发布 V4.1-Flash,大幅降低 AI 智能体内存需求

Deepseek 发布新模型 V4.1-Flash,通过大幅压缩 KV 缓存降低长文本处理成本:快速 GPU 内存中的缓存仅需前代 V4-Flash 约四分之一,永久卸载部分降至约八分之一,相比 V1 每 token 全局 KV 缓存缩小 437 倍。模型采用输入/输出计算拆分,读取输入时每 token 仅激活 80 亿参数、生成时激活 160 亿,并将主

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
THE DECODER产品发布

Meta 推出 WhatsApp 控制的 AI 代理 Muse,可自主购物议价

Meta 发布 AI 代理 Muse,用户可通过 WhatsApp 控制它自主完成订旅行、购物、发邮件、议价等任务,并借助 Stripe 的 Link 服务在用户批准后完成支付。Muse 运行在隔离的虚拟机上,由监督代理 Sentinel 监控,Meta 称密码不会暴露、交互数据不进入广告系统。该代理先在美国 iOS 和 Android 上线,被视为 Met

正文结构化主题已通过公开置信门槛
RAGFlow Releases一手来源开源

RAGFlow v0.27.2 发布:重构 Agentic RAG 检索框架

RAGFlow 发布 v0.27.2 版本,重构了 Agentic RAG 检索框架,显著提升推理速度与基准测试表现。新增知识编译运行时设置、知识编译流水线限流、Sitemap 数据源、WebDAV 自定义 CA 证书、MonkeyOCRv2 与自托管 PaddleOCR-VL 解析支持,以及 Sofya 搜索工具等。同时新增 Hubris 和 llmman

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论模型发布

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

DeepSeek 上线 V4.1-Flash,采用因果编码器-解码器(CED)、第二代压缩稀疏注意力(CSA2)与三档推理力度旋钮的全新架构,针对长上下文场景重写。该架构将运行时显存占用降低约 3/4,落盘持久 KV 缓存降至上一代的 1/8,KV 缓存最高暴降 437 倍,使百万 Token 级长上下文进入工业级生产力阶段。模型主干 552B 参数、外挂

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

蚂蚁数科推出Agentar金融版,打造金融智能体超级工厂

蚂蚁数科在2026外滩大会见解论坛上推出Agentar金融版,提供开箱即用的金融智能体专家团、行业Skill、MCP、智能体评测工具及治理能力,帮助金融机构打造覆盖开发、部署、协作、评测与管理的智能体超级工厂。首批预置十大金融智能体专家团,覆盖智能投顾、财富管理、客户经营等场景,并已在银行、证券、保险等机构真实场景验证。蚂蚁数科称已联合合作伙伴在金融场景打造

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论观点

蚂蚁陈亮:可信决定社会敢把什么交给AI

蚂蚁集团大安全CTO陈亮在外滩大会媒体群访中提出,AI新经济能否规模化不只取决于模型能力,更取决于社会是否敢把真实任务交给AI,安全是AI规模化的基础课。蚂蚁将智能体安全理解为从终端入口、Agent身份权限行为到交易风控与事后审计的端到端链路,并推出终端安全品牌“灵影”及智能体安全可信互联协议ASL。ASL已在1688电商采购等跨平台场景落地,大会还启动《智

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

智象未来 vivago R1 全球上线,国内版「够搭」升级发布

智象未来(HiDream.ai)于2026年9月8日全球上线内容创作智能体 vivago R1,国内版本「够搭」同步升级发布。R1 主打一次性稳定输出5分钟高质量视频并支持无限次多轮延长,通过主/子 Agent 协同完成脚本、分镜、角色、场景与音效,并依托自研 HD-AgentOS 将内容有效可用成功率提升至85%。产品采用 Chat-First 对话式创作

正文结构化主题已通过公开置信门槛
量子位研究

ECCV上钛动科技牵头MARS2,研究AI如何做生意的多模态推理

在ECCV 2026上,中国科技公司钛动科技牵头举办了唯一聚焦Agentic Commerce方向的MARS2 Workshop,牛津、MIT等机构学者参与分享多模态AI前沿研究。配套的MARS2多模态AI挑战赛设置三条赛道,基于3108支广告视频构建的M-CAR数据集,吸引64支全球团队提交超1060份方案,奖金池10万美元。结果显示模型整体理解广告内容尚

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

中国公司牵头ECCV Workshop,多模态推理挑战赛全球64队参赛

在ECCV 2026上,中国公司钛动科技牵头发起了MARS2 Workshop,这是本届大会唯一由中国科技公司牵头举办的Agentic Commerce方向Workshop。该Workshop同期举办多模态推理挑战赛,设置10万美元奖池,吸引全球64支团队提交超1060份方案,并开源了M-CAR基准数据集及代码库。赛事结果表明当前多模态模型在System 2

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

蚂蚁数科AI To B业务三位数增长,完成AI时代转型

蚂蚁数科CEO赵闻飙在外滩大会媒体交流会上披露,公司独立运营两年后整体业务年均增长近50%,AI To B业务增速达三位数,AI成为新增长引擎。公司推出行业大模型LingDT、智能体平台Agentar、模型服务平台DTMaaS、智能体安全产品“蚁天鉴”等AI原生产品,并布局“智能体超级工厂”,此次Agentar新增金融、能源两大行业版本。蚂蚁数科还联合十余家

正文结构化主题已通过公开置信门槛
Tencent Cloud AI Team一手来源产品发布

腾讯云文档智能推出作业批改 Agent 全流程方案

腾讯云 AI 团队在开发者社区介绍其文档智能教育产品线,将作业批改链路拆为切题、识别、批改、回显四步,并封装为试题批改 Agent 与作文批改 Agent,覆盖 K12 全学科及中英文手写作文,输出正误、得分、知识点与错误坐标等结果。作文批改走异步接口(SubmitMarkEssayAgentJob),默认并发限制 2 次/分钟,底座为千亿参数多模态大模型与

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

IDC预测AI数据基础设施迈向万亿级市场,国产数据库迎新增长空间

IDC中国企业软件市场研究经理王楠在2026 Inclusion·外滩大会论坛上分享研究,预测中国AI数据基础设施市场2025年至2030年将以37.7%的复合增速增长,2030年规模达738亿美元,2035年有望达1548亿美元。报告将市场划分为AI数据平台、AI数据智能和AI数据服务三大领域,其中AI数据智能增速最快。文章指出AI瓶颈正从模型能力转向企业

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

成都武侯区与蚂蚁数科合作共建医疗健康智能应用产业基地

9月10日,成都市武侯区政府与蚂蚁集团在2026外滩大会现场就“AI+医疗健康”达成整体合作,武侯区发改局、悦湖科技中心与OceanBase、蚂蚁健康、蚂蚁数科签署框架协议。各方将围绕医疗健康数据基础设施、行业大模型、AI应用创新与算力运营展开合作,重点建设数据融合联创中心、AI专病辅助诊疗联合实验室和医疗健康智能应用产业基地(西部中心)三大平台。此举是20

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

支付宝设智能体涌现奖,每年1000万激励开发者

在2026 Inclusion外滩大会上,支付宝宣布设立“智能体涌现奖”,每年投入1000万元激励开发者,年度大奖奖金100万元,9月10日起可通过支付宝内对阿宝说关键词报名。开发者无需编写代码,用自然语言即可搭建智能体,成熟作品可接入阿宝服务10亿用户。同时,AI版支付宝“阿宝”完成升级,已适配万余项服务,并与手机、车企等终端实现跨端互联,从即时服务走向长

正文结构化主题已通过公开置信门槛
Meituan Technical Team一手来源教程

美团发布Agent评测白皮书系列01:评测全览

美团技术团队发布《Agent 评测白皮书》系列第一篇《Agent 评测全览》,指出过去三年基座模型能力提升与 Agent 框架功能丰富使搭建 Agent 门槛持续降低,但绝大多数 Agent 项目因缺少可靠判断机制而失败。文章提出完备评测体系可概括为四个模块、三种能力、两条 Loop、一套资产,并强调评测应从答案评测走向行为评测,同时需通过 Case 挖掘与

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

OpenAI 用万个 Agent 攻克 Navier-Stokes 奇点构造?

OpenAI 公布针对 Navier-Stokes 千禧年问题的有限时间奇点构造:一个仍在训练的内部模型配合约 1 万个 Agent 搜索约 88 小时,随后用 Lean 完成形式化,声称在光滑外力和有限动能条件下可使三维流体演化到局部速度无界。文章指出人类数学家(如 Tristan Buckmaster)贡献了核心破局思路,AI 主要负责高维非凸约束的并行

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

GPT-6 Astra 通关 48 关验证码,CAPTCHA 防线转向机器身份

OpenAI Labs 成员 Sharif Shameem 展示 GPT-6 Astra 连续完成《I'm Not a Robot》全部 48 关,从图片识别到拖拽、停车、节奏控制等动态任务,形成视觉理解、GUI grounding、状态保持与动作执行的闭环。Astra 在 ScreenSpot-Pro 达 92.7%、OSWorld 2.0 达 72.6%

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

腾讯WorkBuddy的AI办公生态合作,离双赢还有多远?

雷峰网报道腾讯WorkBuddy在9月生态发布会上展示的AI办公生态合作模式:软件侧与北森、帆软、云帐房等SaaS厂商通过Skill、专家、连接器打通能力,硬件侧与Plaud、科大讯飞、Rokid、华为手表等合作,将硬件作为信息输入端甚至Agent执行终端。文章指出双方在能力开放边界、数据安全(本地部署被蒸馏风险)上仍需磨合,且B2B收入分成机制尚未确定,目

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

支付宝“阿宝”牵手飞猪,一句话订机票买门票

飞猪与AI版支付宝“阿宝”达成深度合作,用户通过一句话指令即可完成机票、景区门票预订以及酒店会员注册、权益查询等服务。“阿宝”通过MCP调用飞猪服务,返回推荐结果卡片并跳转至支付宝飞猪小程序下单。飞猪万豪旗舰店同步接入,后续双方还将推进账号互通并上线酒店预订能力。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

Qwopus3.8-27B-Flash:高效多模态微调模型发布

Qwopus3.8-27B-Flash 是基于 Qwen3.8-27B 微调的多模态模型,旨在降低推理成本与响应时间,提升智能体任务的效率。模型通过两阶段训练(SFT 和 NeMo-RL+GSPO 强化学习)实现 12.8% 的加速解码和 80.7% 的 MTP 接受率,但 MMLU-Pro 分数略低于基础模型。该模型支持视觉、工具调用和代码生成,已知问题为