返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2400 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月1日周二 · 20 条
正文结构化主题已通过公开置信门槛
量子位开源

GitHub最热架构图Agent Archify走红,开发者专升本逆袭引热议

开源项目Archify登上GitHub热榜,它能用AI一键生成美观且支持实时更新的架构图,兼容Claude Code、Codex等Agent。开发者“也无风雨也雾晴”是专升本出身,曾因学历在求职中屡遭挫折,后通过开源作品证明自己并获大厂Offer。Archify通过生成JSON IR并验证渲染,支持多种图表类型和交互功能,旨在解决AI生成架构图准确性问题。

正文结构化主题已通过公开置信门槛
量子位商业

Claude明升暗降额度引众怒,OpenAI重置额度修复Bug获好评

Anthropic宣布从9月14日起永久提高Claude Code标准周额度25%,但此前临时50%的加量将结束,实际额度反而减少约17%,引发用户不满。与此同时,OpenAI的Codex负责人Tibo重置了用户额度,并修复了多个后台消耗额度的Bug,使用户实际可用额度增加10%-50%。两相对比,Claude的沟通策略受到批评,而Codex则获得好评。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

VAST完成约30亿元融资并发布Tripo P2.0,刷新AI 3D融资纪录

VAST宣布完成约30亿元B轮和B+轮融资,由经纬创投领投,多家产业资本和财务投资机构参投,累计融资约50亿元,刷新AI 3D领域融资纪录。同时发布旗舰3D原生基座模型Tripo P2.0,首次实现原生四边面拓扑网格的端到端生成,并已在游戏、3D打印、影视等领域落地。融资将用于模型迭代、基础设施扩建和商业化加速。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

Violoop获亿元融资,让AI在真实工作中学会一个人

Violoop完成亿元级天使轮及Pre-A轮融资,投资方包括联想创投、中金保时捷等。其产品为桌面设备,通过HDMI和USB接入电脑,让AI通过视觉和键鼠操作学习用户工作方式,实现个人化自进化。产品计划9月上线,已获约1.2万人预订。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

MoziAI-35B-V3.8:15.9GB 本地部署多模态金融模型

MoziAI-35B-V3.8 是由中国金融领域意见领袖陈雨墨团队开发的开源多模态 AI 模型,基于 Ornith-1.5-35B-A3B 基础模型,采用 MoE 架构,通过自研 MoziSmartBit 量化压缩至 15.9GB,支持本地部署和免费商用。模型具备动态七维思考框架、Agent LOOP 迭代机制、金融垂直优化和无审查特性,支持多语言、视觉理解

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

筷子科技推KP钱包,统一视频商业AI价值计量

筷子科技发布视频商业AI能力统一价值单位“KP”及企业“KP钱包”,旨在统一管理模型调用、内容生产、分发等环节的预算与能力。KP建立在Token之上,覆盖模型、算力、Agent、工具等资源,企业可通过KP钱包分配预算并管理多业务环节。目前Kuaizi已积累超1.2亿条商业视频,服务13500多家付费企业,并展示了多个客户效率提升案例。

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究

ASTRA:用于工单解决和分析的智能体系统

ASTRA 是一个用于工单解决和分析的智能体系统,通过中央编排器协调三个专业信息收集智能体(工单相似性、日志分析和领域知识),并利用法官-编排器循环生成有证据支持的故障排查报告。该系统在 987 个真实电信故障工单上评估,平均质量得分 4.13/5.0,其中 59.9% 的报告正确识别了组件级或更细的故障区域,且硬件故障的诊断难度显著高于软件和配置故障。

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究

AgenticRag-R1:基于栈内存的智能体强化学习实现多步推理与检索

AgenticRag-R1 是一个基于强化学习的框架,通过内存栈和细粒度动作空间深度融合推理、检索和记忆,并采用分层动作感知奖励和信息感知轨迹拒绝策略,以解决现有 RAG 系统在多步推理中自适应检索和上下文修订的不足。实验表明,该方法在多个多跳、开放域和智能体推理基准上优于强基线,并展现出更稳健、可解释且记忆感知的推理行为。代码已在 GitHub 上匿名公开

正文结构化主题已通过公开置信门槛
arXiv cs.AI一手来源研究

并非所有解释都被寻求:以人为本XAI的信息寻求心理学

这篇立场论文主张,以人为中心的可解释AI(HCXAI)应整合信息寻求心理学,基于Sharot和Sunstein的框架,提出人们根据工具性、享乐性和认知性三种预期效用来决定是否寻求解释,并受多种认知偏差影响,导致过度或不足的信息寻求,尤其在智能体AI系统中更为关键。作者倡导从“让解释可用”转向“让解释被寻求”,设计系统时考虑用户实际想要知道的时机和原因。

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究

面向自主云MLOps的前沿全栈工程框架

本文提出了一种基于证据门控的多智能体框架,用于将自然语言描述的MLOps云工程任务转化为经过验证的代码仓库和可运行的云部署。该框架结合了图工程、循环工程和智能体工程,通过有状态的图编排器协调仓库生成、审查、执行、验证、发布和监控等专业智能体,并仅在可验证的执行或运行时证据支持时允许关键生命周期转换。研究在Google Cloud Platform上实现了该框

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究

从生成式AI虚拟病人对话日志到教师可解释的过程证据:高等教育学习分析研究

莫纳什大学、北京大学、汕头大学医学院和香港大学的研究者分析了210名二年级医学生五周内1030次生成式AI虚拟病人问诊对话,通过行为频率、认知网络分析和转换网络分析三层编码,发现高评分问诊不仅活动量更多,更常将信息收集与沟通、核查、组织和综合连接,且总结和组织行为更易引发验证或机制导向的追问。研究表明分层分析AI虚拟病人对话日志可提供教师可解释的临床推理过程

正文结构化主题已通过公开置信门槛
arXiv cs.SE一手来源研究

验证工具覆盖面决定AI编码智能体价值:一项受控研究

该研究通过构建一个工具列表为唯一变量的最小化编码智能体,在六个模型和八种工具配置下实现了1116个Web应用,以探究验证工具覆盖面(如linter、启动探针、shell、截图)对AI编码智能体输出软件质量的影响。研究发现,验证工具的最廉价收益是确保应用能启动,仅一个启动探针即可消除大部分启动失败,且成本仅为完整shell的35%;完整shell将无工具成本提

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论观点

TUM教授黎子玥:AI交通模型为何难落地?PDE三角框架弥合鸿沟

慕尼黑工业大学教授黎子玥在IJCAI 2026 Early Career Spotlight演讲中,提出“PDE三角”框架(感知、决策、解释性),以弥合学术研究与公共部门落地之间的鸿沟。他指出,尽管模型和智能体日益强大,但全球尚无城市长期部署基于强化学习的交通信号控制系统,主要障碍包括数据质量、可解释性和仿真到现实的鸿沟。他呼吁研究社区关注真实数据、可解释性

正文结构化主题已通过公开置信门槛
PydanticAI Releases一手来源产品发布

PydanticAI v2.37.0 发布:新增 glm-5.3-flash 支持并修复多项问题

PydanticAI 发布 v2.37.0 版本,新增对 glm-5.3-flash 模型的支持,并重构了 Z.AI 测试套件。该版本修复了多个 bug,包括保留剪枝 span 查询中的所有条件、接受并映射 Z.AI 的非标准 finish reason 值、为包含工具调用的助手消息发出 AG-UI TEXT MESSAGE START 事件,以及改进 Go

正文结构化主题已通过公开置信门槛
Gemini API Release Notes一手来源API 更新

Gemini API 发布智能体视频理解,支持多模型并减少 token 消耗

Gemini API 于 2026 年 9 月 1 日发布更新,为 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型推出了智能体视频理解功能,该功能通过 Interactions 和 GenerateContent API 提供。模型能够动态导航视频时间线,按需请求转录、帧或音频轨道,与静态处理相比,长视频内容可减

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

将 AgentCore Runtime 托管的 MCP 服务器连接到 Amazon Quick

AWS 发布了一篇博客,介绍如何将 AgentCore Runtime 托管的 MCP 服务器连接到 Amazon Quick。文章详细说明了集成步骤、认证流程(Inbound Auth 和 Outbound Auth)以及部署选项,旨在帮助用户复用 AI 工具并避免重复开发。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

Dirk-Qwen3.8-27B-GGUF:精简模板提升效率的量化模型

Hugging Face 上发布了 Dirk-Qwen3.8-27B-GGUF,这是基于 Qwen3.8-27B 的量化模型,采用 Unsloth Dynamic 3.0 UD 量化,保留了 MTP 头,并集成了 Sharp 聊天模板。该模型通过精简系统提示和默认中等推理强度,减少了输出 token 数量,同时提升了准确率,在 SWE-bench-Live

正文结构化主题已通过公开置信门槛
Vercel AI SDK Releases一手来源产品发布

Vercel AI SDK 5.0.250 发布:工具调用验证与网络错误重试改进

Vercel AI SDK 发布 5.0.250 版本,主要包含两项补丁更新:一是验证持久化类型化工具调用与当前输入输出模式的一致性,不兼容的空输入或错误输入以及不可用工具的历史记录将作为动态工具部分加载;二是将读取成功响应体时出现的瞬时网络错误标记为可重试,包括 AI Gateway 响应。同时更新了 @ai-sdk/gateway 和 @ai-sdk/p

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

AWS Agent Registry 正式可用,统一管理 AI 代理与工具

AWS 宣布 Agent Registry 正式可用,这是一个用于大规模管理 AI 代理、工具和技能的统一目录服务。该服务提供治理平面和发现平面,支持 MCP、A2A 等资源类型,并具备语义搜索、访问控制和审批流程。索尼、三菱电机和西南航空等公司已开始使用该服务,以解决代理发现、治理和运营挑战。

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

AWS 推出基于 Bedrock 与 CloudFormation 的企业级代理检索方案

AWS 发布了一篇博客,介绍如何使用 Amazon Bedrock Managed Knowledge Base 和 AWS CloudFormation 构建可观测的企业级代理检索解决方案。该方案通过 AgentCore 和 AgenticRetrieveStream API 实现多知识库路由与迭代检索,并内置了基于 OpenTelemetry 的观测性和