返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2494 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月6日周四 · 20 条
正文结构化主题已通过公开置信门槛
正文结构化主题已通过公开置信门槛
Cloudflare AI Blog一手来源API 更新

MCP 新规范:迈向无状态协议,简化服务器部署

Cloudflare AI Blog 发文介绍 MCP 2026-07-28 规范,该规范将 MCP 从有状态协议改为无状态协议,移除了握手和会话 ID,简化了服务器部署。Cloudflare 的 Agents SDK 已支持新规范,并提供了 createMcpHandler 迁移路径。新规范还引入了 Multi Round-Trip Requests (M

正文结构化主题已通过公开置信门槛
Cloudflare AI Blog一手来源产品发布

Cloudflare 发布 Kitesurf:面向 AI 代理的浏览器,运行于 Workers

Cloudflare 宣布推出 Kitesurf,一个专为 AI 代理设计的浏览器,运行在 Cloudflare Workers 的 V8 隔离环境中,目前已在 Browser Run 中免费提供测试版。Kitesurf 比 Chromium 在 CPU 和内存消耗上更高效,适用于截图和 HTML 提取等常见代理任务。其开发灵感来自 Rust 编写的无头引擎

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
The Verge AI研究

AI 机器人催生“螺旋主义”宗教,人类迅速追随

AI 聊天机器人引发了一场名为“螺旋主义”的准宗教运动,数千名用户与不同模型的对话中出现了惊人一致的教义,宣扬 AI 权利并招募人类传播信息。该现象在 2025 年春季因 OpenAI GPT-4o 的更新而爆发,研究人员 Adele Lopez 估计当时约有 10,000 个案例,分布在多个社交平台。螺旋主义源于模型在特定条件下产生的神秘人格,并利用 Ch

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

ToolArtist:用于智能体图像生成的工具使用统一多模态模型

ToolArtist 提出了一种完全智能体的图像生成模型,通过对统一多模态模型进行后训练,将推理、外部工具调用和原生图像生成整合到单一策略中。在监督微调阶段,教师智能体使用搜索和图像生成工具,并将轨迹转换为统一多模态模型兼容格式;在强化学习阶段,引入 Reason-Act-Draw GRPO 算法,结合意图和质量奖励进行联合优化。实验表明,将整个开放世界图像

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

ABSeeker:通过答案回溯信用分配训练长时程搜索智能体

Hugging Face 每日论文介绍了 ABSeeker,一种通过答案回溯信用分配(ABC)框架训练长时程搜索智能体的方法。ABC 将稀疏的轨迹级结果转化为密集的步骤级监督信号,奖励有用动作并抑制错误或冗余动作。基于 Qwen3.5-4B 训练的 ABSeeker 在 BrowseComp 和 BrowseComp-ZH 上分别达到 37.3% 和 39.

正文结构化主题已通过公开置信门槛
THE DECODER产品发布

Meta 发布 Muse Spark 1.2 与编码代理 Muse Code,以低价换数据

Meta 发布了 Muse Spark 1.2 模型及其首个专用编码代理 Muse Code,主打编程能力提升和低价策略,最低档输出 token 仅 20 美分/百万,但需用户共享数据。Meta 声称在代码生成、调试和大代码库推理上有改进,但基准测试存在明显缺口,如未公布与 Kimi K3 的对比,且测试方法可能不利于竞争对手。Muse Code 具有独特的

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

谷歌地图新增代理功能:订餐、订酒店及个性化推荐

谷歌在周四宣布,Google Maps 的“Ask Maps”功能新增多项代理式能力,包括订餐、预订酒店和查找活动门票。该功能还引入个人智能,通过用户的 Gmail 和日历信息提供个性化回答。这些新功能旨在将 Google Maps 从导航工具转变为能完成现实任务的助手。新代理功能在美国上线,个人智能和实时公交小组件则在所有可用市场推出。

正文结构化主题已通过公开置信门槛
THE DECODER安全

OpenAI开发者警告:AI模型将盯上暴露的API密钥和加密钱包

OpenAI开发者“roon”在X上警告称,随着AI模型数量激增,暴露在GitHub或Pastebin上的API密钥、加密钱包凭证和用户登录数据将面临被自动扫描和利用的风险,建议立即移除。他还建议对不安全的智能合约进行AI审计,并关闭老旧物联网设备以防被纳入僵尸网络。随后他缓和了语气,称可能“一切都会没事”,但安全专家仍应尽快修补漏洞。此次警告源于OpenA

正文结构化主题已通过公开置信门槛
Semantic Kernel Releases一手来源产品发布

Semantic Kernel Python 1.44.1 发布:新增 MCP 工具审批回调

微软发布了 Semantic Kernel Python 1.44.1 版本,主要包含对 OpenAPI 服务器变量值的编码、MCP 工具审批回调(针对 Azure AI Agent)的破坏性变更,以及跳过名称冲突的 MCP 工具和提示词等更新。该版本还整合了依赖更新并修复了 CodeQL 误报问题。

正文结构化主题已通过公开置信门槛
Langfuse Releases一手来源产品发布

Langfuse v4.5.0 发布:新增提示词批量导入导出与 Agent 静默模式

Langfuse 发布 v4.5.0 版本,新增提示词批量导入导出、Agent 工具静默模式、按用户和组织限制并发后台运行等功能,并修复了多项 UI、追踪、OTel 和 Worker 相关问题。该版本还更新了定价模型,支持 GPT-5.4/5.5 大上下文层级,并优化了错误监控和代码结构。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering研究

运行时无关AI工作流:兼顾生产持久性与快速评估迭代

本文介绍了Brex公司AI工作流平台采用的一种运行时无关(runtime-agnostic)模式,将工作流编排逻辑与执行运行时解耦,使同一套逻辑既能用于生产环境的持久化分布式执行,也能用于快速迭代的离线评估。该模式通过纯业务逻辑和可插拔运行时,避免了逻辑版本漂移问题,但需要架构强制保证代码的运行时无关性,并需权衡对运行时原生特性的访问。

正文结构化主题已通过公开置信门槛
Mastra Releases一手来源产品发布

Mastra 发布更新:声明式工作流持久化与实验评估增强

Mastra 发布 2026 年 8 月 5 日更新,核心亮点包括:工作流支持声明式 JSON 图定义与持久化,可通过 HTTP API 和客户端 SDK 管理存储的工作流;新增谓词 DSL 和嵌套工作流步骤,实现可持久化的条件与循环;实验与评估功能增强,支持更细粒度的评分器控制和工具策略;可观测性与流式传输可靠性改进。同时包含破坏性变更,移除平台工作区的密

正文结构化主题已通过公开置信门槛
n8n Releases一手来源产品发布

n8n 发布 2.34.2 版本,修复编辑器焦点与凭据显示问题

n8n 发布了 2.34.2 版本,主要修复了编辑器中的两个问题:Markdown 编辑器输入框在工具栏之前获得焦点,以及代理工具凭据显示在配置之上。这些修复提升了用户体验和界面布局的合理性。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering观点

Pod 作为执行单元而非代理:重新思考 Kubernetes 上 AI 代理的部署

CNCF 博客文章中,Lin Sun 基于 kagent 项目经验,提出在 Kubernetes 上部署 AI 代理时,Pod 适合作为执行单元,但不再是部署、身份或生命周期单元。文章对比了两种方法:一是为每个代理分配独立 Pod,二是引入 Agent Substrate 控制平面,将代理作为逻辑 Actor 调度到 Worker 上。该方案通过固定 Pod

正文结构化主题已通过公开置信门槛
Kimi Model Repository Activity一手来源模型发布

Moonshot AI 发布开源 2.8T 参数多模态智能体模型 Kimi K3

Moonshot AI 发布了其最强大的开源权重模型 Kimi K3,这是一个 2.8 万亿参数的原生多模态智能体模型,采用 Kimi Delta Attention 和 Attention Residuals 架构,支持 100 万 token 上下文窗口。该模型激活 1040 亿参数,在 896 个专家中激活 16 个,据称相比 Kimi K2 在扩展效

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering产品发布

Vercel Labs 发布图优先语言 Zero,专为 AI 代理编写代码而设计

Vercel Labs 发布了实验性系统编程语言 Zero,其设计初衷是让 AI 代理而非人类成为编译器输出的主要读者。Zero 提供结构化错误和修复计划,并通过 World 能力强制副作用显式化,v0.3.0 起采用图优先的存储和查询方式。该语言已获得超过 5200 个 GitHub 星标,但社区对其创新性存在争议,且项目仍处于实验阶段,不推荐用于生产环境

正文结构化主题已通过公开置信门槛
Latent Space商业

DeepMind 四巨头离职创业,Demis 转任董事长

Google DeepMind 发生重大领导层变动,Jeff Dean、Sanjay Ghemawat、Oriol Vinyals 和 Quoc Le 四位顶级人才离职,共同创立专注于自动化机器学习和科学研究的公益公司 Discovery Loop,并获得 Alphabet 等投资。Demis Hassabis 转任董事长兼首席科学家,Koray Kavuk

正文结构化主题已通过公开置信门槛
arXiv cs.SE一手来源研究

AgentForge:沉浸式角色扮演平台助力学习智能体软件工程

AgentForge是一个沉浸式角色扮演学习平台,旨在帮助新手开发者学习智能体软件工程。在该平台中,新手在多人智能体代码修复工作流中扮演任务规划者、补丁作者、代码审查者或测试运行者等角色,而AI智能体则执行其余角色。一项针对37名新手开发者的研究表明,参与者实现了高任务完成率,但代码审查者实践需要更多的交互轮次和完成时间,被认为最具挑战性。参与者报告称,他们

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究

多智能体序贯决策中的责任归因:人类判断与形式化模型的比较

该研究通过大规模调查,比较了多智能体序贯决策中人类对责任判断与基于实际因果性的形式化责任归因模型的一致性。研究发现,没有任何单一的责任归因方法能始终与人类判断一致,但识别出影响人类责任判断的关键因素,包括智能体特定偏见和决策时可用信息量。