返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2498 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月6日周四 · 6 条
正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

LendingTree 在 Amazon Bedrock 上构建多智能体抵押贷款助手

LendingTree 在 Amazon Bedrock 上构建了一个多智能体抵押贷款助手,使用 LangGraph、MCP 和 Amazon Bedrock 基础模型,包含监督者和两个专业工作者(教育和匹配)。该助手通过 Amazon Bedrock Guardrails 和 LLM 安全分类器确保合规性和数据保护,旨在教育借款人并提供个性化贷款选项。该解

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

Mobileye 借助 Amazon Bedrock AgentCore 实现支持运营转型

Mobileye 利用 Amazon Bedrock AgentCore 部署了 AI 支持代理,将响应时间缩短了 90%,准确率超过 95%,且无需管理基础设施。该代理通过 MCP 协议实时访问数据处理平台 API,解决了内部工单查询瓶颈。Mobileye 还将 AgentCore 转化为自服务平台,供公司内部团队部署自己的 AI 代理。

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

AWS 构建 MCP 桥接器,实现云端 AI 代理访问本地工具

AWS 机器学习博客介绍了一种通过 MCP 桥接器,使云端 AgentCore 托管的 AI 代理能够访问用户本地 MCP 工具的方法。该方案利用 WebSocket 和原生消息传递,在远程 MCP 客户端与本地 MCP 服务器之间建立隧道,解决了云端代理与本地文件(如 Excel)之间的访问问题。文章详细描述了架构、消息流和实现细节,并提供了完整的源代码。

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

AWS 推出 n8n 社区节点,集成 Bedrock AgentCore 生产级代理

AWS 宣布 Amazon Bedrock AgentCore harness 正式可用,并推出开源社区节点 @aws/n8n-nodes-agentcore,将生产级 AI 代理能力集成到 n8n 可视化编辑器中。该节点支持持久记忆、真实工具调用和多模型提供商(如 Bedrock、OpenAI、Gemini),用户无需编写基础设施或代理代码即可构建代理。节

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布

Mem0 Node SDK v3.1.5 发布,新增代理自定义指令

Mem0 发布了 Node SDK v3.1.5,新增了 agentCustomInstructions 功能,允许为代理作用域的记忆设置第二套提取指令。该功能支持仅传递 agentId 时使用新指令,同时传递 userId 时按归属拆分,未设置时回退到原有 customInstructions。此更新增强了记忆管理的灵活性和定制性。

正文结构化主题已通过公开置信门槛
Mem0 Releases一手来源产品发布

Mem0 Python SDK v2.0.17 发布,新增 agent 自定义指令支持

Mem0 发布了 Python SDK v2.0.17,新增了在项目更新和添加记忆选项中设置 agent custom instructions 的功能,该指令仅适用于 agent 范围的记忆,并支持同步和异步接口。此更新允许更精细地控制记忆提取指令,提升记忆管理的灵活性。

8月5日周三 · 14 条
正文结构化主题已通过公开置信门槛
Agno Releases一手来源产品发布

Agno v2.8.7 发布:新增 AdvisorTools 与多项修复

Agno 发布了 v2.8.7 版本,新增了 AdvisorTools、OpenRouteService 工具包、组件感知的调度工具和文件系统工具包名称覆盖功能。同时修复了多个 bug,包括 Cohere 采样参数、持久化组件工具再水化、SQLite 崩溃和音频工具结果处理等问题。该版本还排除了有问题的 nltk 3.10.1 依赖。

正文结构化主题已通过公开置信门槛
OpenAI Agents JavaScript Releases一手来源产品发布

OpenAI Agents JS v0.14.3 发布:多项修复与改进

OpenAI 发布了 Agents JavaScript 库 v0.14.3 版本,包含多项修复和新功能。主要新增了会话历史事务支持,并修复了工具名称冲突、输出护栏、工具结果保留、MCP 工具分页、实时对话、沙箱快照路径和输出令牌预算等问题。这些改进提升了库的稳定性和可靠性。

正文结构化主题已通过公开置信门槛
n8n Releases一手来源产品发布

n8n 发布 2.33.4 版本,修复任务代理与 AI 助手问题

n8n 发布了 2.33.4 版本,主要修复了核心组件中任务代理的弹性问题,包括当运行器死亡时的恢复机制,以及恢复无响应的任务运行器。此外,还修复了 AI 模板示例中“查看全部”按钮的跟踪问题,并跳过了 AI 助手中冗余的工作流编辑审批。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering开源

Ponytail 技能修正自身基准,回应质疑并推动技能评估标准

开源技能 Ponytail 通过注入规则集,指导 AI 编码代理遵循 YAGNI 原则,避免过度工程化,自发布以来已获超 8.2 万 GitHub 星标。其原始基准声称减少 80-94% 代码,但遭质疑后作者重建基准,公开修正为平均减少约 54% 代码,并补充了行为测试框架。该事件凸显了 AI 技能缺乏评估标准的问题,Ponytail 的回应被视为更持久的贡

正文结构化主题已通过公开置信门槛
CrewAI Releases一手来源产品发布

CrewAI 发布 1.15.11 版本:新增功能与安全修复

CrewAI 发布了 1.15.11 版本,新增了遥测跟踪、项目 ID 关联、AGENTS.md 中的 AMP 展示以及 IBM Db2 搜索工具等功能。同时修复了多个安全漏洞和错误,并更新了文档。

正文结构化主题已通过公开置信门槛
OpenAI Agents Python Releases一手来源产品发布

OpenAI Agents Python v0.19.4 发布:多项修复与性能优化

OpenAI 发布了 openai-agents-python 库的 v0.19.4 版本,包含多项修复,如保留工具护栏结果、重定向无效工具参数错误、延迟非流式会话保存、在策略检查前尊重已解决状态、并发失败后取消兄弟任务、显示非流式内容过滤拒绝等。此外,还改进了 MCP 重试退避、实时连接清理、跟踪标记、沙箱令牌预算、会话状态管理及扩展的思考块保留。同时优化

正文结构化主题已通过公开置信门槛
PydanticAI Releases一手来源产品发布

PydanticAI v2.24.0 发布:多项提供商兼容性修复

PydanticAI 发布 v2.24.0 版本,主要包含多项 bug 修复,涉及 Google、Bedrock、OpenRouter、Groq 等提供商,以及 AG-UI 协议兼容性改进。修复了 Google 提供商超时参数、Bedrock 流处理、Kimi 推理模型识别等问题,并新增了对 Groq 复合模型名称的支持。

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

AgentStream:评估自进化LLM代理在流式任务中的表现

AgentStream 是一个统一框架,用于评估自进化 LLM 代理在流式任务中的表现,通过将基准组织为可配置任务流,并实例化隔离、顺序和交错三种流式场景。研究发现自进化可靠性随场景变化,其收益受模型能力限制且非单调,没有单一方法在所有模型和场景中占优。该研究倡导在现实任务流而非孤立单任务设置中评估自进化代理。

正文结构化主题已通过公开置信门槛
Simon Willison's Weblog产品发布

LLM 0.32 发布:支持推理轨迹、OpenAI Responses 与服务端工具

Simon Willison 发布了 LLM 0.32,这是该项目自启动以来最重要的版本,新增了对推理轨迹、OpenAI Responses API、服务端工具和内容寻址日志的支持。该版本还引入了新的模型(如 GPT-5.6 系列)和 Python API 改进,包括流式事件和消息列表参数。同时,llm-anthropic 等插件也获得了重大更新,增加了 W

正文结构化主题已通过公开置信门槛
TechCrunch AI商业

英伟达主导的开放安全AI联盟一周内取得进展

由英伟达牵头成立的开放安全AI联盟(OSAA)在成立一周内已吸引超过120家公司加入,并成立了名为SAFE的工作组,已提出多项提案供公开评议,由Linux基金会管理。提案涵盖AI网络安全事件的保密报告、受影响方通知及无指责分析等。联盟成员包括Adobe、微软、英特尔等,但Anthropic、OpenAI和Google尚未加入,尽管后两者签署了支持开源AI的公

正文结构化主题已通过公开置信门槛
llama.cpp Releases一手来源产品发布

llama.cpp b10271 发布:UI 新增工作目录选择器

llama.cpp 发布 b10271 版本,主要更新了 UI 功能,为 agent 添加了每会话工作目录选择器,支持路径导航和搜索范围控制,并持久化每次调用的工具工作目录。该版本还改进了文件搜索的健壮性,并提供了多平台二进制下载。

正文结构化主题已通过公开置信门槛
Latent Space产品发布

解析 ChatGPT Work:面向十亿用户的智能体

OpenAI 于 7 月 9 日发布了面向知识工作的智能体产品 ChatGPT Work,整合了多个模型和桌面应用,并支持云和本地两种模式。该产品基于 Codex 框架,提供持久化云计算机、插件和工件生成功能,上线三周用户已超 1000 万。文章还分析了其记忆机制、任务工作区以及与 ChatGPT 的合并计划。

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布

Qwen3.6-35B-A3B 无审查多模态模型 Genesis Hermes V6 发布

LuffyTheFox 发布了基于 Qwen3.6-35B-A3B 的无审查多模态 MoE 模型 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF,该模型通过其自研的 Genesis 算法对张量进行噪声修复,无需重新训练即可提升模型稳定性和输出质量。模型融合了 Hermes 微调数据,支持多语言和视觉任务,并

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

AWS 发布基于 Bedrock AgentCore 的自动化网页洞察提取方案

AWS 发布了一篇技术博客,介绍如何使用 Amazon Bedrock AgentCore Browser 构建自动化网页洞察提取解决方案。该方案通过事件驱动架构,利用 AgentCore 的托管浏览器服务渲染 JavaScript 密集型页面,结合 Amazon Bedrock 进行 AI 分析、OpenSearch Serverless 进行语义搜索,并