返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2513 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

7月1日周三 · 1 条
正文结构化主题已通过公开置信门槛
Microsoft Research Blog一手来源研究

SkillOpt:将智能体技能作为可训练参数,实现可靠性能提升

微软研究院发布SkillOpt,一种将智能体技能文件视为可训练参数的新方法,在不更新模型权重的情况下,通过前向-反向-更新循环优化技能。在六个基准、七个模型和三种执行模式下,SkillOpt在全部52个评估单元中取得最佳或并列最佳结果,显著提升性能,且优化后的技能可跨模型和任务迁移。

6月30日周二 · 3 条
正文结构化主题已通过公开置信门槛
LangGraph Releases一手来源产品发布

LangGraph 1.2.7 发布:修复 DeltaChannel 与依赖更新

LangGraph 发布了 1.2.7 版本,主要修复了 DeltaChannel 覆盖超步、Overwrite 在 JSON 往返中的问题,并为 langgraph-api 生成有效的 UUID。同时更新了多个依赖项,包括 redis、langsmith、jupyterlab 等。

正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源模型发布

Anthropic 发布 Claude Sonnet 5,主打代理能力与性能提升

Anthropic 于 2026 年 6 月 30 日发布了 Claude Sonnet 5 模型,这是其最具代理能力的 Sonnet 系列模型,在推理、工具使用、编码和知识工作方面相较 Sonnet 4.6 有显著改进。该模型旨在提升自动化任务执行能力,相关细节已通过官方博客公布。

正文结构化主题已通过公开置信门槛
Microsoft Research Blog一手来源研究

微软发布 Memora:平衡抽象与具体的长期记忆系统

微软研究院发布了 Memora,一种面向长期任务 AI 代理的可扩展记忆系统,通过解耦存储内容与检索方式,平衡抽象与具体性,显著提升代理效率。Memora 在 LoCoMo 和 LongMemEval 基准上达到最先进性能,相比全上下文推理减少高达 98% 的 token 使用。该论文发表于 ICML 2026,代码已在 GitHub 开源。

6月29日周一 · 2 条
正文结构化主题已通过公开置信门槛
Import AI研究

NVIDIA 推出机器人自改进框架 ENPIRE,并反思 AI 预测的局限性

NVIDIA 研究人员开发了 ENPIRE 框架,使物理机器人能够像 AI 智能体一样自主实验和学习,在 PushT 等任务上达到 99% 成功率。该框架包含环境、策略改进、评估和进化模块,但扩展时面临基础设施挑战。此外,文章引用 Matthew Tokson 的论文,指出人类常低估或高估技术影响,提醒对 AI 未来保持谨慎。

正文结构化主题已通过公开置信门槛
Quarkus LangChain4j Releases一手来源产品发布

Quarkus LangChain4j 1.12.0.CR1 发布

Quarkus LangChain4j 发布 1.12.0.CR1 版本,包含多项更新:将模型名称传递给 Azure 实现、在指标和成本估算中跟踪提示缓存令牌、将 Quarkus Proxy Registry 集成到 Bedrock 提供商、为 agentic 系统添加构建时安全检查、支持 watsonx.ai 按需部署,并升级至 LangChain4j 1

6月27日周六 · 1 条
正文结构化主题已通过公开置信门槛
Ahead of AI教程

本地编码代理:用开放权重模型替代订阅服务

本文是一篇关于使用开源工具和开放权重模型搭建本地编码代理的教程,作者介绍了如何用本地LLM和编码框架替代Claude Code和Codex订阅服务。文章强调了本地方案在成本、隐私、可定制性方面的优势,并主要使用Qwen3.6模型和Qwen-Code框架,同时提及了其他框架如Claude Code、Codex和Cline。作者还引用了Nvidia的Polar论

6月25日周四 · 2 条
正文结构化主题已通过公开置信门槛
Flowise Releases一手来源产品发布

Flowise v3.1.3 发布:新增 MCP 服务器支持与模型更新

Flowise 发布 v3.1.3 版本,包含多项修复和新功能,如修复点击劫持漏洞、将聊天流转换为 MCP 服务器、支持 Anthropic Claude Opus 4.7 和 GPT-5.5 模型,并优化了 AgentFlow 的 UI 和功能。

正文结构化主题已通过公开置信门槛
Google DeepMind News一手来源产品发布

Gemini 3.5 Flash 内置计算机使用功能,强化智能体自动化

Google DeepMind 宣布在 Gemini 3.5 Flash 中内置计算机使用功能,使开发者能够构建可跨浏览器、移动和桌面环境执行任务的智能体。该功能通过对抗性训练降低提示注入风险,并推出两项可选的企业级防护措施。目前已有客户在利用该功能创造价值。

6月24日周三 · 3 条
正文结构化主题已通过公开置信门槛
Gemini API Release Notes一手来源产品发布

Gemini 3.5 Flash 推出 Computer Use 工具公开预览

Gemini API 于 2026 年 6 月 24 日发布更新,宣布 Gemini 3.5 Flash 中的 Computer Use 工具进入公开预览。该工具支持简化操作、内置浏览器/移动/桌面环境支持、可配置安全策略及高级提示注入检测。

正文结构化主题已通过公开置信门槛
Mistral AI News一手来源产品发布

Mistral AI 增强连接器控制,提升企业 AI 集成安全性与可管理性

Mistral AI 为其 Connectors 平台推出多项新功能,包括增强的管理员控制、带作用域的 API 密钥、多账户连接器、调试器,以及将连接器集成到 Workflows 和 Vibe Code 中。这些功能旨在为企业提供更安全、更可控的 AI 工作流集成体验,支持超过 60 个预构建连接器及自定义 MCP 选项。

正文结构化主题已通过公开置信门槛
Google ADK JavaScript Releases一手来源产品发布

Google ADK JS v1.3.0 发布:新增技能注册表与 Gemini 3.x 支持

Google 发布了 ADK JavaScript 库的 v1.3.0 版本,新增了 --reload agents 标志以监视代理文件变化,支持 Gemini 2.5 和 3.x Live 模型,并引入了技能注册表核心接口、远程 GCP 技能注册表集成以及 OpenAPI REST API 工具实现。此外,该版本还修复了多个 bug,包括流式传输中的原型污

6月23日周二 · 2 条
正文结构化主题已通过公开置信门槛
Claude App Release Notes一手来源产品发布

Claude App 更新:在 Slack 中通过 Claude Tag 委派任务

Claude App 发布更新,团队版和企业版用户现在可以在 Slack 对话中直接标记 Claude,并委派任务给它,以便用户专注于其他工作。该功能通过 Claude Tag 实现,相关详细信息已在官方博客中公布。

正文结构化主题已通过公开置信门槛
Mistral AI News一手来源模型发布

Mistral OCR 4 发布:支持边界框与置信度评分,性能领先

Mistral AI 发布了 Mistral OCR 4,这是一款文档解析模型,支持边界框、块分类和置信度评分,覆盖 170 种语言,并可在单容器中自托管部署。该模型在人类评估和 OlmOCRBench 基准上表现优异,价格低至每千页 2 美元(批量 API),适用于企业搜索、RAG 和代理工作流。

6月22日周一 · 1 条
正文结构化主题已通过公开置信门槛
Interconnects AI模型发布

GLM-5.2:开源代理模型的重大突破

Z.ai 于 2026 年 6 月发布了开源模型 GLM-5.2,该模型在编码代理任务中表现出色,被社区视为开源代理的转折点。其性能在多个基准测试中与 OpenAI 和 Anthropic 的闭源模型相当,甚至超越,引发了广泛关注。作者认为 GLM-5.2 缩小了开源与闭源模型的能力差距,并可能对 Anthropic 等闭源实验室构成竞争压力。

6月21日周日 · 1 条
正文结构化主题已通过公开置信门槛
Eugene Yan研究

构建网络安全评估的模式

Eugene Yan 撰文探讨了构建网络安全评估(cybersecurity evals)的模式,介绍了评估模型漏洞利用能力的通用框架,包括沙箱目标、难度输入、工具和评分器。文章重点分析了 Cybench 等基准测试的设计与结果,指出当前模型在复杂任务上表现有限,如 Claude 3.5 Sonnet 在无引导模式下成功率仅 17.5%。

6月19日周五 · 3 条
正文结构化主题已通过公开置信门槛
Cloudflare AI Blog一手来源产品发布

Cloudflare 推出 AI 代理临时账户,实现免注册部署

Cloudflare 推出了面向 AI 代理的临时账户功能,允许代理无需注册即可通过 Wrangler CLI 的 --temporary 标志部署 Worker,部署有效期为 60 分钟,用户可在此期间认领账户。该功能旨在消除代理部署时的注册障碍,支持代理快速迭代和验证代码。Cloudflare 还计划通过与其他公司的合作进一步简化代理部署流程。

正文结构化主题已通过公开置信门槛
LangGraph Releases一手来源产品发布

LangGraph 1.2.6 发布:修复子图继承与流中止问题

LangGraph 发布了 1.2.6 版本,修复了嵌套子图继承父级 checkpoint ns 的回归问题,以及在 v3 流中止时取消运行中子图的问题。同时更新了 CLI 到 0.4.30,并升级了依赖 tornado 至 6.5.6。

正文结构化主题已通过公开置信门槛
Cloudflare AI Blog一手来源教程

Cloudflare 发布构建模型无关漏洞检测工具的实践指南

Cloudflare 在 Project Glasswing 中发布了一篇关于构建漏洞检测工具的技术博客,介绍了如何将安全审计技能转化为模型无关的流水线,以应对前沿 AI 带来的安全威胁。文章强调了模型互换、状态外部化和跨仓库依赖追踪的重要性,并分享了从单仓库技能到全舰队扫描的架构演进经验。

6月18日周四 · 1 条
正文结构化主题已通过公开置信门槛
Quarkus LangChain4j Releases一手来源产品发布

Quarkus LangChain4j 1.7.6 发布:更新至 LangChain4j 1.11.8

Quarkus LangChain4j 发布了 1.7.6 版本。该版本强化了 MCP 工具示例的系统提示词以强制工具使用,并将 LangChain4j 更新至 1.11.8。此更新提升了 Quarkus 应用中 LangChain4j 集成的稳定性和功能。