返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2463 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月16日周日 · 1 条
正文结构化主题已通过公开置信门槛
TechCrunch AI商业

SpaceX 正式完成对 Cursor 的收购

AI 编程初创公司 Cursor 正式被 SpaceX 收购,成为其一部分。SpaceX 此前已收购 xAI,并拥有全球最大的 GPU 集群,Cursor 将利用该基础设施扩展其 AI 编程工具。此次收购最初于 4 月宣布,交易金额为 600 亿美元,现已完成。

8月15日周六 · 16 条
正文结构化主题已通过公开置信门槛
Latent Space产品发布

Flue 2 引入 React 风格 Hooks,重新定义代理开发

Flue 2 由 Astro 创建者 Fred Schott 发布,引入了受 React 启发的 Agent Hooks,使代理能够动态管理状态、监听生命周期事件并附加资源。Schott 认为代理必须依赖 harness 环境,Flue 基于开源 Pi 构建,旨在提供比传统 web 框架更灵活的代理组合方式。该框架已用于构建支持机器人和分诊机器人,并强调与

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering研究

DoorDash 从模型到智能体:构建大规模上下文感知消费者 AI

DoorDash 机器学习与 AI 负责人 Sudeep Das 在 QCon AI 大会上分享了公司从传统一次性预测向智能体推荐平台转型的经验。他介绍了利用语言原生消费者记忆、RQ-VAE 语义 ID 进行目录表示以及基于检索的搜索,显著提升了相关性和转化率指标。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering产品发布

Cloudflare 推出 Agent Tracing,带截断限制和不均匀的负载默认值

Cloudflare 推出了 agent tracing,这是 Cloudflare Agents 的首个组件,用于在统一仪表板中收集部署的 agent 会话。该功能在现有 Workers tracing 基础上增加了 agent 级 span,并附带定价日期:测试期间免费,自 2026 年 10 月 1 日起纳入 Workers Observability

正文结构化主题已通过公开置信门槛
量子位模型发布

Qwen3.8-27B开源:消费级显卡跑Opus级Agent,多项评测超Claude

阿里开源了Qwen3.8-27B模型,总参数270亿,支持原生多模态、262K上下文,在SWE-bench Pro等多项代码和Agent评测中超越Claude Opus 4.6 Max。模型内置可调节的推理档位和preserve thinking功能,并支持通过Transformers、vLLM等框架部署,可在消费级显卡上运行。

正文结构化主题已通过公开置信门槛
量子位开源

DeepSeek Harness插件生态爆发:700+仓库,从多Agent到电子宠物

DeepSeek Harness插件生态在GitHub上爆发,已有超过700个相关仓库。开发者为其开发了多类插件,包括多Agent团队管理、侧边栏IDE、文件引用、长期记忆、Claude数据迁移、视觉理解等实用功能,以及电子宠物、小游戏、复古广告等趣味插件。这些插件极大扩展了DeepSeek Harness的能力,使其从单一Agent工具演变为可高度定制的开

正文结构化主题已通过公开置信门槛
量子位产品发布

鸿蒙元服务推出ASCF框架,助力开发者低成本高效开发

华为鸿蒙推出元服务及ASCF跨端框架,帮助开发者低成本迁移小程序等存量资产,并借助AI插件和零代码工具提升开发效率。京东、深圳万象城等案例显示,该方案能缩短开发周期并带来商业增长。鸿蒙通过系统级入口和智能分发,推动服务从App向轻量元服务转型。

正文结构化主题已通过公开置信门槛
arXiv cs.AI一手来源研究

LLM辅助多轮合同网协议用于移动边缘计算流处理调度

本文提出 MAS-DecStream 系统,其核心是 LLM-MR-CNP 协议,扩展了经典合同网协议,引入语义化 CFP 生成、渐进式上下文披露、多轮提案修订、协商记忆和确定性验证。实验基于阿里 ASI 追踪数据,结果显示该方案将延迟违规率降至 3%,消除资源过度承诺,在 20 个代理下冲突解决率达 0.91,效用相比多轮规则基线提升最多 22%。研究表明

正文结构化主题已通过公开置信门槛
OpenAI Agents JavaScript Releases一手来源产品发布

OpenAI Agents JS SDK v0.16.0 发布:新增测试工具与标准模式支持

OpenAI 发布了 Agents JavaScript SDK v0.16.0,新增了确定性的 SDK 测试工具,支持 Standard Schema 输入输出,并增强了运行、提供者和 Realtime 行为的安全性。该版本还修复了多个核心、沙箱和 Realtime 相关的问题,提升了稳定性和兼容性。

正文结构化主题已通过公开置信门槛
PydanticAI Releases一手来源产品发布

PydanticAI v2.31.0 发布:UIEventStream 增强与多项修复

PydanticAI 发布 v2.31.0 版本,新增功能允许 UIEventStream 无需 run input 构建,并为 AGUIEventStream 提供独立的 thread id/run id。同时修复了 FallbackModel 失败跨度归属错误以及 Temporal 工作流沙箱中 openai 传递问题。

正文结构化主题已通过公开置信门槛
OpenAI Agents Python Releases一手来源产品发布

OpenAI Agents Python SDK v0.21.0 发布:新增测试工具与兼容性更新

OpenAI 发布了 Agents Python SDK 的 v0.21.0 版本,主要新增了 provider-neutral 的测试工具(agents.testing、agents.realtime.testing、agents.voice.testing),用于无需 provider 请求的确定性测试,并更新了对 OpenAI Python v3 和

正文结构化主题已通过公开置信门槛
Interconnects AI模型发布

GLM-5.3 发布:中国实验室如何保持前沿竞争力

Z.ai 发布了 GLM-5.3 模型,目前仅在编程计划中提供,API 即将上线,两周后开放权重。该模型在多个基准测试中超越了 Moonshot AI 的 Kimi K3,部分指标甚至超过 Claude Fable 5 和 GPT-5.6-Sol,且参数量仅为 Kimi K3 的三分之一。Z.ai 表示 GLM-5.3 基于 GLM-5.2 的相同基础模型,

正文结构化主题已通过公开置信门槛
THE DECODER模型发布

阿里Qwen发布Qwen3.8开源模型,性能超越更大版本

阿里巴巴的Qwen团队发布了Qwen3.8系列模型,包括核心的Qwen3.8-27B多模态稠密模型和更大的Qwen3.8-2.4T-A95B模型,权重以Apache 2.0许可证开源。Qwen3.8-27B在编码和办公任务上优于更大的Qwen3.7-Plus,并增强了智能体能力,原生支持262K上下文,可通过YaRN扩展到100万,支持图像和视频处理。模型已

正文结构化主题已通过公开置信门槛
THE DECODER产品发布

OpenAI 推出 Computer History:将点击和按键转化为可搜索的 ChatGPT 记忆时间线

OpenAI 推出了名为“Computer History”的新功能,通过 macOS 辅助功能记录用户的点击、按键和应用切换等交互事件,生成可搜索的时间线,供 ChatGPT 和 Codex 作为上下文使用。该功能取代了之前的“Chronicle”预览版,不捕获屏幕截图或音频,且需要管理员和用户双重同意。OpenAI 警告存在提示注入风险,并建议敏感应用暂

正文结构化主题已通过公开置信门槛
Ollama Releases一手来源产品发布

Ollama v0.32.12 发布,支持 Qwen 3.8 27B 模型

Ollama 发布 v0.32.12 版本,新增对 Qwen 3.8 27B 模型的支持。该版本针对 Apple Silicon 设备进行了优化,以提升性能和输出质量,特别适用于重复任务和编码代理场景。Qwen 3.8 在编码、专业工作、研究及长周期代理任务中表现出显著提升。

正文结构化主题已通过公开置信门槛
THE DECODER研究

新研究质疑Anthropic和OpenAI关于自主AI研究的说法

普林斯顿大学与英国AI安全研究所联合发布了一项研究,通过“影子评估”方法测试前沿AI模型(如Claude Opus 4.8和GPT-5.6)的自主研究能力。结果显示,这些模型能完成工程任务,但在研究判断、创造性问题解决和资源管理上存在系统性缺陷,生成的两篇论文均被原审稿人拒绝。该研究对Anthropic和OpenAI关于AI可加速自身研究的说法提出了质疑。

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

Amazon Nova Forge 多轮强化学习自定义奖励函数指南

AWS 机器学习博客介绍了 Amazon Nova Forge 的多轮强化学习自定义奖励函数设计。文章强调奖励函数决定模型学习行为,并展示了通过 BYOO 在自有环境运行奖励逻辑,以及使用 GRPO 优化累计奖励。还讨论了奖励评估流程、代码安全执行和常见陷阱,并提供了相关基础设施和示例代码。

8月14日周五 · 3 条
正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

AWS 展示 SageMaker AI 与 Bedrock AgentCore 构建多智能体工作流

AWS 展示了如何将 SageMaker AI 上的 OpenAI 兼容端点与 Bedrock AgentCore 运行时结合,构建多智能体工作流。该架构通过 Bedrock AgentCore 容器连接编排器(Claude Haiku 4.5)、预算智能体(Claude Sonnet 4.6)和财务分析智能体(Qwen 3.5 9B),实现成本优化、数据驻

正文结构化主题已通过公开置信门槛
LangChain4j Releases一手来源产品发布

LangChain4j 1.19.0 发布:支持 MCP 更新、Milvus V2 及 Anthropic 批量模型

LangChain4j 发布了 1.19.0 和 1.19.0-beta29 版本,主要更新包括:MCP 客户端更新至 2026-07-28 规范,支持 Milvus V2 服务及混合搜索,新增工具操作补偿机制,以及 AnthropicBatchChatModel 支持 Anthropic Message Batches API。此外,还增加了 watson

正文结构化主题已通过公开置信门槛
Cloudflare AI Blog一手来源产品发布

Cloudflare 推出新功能检测并保护 MCP 流量

Cloudflare 宣布推出新的 Cloudflare One 功能,用于识别和检查 MCP(模型上下文协议)流量,显示哪些用户和服务器在生成该流量,并控制受管网络路径上的直接连接。这些控制措施结合 MCP Server Portals,帮助管理员确保代理使用经批准的路径,防止影子 MCP 流量。文章详细分析了 MCP 工具调用的结构,并比较了在客户端、网