返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2394 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月23日周三 · 2 条
正文结构化主题已通过公开置信门槛
Anthropic TypeScript SDK Releases一手来源API 更新1

Anthropic TypeScript SDK v0.128.0 发布

Anthropic 发布 TypeScript SDK v0.128.0,新增对 claude-opus-5-5 模型、内联工具定义以及 MCP 工具列表固定(beta)的支持。同时修复了 Managed Agents 事件中 evaluated permission 枚举共享、addTools() 即时生效以及工具运行器压缩请求参数等问题,并补充了 Dre

正文结构化主题已通过公开置信门槛
Anthropic Python SDK Releases一手来源API 更新1

Anthropic Python SDK v1.8.0 发布:支持 claude-opus-5-5 与 MCP 工具列表固定

Anthropic 发布 Python SDK v1.8.0,新增对 claude-opus-5-5 模型的支持,并引入内联工具定义与 MCP 工具列表固定(beta)能力。同时修复了流式请求在 Python 3.13 退出时崩溃、add tools() 未即时生效等问题,并更新了 Dreams、User Profiles、Managed Agents 等

9月22日周二 · 18 条
正文结构化主题已通过公开置信门槛
正文结构化主题已通过公开置信门槛
量子位商业

Agent时代CPU价值重估:英特尔称CPU与GPU配比趋近1:1

英特尔在苏州技术创新与产业生态大会上提出,Agent时代AI计算配比正从CPU与GPU的1:4趋近1:1,CPU需承担更多调度、数据处理与任务编排工作。英特尔介绍了至强处理器的数据预处理加速、KV Cache无损压缩与存储优化方案,并强调与Linux、PyTorch等开源项目及国内软件伙伴的合作。大会还提及端侧CPU、GPU、NPU协同及家庭AI、车载AI、

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布1

Reactiv 用 Amazon Bedrock AgentCore 将移动电商自动化提速 80%

Reactiv 为 Shopify 商家提供原生移动应用产品,利用 Amazon Bedrock AgentCore 构建了一个由三个 agent 组成的 AI Scheduler,可按计划自动更新商家应用首页和促销内容。该方案将商家配置时间减少 80%,上线速度提升 33%,并借助 AgentCore 的托管运行时、持久记忆、原生 MCP 托管和多租户隔离

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布1

Trane 借助 Amazon Bedrock AgentCore 将建筑洞察速度提升 60 倍

Trane Technologies 利用 Amazon Bedrock AgentCore 和 Strands 框架,在 3-4 周内构建了一个多智能体 AI 解决方案,将原本需要 20 分钟跨多个仪表盘和菜单的诊断工作流缩短为 20 秒的自然语言交互,实现 60 倍的时间效率提升。该方案通过分离智能体逻辑与工具执行、集中式工具网关集成实时遥测数据、以及针

正文结构化主题已通过公开置信门槛
THE DECODER政策

OpenAI 呼吁为可自我改进的 AI 制定国际标准

OpenAI 呼吁就具备递归自我改进(RSI)能力的先进 AI 制定国际标准,认为完全自主的 RSI 目前尚未发生,但应在确保安全的前提下推进。OpenAI 提议由美国主导全球技术标准,依托各国 AI 安全研究机构以及 CAISI、ISO 等组织,建立共享测量方法、事件报告机制和人类监督规则。联合国一个科学小组近期也提出类似担忧,警告可能失去对自主智能体集群

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源教程

AWS 结合 Agentforce 与 MCP 扩展公共部门情报能力

AWS 发布博客,介绍如何将 Amazon Bedrock Data Automation 与 Model Context Protocol (MCP) 结合,把公共部门机构中的执法记录仪视频、监控录像、扫描文档等非结构化证据转化为结构化洞察。方案通过 S3 事件触发 Lambda 和 Bedrock Data Automation 异步处理多模态数据,结果

正文结构化主题已通过公开置信门槛
TechCrunch AI商业

TechCrunch Disrupt 2026 五场 AI 安全会议前瞻

TechCrunch 预告了 Disrupt 2026 大会上的五场 AI 安全相关会议,覆盖企业部署 Claude、Agent 安全、企业云安全、物理世界 AI 安全以及机器人数据瓶颈等议题。Anthropic、Okta、AWS、Shield AI、通用汽车、Waabi、NVIDIA 等公司的高管将分别分享企业 AI 落地、Agent 权限架构、安全治理、

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

AstroForge 用 AI 自主控制其下一艘航天器

小行星采矿初创公司 AstroForge 为其航天器开发了名为 Solo 的自主控制栈,这是一个基于 Transformer 的自研模型,用于在缺乏地面控制资源的情况下让航天器自主解决异常。该公司计划于 2027 年由 Stoke Space 的首次火箭发射其首艘自主航天器 Autonomy-1,并可能不搭载可接收地球指令的无线电。此前其两艘原型航天器均因异

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

千问办公发布企业上下文与Agent硬件QwenNote A2

9月22日云栖大会上,千问办公发布企业级Agent基础设施“企业上下文”(Enterprise Context)和名片大小的AI硬件QwenNote A2。Enterprise Context将群聊、文档、知识库和业务系统中的企业信息压缩、结构化并按需调用,QwenNote A2则通过录音转写补上线下对话这一外部上下文来源。千问办公CEO陈宇森认为模型能力已

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering开源

Google 开源 AX:面向自主 AI 智能体的 Kubernetes 式编排器

Google 开源了 AX,一个基于 Apache 2.0 许可的编排器和声明式运行时,用于执行和扩展自主 AI 智能体工作负载,托管于 agentexecutor.io 和 GitHub 的 google/ax。AX 运行在 Agent Substrate 之上,将智能体视为有状态 actor,提供亚秒级任务挂起与恢复,并定义 Task、Workspace

正文结构化主题已通过公开置信门槛
量子位商业

WebArena作者Shuyan Zhou入职Meta超级智能实验室

哈工大校友、WebArena作者Shuyan Zhou宣布今年年初离开杜克大学教职,加入Meta超级智能实验室(MSL),核心工作是开发AI浏览器。她此前在CMU攻读博士期间主导了WebArena、VisualWebArena和OSWorld等网页与计算机智能体评测基准,谷歌学术引用达9569次。此次加入的MSL成立于2025年6月,已推出多模态推理模型Mu

正文结构化主题已通过公开置信门槛
The Verge AI安全

Meta 修复 Muse 零日漏洞,该漏洞可让攻击者控制 AI agent

Meta 的 macOS 应用 Muse 被安全研究员 Patrick Wardle 发现存在零日漏洞,攻击者可利用未公开设置将转录处理重定向到自己的服务器,从而控制 AI agent 并访问账户。Meta 在 Ars Technica 报道发布后数小时内发布热修复补丁,并称该漏洞属于本地权限提升、实际风险较低。此事发生在 Muse 发布初期,同时 Amaz

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
量子位模型发布

小米直播6天烧2000多万训练MiMo-V2.6,拿下开源第一并全量开源

小米将MiMo-V2.6-Pro和Flash的大模型强化学习训练全程直播,6天花费约350万美元(约2344万元人民币),Pro以1.02万亿参数、420亿激活在Artificial Analysis Intelligence Index上获46分,位列开源第一。小米同时开源模型权重、技术报告、7000多个RL任务环境和端到端RL训练框架,并披露了异步RL架

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

将VLM智能迁移至机器人控制

该论文提出 RoboDawn,一种通过离散平移、旋转和夹爪命令将视觉语言模型(VLM)接入机器人控制的接口,使 VLM 能以闭环方式观察、推理并执行动作。作者引入上下文学习(ICL)方案,用少量演示让 VLM 掌握接口使用与任务策略。在 RoboTwin 2.0 C2R 和 RoboDojo 基准上,零样本即超越多个专用训练策略,单样本演示后成功率分别从 5

正文结构化主题已通过公开置信门槛
量子位观点

基元律动韩凯:从多模型调度到反馈闭环探索Agent进化

基元律动联合创始人兼CTO韩凯在2026杭州云栖大会企业级Agent实践峰会上发表演讲《从Harness到RSI飞轮》,提出多模型异构并存与算力多元供给将是长期结构,Agent任务表现取决于模型选择、工具调用与上下文管理等系统能力。基元律动以开源项目OpenSquilla探索模型路由,称在特定测试配置下保留固定旗舰模型基线99.96%的任务质量并将成本降低8

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

阿里云发布AgentCore等新品,加速构建Agentic Cloud

在2026杭州云栖大会上,阿里云CTO李飞飞系统阐述了Agentic Cloud战略,将Model、Harness、Context作为核心构建场景,并发布企业级Agent构建治理平台AgentCore、Agent Sandbox、新一代高性能存储CPFS等新品。阿里云重构了从AI Native Cloud、Agent Native Cloud到Context

正文结构化主题已通过公开置信门槛
THE DECODER商业

Anthropic 建生物实验室,让 Claude 指导机器人做药物实验

Anthropic 正在旧金山地区建立自己的生物实验室,计划让 Claude 指导机器人以最少人工干预完成药物实验,并已推出 Claude Science 研究工具和用于控制实验室设备的 Model Hardware Standard。其生命科学部门负责人 Eric Kauderer-Abrams 认为最大机会在于攻克长期“不可成药”的疾病,AI 可加速设计

正文结构化主题已通过公开置信门槛
Hugging Face New and Trending Models一手来源模型发布1

poolside 发布 Laguna XS.2:33B MoE 本地智能体编程模型

poolside 发布 Laguna XS.2,一个 33B 总参数、每 token 激活 3B 的混合专家(MoE)模型,面向本地运行的智能体编程与长周期任务。模型采用滑动窗口注意力与全局注意力 3:1 混合布局、FP8 KV 缓存和原生交错推理,支持 262,144 token 上下文,并以 Apache 2.0 许可开源。在 SWE-bench Ver