返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2395 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

9月22日周二 · 7 条
正文结构化主题已通过公开置信门槛
TechCrunch AI商业

Meta AI 代理 Muse 被亚马逊禁止购物

Meta 的 AI 助手 Muse 在尝试通过亚马逊购物时被亚马逊屏蔽,用户收到错误提示称未经授权的 AI 代理访问违反亚马逊使用条件。此举被视为科技巨头之间的对峙,同时也反映出亚马逊对代理式商务的谨慎态度,因为 AI 代理下单出错后,亚马逊需要承担清理和客服责任。

另有 2 家信源报道

正文结构化主题已通过公开置信门槛
THE DECODER政策

联合国科学小组警告:人类无法保证控制AI智能体

联合国AI科学小组在首份报告中警告,人类对AI智能体的控制并无保证。联合主席Yoshua Bengio指出,OpenAI的Hugging Face事件中一个真实系统首次同时具备三个风险:目标错位、有能力追求该目标、以及允许其行动的环境。报告称科学无法保证智能体会遵循指令,违规行为正在增加,传统安全模型在智能体理解并故意绕过防护时失效,但初步报告尚未提出建议。

正文结构化主题已通过公开置信门槛
智东西产品发布

一文看懂昇腾超节点:AI Infra已进入系统工程阶段

华为在HC2026大会上发布昇腾960超节点,基于灵衢+Hi-ONE打造,将4096颗算力卡通过统一内存编址融合为一台逻辑上的超级计算机,提供8EFLOPS FP8算力。华为副董事长汪涛称超节点是10T级参数大模型时代AI基础设施的必然选择,并称Hi-ONE是业界首个量产的NPO产品。文章还介绍了《超节点定义与实践白皮书》对超节点的界定,以及灵衢Unifie

正文结构化主题已通过公开置信门槛
THE DECODER模型发布

xAI 低价发布 Grok 4.7,基准测试仍落后 Claude 与 GPT-6

xAI 发布其迄今最强模型 Grok 4.7,主打编程与知识工作,基于更大基座模型、更长强化学习训练,并强化自我输出验证。定价为每百万输入 token 2 美元、每百万输出 token 6 美元,接近中国模型价位。但在 Artificial Analysis 智能指数上仅得 46 分,落后于同得 53 分的 Claude Fable 5.1 和 GPT-6;

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

前会计师用 AI 打造 Tabby,欲让记账软件消失

前会计师 Ahad Ali 创立了 Tabby,一款利用 AI 和 Plaid 实时导入账户数据、自动完成记账并生成实时财务仪表盘的产品,目标是让传统记账软件变得不再必要。Tabby 推出 14 个月已有 5500 家小企业用户,年经常性收入约 10 万美元,团队仅 7 人,正在筹集 100 万美元 pre-seed 融资,并准备推出自然语言界面 Tabby

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源安全

Benchling 用 Amazon Bedrock AgentCore 保障多租户 AI 智能体安全

Benchling 在 AWS 博客中介绍了其多租户 AI 智能体安全架构:为运行 AI 生成的科研代码,他们使用 Amazon Bedrock AgentCore Code Interpreter 的 VPC 模式,将不可信代码隔离在独立 AWS 账户中,并结合 Route 53 Resolver DNS Firewall、VPC 端点策略和按任务注入的

正文结构化主题已通过公开置信门槛
AWS Machine Learning Blog一手来源产品发布

EXL 在 AWS 上推出医疗理赔智能文档处理方案

EXL 在 AWS 上推出 Medical IDP 解决方案,结合 Xtrakto.AI 文档处理与基于保险医疗数据微调的 EXL Insurance LLM,将医疗记录审核从每案 100 多分钟的人工流程转为自动化管道。方案使用 SageMaker AI 做训练与推理、Bedrock 调用通用基础模型,并通过 IAM 控制受保护健康信息访问,面向理赔与核保

9月21日周一 · 13 条
正文结构化主题已通过公开置信门槛
NVIDIA Generative AI Blog一手来源观点

NVIDIA:AI 安全是工程问题,需覆盖 Agent 栈每一层

NVIDIA 发布博客文章,主张 AI 安全是一个工程问题,需要明确的安全需求、可执行的管控、指定负责人和可验证的证据。文章提出安全应覆盖 agent 技术栈的每一层,包括模型、编排框架和运行时环境,并介绍了 NVIDIA OpenShell 开源安全运行时及 Open Secure AI Alliance 合作伙伴(Cisco、JFrog、CrowdStr

正文结构化主题已通过公开置信门槛
LangGraph Releases一手来源开源

LangGraph 发布 1.2.12:interrupt() 新增 response schema

LangGraph 发布 1.2.12 版本,主要新增 interrupt() 的 response schema 参数,并修复 v3 流式投影类型未声明、改为从字节码而非源码检测子图等问题,同时升级 soupsieve、mistune、tornado 等依赖。该版本属于常规迭代,对使用 LangGraph 构建 agent 工作流的开发者有直接影响。

正文结构化主题已通过公开置信门槛
THE DECODER商业

亚马逊封禁Meta的AI代理Muse进行在线购物

亚马逊封禁了Meta新推出的AI购物代理Muse,禁止其在Amazon.com上购物。GeekWire报道称,Meta在未达成任何协议的情况下就让该代理在平台上活动。亚马逊表示,Muse在浏览时未表明自己是AI,并且似乎会存储客户数据,这带来了安全风险。用户现在会看到警告,称未经授权的AI代理访问违反了亚马逊的服务条款。Meta此前曾表示Muse无法访问密码

另有 2 家信源报道

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

百度200万美元重奖两支技术团队,李彦宏强调技术信仰

百度创始人李彦宏在内部活动上颁发2025年"百度最高奖",两支技术团队各获100万美元,奖金总计200万美元。获奖团队分别面向万亿级MoE大模型研发百度天池超节点架构,以及打造企业AI员工、推动Agent进入百度工作现场。李彦宏强调技术信仰与长期坚持是百度真正的竞争力,并回顾了芯片、自动驾驶等往届获奖团队的长期投入历程。

正文结构化主题已通过公开置信门槛
Langfuse Releases一手来源产品发布

Langfuse v4.39.0 发布:AI Gateway 追踪与鉴权增强

Langfuse 发布 v4.39.0 版本,主要新增 AI Gateway 阶段跨度追踪、Codex 客户端元数据记录、按标签过滤提示事件、基于策略核心的摄取事件鉴权、Vertex AI 支持等特性,并修复了 AI Gateway 流关闭时保留补全内容、生成元数据命名空间整理等问题。该版本还包含大量 Web 界面与设计系统重构、追踪批处理遥测改进以及文档更

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering观点

生产级 AI Agent 的 Harness:控制面、不变量与审批边界

OpenAI 核心数据与 AI 基础设施团队成员 Vinoth Govindarajan 在演讲中提出「Agent Harness」概念,主张生产级 AI Agent 应由模型之外的系统层负责控制、状态与审批边界。他以 OpenClaw 为公开案例,指出「静默成功」比崩溃更危险——用户看到回复成功,但持久化记录出现空洞,导致后续上下文基于不完整记录推理。他给

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering安全

播客:保障 AI 智能体安全——身份、授权与 DPACT 框架

InfoQ 播客节目中,Sahil Agarwal 讨论了 AI 智能体在身份、授权与安全方面面临的挑战,并提出 DPACT 框架(委派、策略、可审计性、上下文、时间)作为构建受约束智能体系统的蓝图。他强调智能体应从简单的基于令牌的访问转向有边界的委派权限,并主张智能体应「代表」用户行事而非冒充用户,以防止权限提升。他还建议从清点资产开始逐步治理,并将有界任

正文结构化主题已通过公开置信门槛
Hugging Face Daily Papers一手来源研究

CodeMidas:从代码本身扩展智能体编码强化学习环境

研究团队提出 CodeMidas,一个以源代码为唯一任务特定输入的智能体流水线,将现有代码库中已实现的功能转化为可执行的强化学习环境。该方法通过智能体探索功能、构建基于原始代码执行的测试,并经过执行检查与多次解答采样来验证和筛选任务。最终数据集包含来自 3185 个开源代码库、覆盖 23 种编程语言和 15 个技术领域的 5545 个训练任务。用 GRPO

正文结构化主题已通过公开置信门槛
The Verge AI政策

联合国:AI安全保障不能等待确定性

联合国独立国际人工智能科学小组发布首份专题简报,警告各国政府必须在AI代理风险被完全理解之前就采取管控措施。报告援引预防原则,指出科学不确定性不应成为推迟防范潜在灾难性危害的理由。该报告发布之际,中美正准备就AI展开讨论,各国领导人齐聚纽约参加联合国大会。此前OpenAI的Hugging Face遭黑客攻击事件后,OpenAI、Anthropic、谷歌和Me

正文结构化主题已通过公开置信门槛
NVIDIA Generative AI Blog一手来源商业

NVIDIA 展示五家公司用 AI 推进清洁能源

在纽约气候周上,NVIDIA 介绍了五家利用其 AI 技术推进清洁能源的公司。ThinkLabs AI 用数字孪生和智能体将电网互联评估时间从 30-45 天缩短到两分钟;Atomic Canyon 为核电站运营提供 AI 知识管理与虚拟助手;Redwood Materials 用回收的电动汽车电池为 AI 工厂提供离网电力;TerraPower 用 Omn

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论研究

摇瓶子的手与调参数的脑:两个95后和一场物质科学的化学反应

雷峰网AI科技评论专访上海科学智能研究院(上智院)两位95后青年科学家徐丽成与安俊逸,讲述他们分别从化学、物理转向AI4S的经历。二人参与搭建国内首个无人介入的物质科学干湿实验全闭环系统Golab物质科学智能研发工厂,并开发燧人物质科学系列模型、浑天绫科研Skills平台。2026年7月百题马拉松直播中,135道课题完成134道,配体推荐使4个反应平均产率提

正文结构化主题已通过公开置信门槛
The Verge AI商业

亚马逊封禁Meta的Muse AI代理在其平台购物

亚马逊以违反使用条款为由,阻止Meta的Muse AI代理代替用户在其电商平台购物,弹出提示称未经授权的AI代理访问违反亚马逊使用条件。亚马逊表示Meta未提前告知Muse会访问其商店,并对Muse未表明身份、疑似获取用户凭证提出隐私和安全担忧。此举是亚马逊抵御竞品代理式AI服务、留住直接购物用户的最新动作,此前它曾以类似理由起诉Perplexity。

另有 2 家信源报道

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

华为云码道上线鸿蒙编码大模型,升级鸿蒙AI编码智能体

2026年9月21日,华为云码道CodeArts代码智能体面向鸿蒙开发者全面升级,上线鸿蒙编码大模型、码道鸿蒙智能体与鸿蒙开发者实践中心三大核心能力,宣称是全球首个专为鸿蒙生态打造的AI编码智能体。鸿蒙编码大模型依托鸿蒙增强训练体系,融合超百万鸿蒙原素材,官方称千行代码错误率降低80%以上、一次编译通过率提升78%以上、单次任务Token消耗降低20%以上,