返回主题地图

Agent 智能体

技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2401 条

只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。

8月20日周四 · 20 条
正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

晨昏线科技亮相世界机器人大会,提出“1×N+1”具身智能概念

晨昏线科技在2026世界机器人大会上提出“1×N+1”概念,展示一个具身大脑连接多种机器人本体、生态伙伴与产业场景。其自研目标因果世界模型GCWM1及配套模型,使机器人能跨场景理解与执行任务,如工业上下料、零售服务等,并已与华为、理工华汇合作,推动具身智能在真实场景落地。

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

Meta 推出 Mac 版 AI 应用,支持系统级听写与屏幕问答

Meta 发布了适用于 Mac 的 Meta AI 应用,内置系统级听写功能,并能基于屏幕内容使用 Muse Spark 模型回答问题。该应用还面向企业主,允许连接 Instagram、Facebook、广告活动和 Google Workspace 账户,提供营销洞察、创建提案和文档。此举是 Meta 推动 AI 工具服务企业自动化的一部分,CEO 马克·扎

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering产品发布

InfoQ 推出 AI 辅助工程在线认证项目

InfoQ 推出了新的在线认证项目“AI辅助工程”,面向资深工程师和架构师,旨在教授如何为生产代码中的 AI 编码代理构建验证框架。项目由 Thoughtworks 的 Zichuan Xiong 和 Premanand Chandrasekaran 主持,首期课程于 2026 年 9 月 18 日开始,为期五周,费用为 1470 美元。课程涵盖代理权限、审

正文结构化主题已通过公开置信门槛
The Verge AI产品发布

Slack 推出协作式氛围编码频道

Slack 推出了名为 Slack Code 的新功能,为团队提供专门的代码频道,以便与 AI 代理协作进行“氛围编码”。该功能允许用户通过标记编码代理(如 Anthropic 的 Claude 或 Cognition 的 Devin)来创建代码频道,在其中进行代码审查、预览和批准。Slack Code 从今天起对所有 Slack 套餐开放,并支持与 Cla

正文结构化主题已通过公开置信门槛
Agno Releases一手来源产品发布

Agno v3.0.0a2 发布:增强可靠性并新增工具

Agno 发布了 v3.0.0a2 版本,包含多项功能更新和修复。主要变更包括移除已弃用的参数、引入用户隔离评估、优化 AgentOS 元数据路由、增强后台执行的可靠性,并新增 FinanceTools 和 RampRouter 模型支持。此外,该版本还改进了 Studio 3.0 控制平面,并更新了 Cerebras 默认设置和模型。

正文结构化主题已通过公开置信门槛
量子位产品发布

光帆AI技术落地韶音OpenFit 2 AI耳机,共推AI实验室

韶音发布开放式耳机新品OpenFit 2 AI,并与光帆科技达成AI技术合作,将上线基于光帆自研AI OS的“AI实验室”功能合集,涵盖智能对话、日程待办等能力。这是光帆AI技术首次落地第三方硬件品牌,标志着其系统化AI能力对外输出。合作旨在提升耳机AI体验,并顺应AI硬件端侧规模化落地趋势。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

豆包上线侧边工作台,实现对话与操作同屏

豆包近日升级了生产力场景,在对话页面新增侧边工作台,支持多标签形式承载任务资源,实现AI对话与操作同屏进行。该工作台支持打开本地文件、飞书文档、在线网页及代码应用,并支持代码实时预览和网页自主操作,旨在提升办公和开发效率。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论商业

阿里云收入增速创新高,模型发布全面提速

阿里巴巴发布新季度业绩,阿里云外部商业化收入增速达45%,创22个季度新高,AI相关产品收入连续12个季度三位数增长。过去一个月,阿里密集发布多类模型,包括旗舰模型Qwen3.8-Max,并推出Agent产品“千问办公”。公司表示,前期在芯片、模型和基础设施上的投入已转化为商业回报。

正文结构化主题已通过公开置信门槛
量子位研究

Prime Intellect多智能体Harness让开源模型逼近顶级闭源模型

开源AI基础设施公司Prime Intellect发布研究,提出多智能体Harness系统,让更便宜的开源模型承担监控和实现任务,从而降低AI自主科研成本。实验中,18个前沿模型参与nanoGPT优化器速通,开源模型Kimi K3搭配Prime Agent Harness达到2930步,超过GPT-5.6 Sol的3042步,逼近Opus 5的2920步。研

正文结构化主题已通过公开置信门槛
TechCrunch AI产品发布

币安推出Agent OS平台,允许AI代理自主交易但风险由用户自负

全球最大加密货币交易所币安推出Agent OS平台,允许AI代理分析市场并代表用户执行交易。该平台集成Binance API、MCP等工具,支持ChatGPT、Claude Code等AI应用,但主要通过子账户和用户配置的权限来控制风险,用户需自行设定交易限额。币安无法监控AI代理的决策推理过程,仅能监控交易活动,安全主要依赖子账户隔离。

正文结构化主题已通过公开置信门槛
量子位产品发布

招商局狮子山AI实验室亮相WRC 2026,展示柔性叠衣技术

招商局狮子山人工智能实验室在2026世界机器人大会上首次公开亮相,展示了基于自研LiOS端云协同基础设施的柔性衣物自主折叠解决方案,并凭借该技术获得ICRA 2026 LeHome Challenge全球第一名。LiOS通过云侧、端侧和端云协同三层架构,解决了仿真到真机的虚实迁移难题,提升了训练和评测效率,并实现了低延迟的云端推理。该技术旨在推动具身智能从实

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

光帆AI OS首次落地韶音耳机,系统化AI能力输出开启

韶音在媒体沟通会上发布开放式耳机新品 OpenFit 2 AI,并宣布与光帆科技合作,在其耳机中上线基于光帆自研 AI OS 的“AI 实验室”功能合集,提供智能对话、日程待办等 AI 能力。这是光帆 AI 技术首次落地第三方硬件品牌,标志着其系统化 AI 能力从自有产品走向行业输出。行业分析认为,AI 硬件竞争焦点正从单点功能转向系统化能力,此次合作是这一

另有 1 家信源报道

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

阿里AI Agent Accio打通国内电商,商家运营效率大幅提升

阿里国际站推出的AI Agent Accio,已从外贸B2B延伸至国内电商,打通淘宝、天猫、拼多多、京东、抖音等平台,提供多平台数据分析和发品功能。商家通过Accio可自动生成跨平台分析报告、优化广告投放、分析用户评价,显著提升运营效率。Accio全球用户超1000万,单次任务成本下降50%,正推动商家组织向AI Native转型。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论产品发布

腾讯云发布AI数据底座TDSQL Nexa,多项AI数据库能力进入生产环境

腾讯云在2026 DTCC中国数据库技术大会上发布面向AI时代的数据底座TDSQL Nexa,统一连接企业多源数据,为Agent提供业务语义理解和权限治理能力。同时公布多项AI数据库能力已进入生产环境,包括TDSQL-C服务50万开发者、Agent Memory开源80天获2万GitHub Stars、DatabaseClaw在头部客户规模化使用。腾讯云副总

正文结构化主题已通过公开置信门槛
Latent Space研究

唐杰谈GLM-5.3:后训练扩展律与参数死亡

智谱CEO唐杰在X上发文,提出参数数量不再是衡量模型能力的唯一标准,需结合数据量、算力分配和运行条件。GLM-5.3通过长时程环境强化学习实现性能提升,其训练环境、评判器和验证器均为合成生成。同时,Ornith-1.5等新开源模型发布,强调端到端自我改进能力。

正文结构化主题已通过公开置信门槛
雷峰网 AI科技评论政策

中国信通院联合淘宝闪购发布首份即时零售智能体可信规范

中国信通院联合淘宝闪购在8月18日发布了即时零售领域首份针对AI Agent的可信规范《即时零售智能体可信基本要求》,该规范由多家企业共同参编,围绕能力维度和安全领域构建评估体系,并设定了具体性能指标。此举填补了行业可信评估空白,为即时零售智能体应用提供了标准依据,并响应了国家政策对智能体可信发展的要求。

正文结构化主题已通过公开置信门槛
InfoQ AI ML and Data Engineering开源

DeepSeek 开源 Harness 运行时,推动模块化 AI 代理基础设施

DeepSeek 发布了 DeepSeek Harness (dsh) 的开发者预览版,这是一个基于 MIT 许可证的开源执行运行时,用于构建自主 AI 代理。该软件采用微内核架构,基于 Cordis 元框架构建,将模型适配器、工具注册表、沙箱环境等作为独立插件加载,支持通过 YAML 或 JSON 配置切换模型端点和执行工作流。平台还包含仅追加的事件日志子

正文结构化主题已通过公开置信门槛
arXiv cs.MA一手来源研究

LLM委托合约:技术与努力选择中的道德风险

该论文将经典委托-代理框架扩展至LLM代理选择技术与努力水平(如token预算)的场景,建模了凹性饱和生产函数,推导了最优线性合约,并基于MATH和MMLUPro基准校准模型,证明简单线性合约能有效激励技术感知的委托。

正文结构化主题已通过公开置信门槛
arXiv cs.CL一手来源研究

人格引导的LLM智能体在任务导向对话中的研究

肯塔基大学的研究人员提出了一种无需训练的任务导向对话框架,通过两个LLM智能体模拟用户与系统交互,研究人格适应对对话质量的影响。实验在SGD数据集上评估了GPT-4o、Qwen3-Next-80B和Gemini 2.0 Flash,发现人格适应能提升约束满足率和用户满意度,但会降低真实性,而基于线索的隐式适应(Try)能最好地平衡这一权衡。

正文结构化主题已通过公开置信门槛
arXiv cs.SE一手来源研究

什么让软件问题解决任务对AI代理更难?

乔治梅森大学的研究人员提出了一种测量框架,用于系统量化软件问题解决任务的结构属性如何影响AI代理的成功率。他们基于CoderForge-Preview数据集进行大规模实证研究,发现任务难度可从静态特征(如补丁碎片化和仓库规模)显著预测,提示难度编码于任务结构中,为构建难度可控的基准测试奠定基础。