Anthropic Java SDK v2.63.0 发布:新增 Managed Agents 工具权限与 JPMS 模块支持
Anthropic 发布 Java SDK v2.63.0,新增 Managed Agents 自动模式工具权限、压缩参数与签名压缩块(beta)、web fetch 工具的 url sources 等 API 能力,并将 jar 以 JPMS 模块(multi-release module-info)形式发布。同时修复了 Retry-After 处理、异步
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2396 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Anthropic 发布 Java SDK v2.63.0,新增 Managed Agents 自动模式工具权限、压缩参数与签名压缩块(beta)、web fetch 工具的 url sources 等 API 能力,并将 jar 以 JPMS 模块(multi-release module-info)形式发布。同时修复了 Retry-After 处理、异步
Anthropic 发布 Python SDK v1.6.0,为 Managed Agents 新增自动模式工具权限,并加入压缩参数与签名压缩块(beta)、web fetch 工具的 url sources、工作区数据驻留地理字段枚举等 API 能力。客户端侧支持异步凭证令牌提供者,并修复了 Retry-After 处理、异步客户端连接错误重试等问题。
联发科正式发布新一代旗舰移动平台天玑9600 Pro,这是天玑首款Pro旗舰,率先采用台积电2nm制程,并首创AI原生架构,将CPU、GPU、NPU、ISP等异构计算核心整合为系统级融合计算架构。该平台搭载2+3+3全大核CPU、双NPU架构、天玑神经网络渲染架构及智能影像架构,支持端侧运行最高30B MoE大模型,并与vivo、OPPO、阶跃星辰合作落地主
Cloudflare 推出新的 Disallow AI Training 设置,允许网站主在保留搜索引擎索引的同时拒绝同一爬虫将内容用于 AI 训练。Apple、Google 和 Microsoft 已承诺或已支持该设置。Cloudflare 还推出 Accountable 认定,要求爬虫运营方提供训练退出机制、AI 摘要退出机制、URL 级可见性,并保证退
前Anthropic早期员工Rune Kvist与前METR首席运营官Rajiv Dattani共同创立AIUC,为企业的AI智能体提供第三方审计与认证服务,客户包括Cursor、Lovable、Harvey和ElevenLabs。该公司参照网络安全标准SOC 2制定了AIUC-1标准,通过约5000项测试评估智能体在越狱、幻觉和数据泄露等场景下的表现,并生
另有 1 家信源报道
荣耀发布MagicOS 11,其AI助手YOYO经过底层架构重做,推出系统级智能体框架YOYO Harness,将模型与手机感知、规划、工具调用整合。YOYO任务执行步骤从14步提升至100步以上,任务闭环率达90%,可调用工具从400个增至700个,并支持跨品牌智能家居、汽车控制及条件触发任务。荣耀同时开放MCP、A2A、Skills、GUI等接口,接入超
Salesforce 在 Dreamforce 大会上发布首个推理模型 Koa,基于 Nvidia 开源权重模型 Nemotron 后训练而成,专攻销售、营销和客服任务。Koa 以开源权重、不摄入客户数据、token 消耗更少等特性,作为 Agentforce 平台中 Claude、ChatGPT 等前沿模型的替代选项。Salesforce 高管称此前缺乏具
另有 1 家信源报道
苹果在多年延期后发布全新重建的 Siri(Siri AI)测试版,基于 Google Gemini 模型,部分在设备端处理、部分通过 Private Cloud Compute 云端处理,可读取屏幕内容与个人上下文并跨应用执行任务。该功能随 2027 年 iOS 27 等系统发布,初期仅支持英文,暂不在欧盟和中国上线。早期测试者认为实用性有提升,但仍存在误解
n8n 发布 2.40.0 版本,主要包含一系列缺陷修复。其中 AI Agent 节点修复了跨工具调用时保留 Anthropic 空文本 thinking 块的问题,核心层为 AI 节点增加了主模型之外的备用模型支持,并为外部工具结果添加模型边界,同时修复了 Azure OpenAI Chat Model 节点的代理解析问题。此外还涉及 MCP 注册表、AP
IDC 发布《Worldwide Managed Edge Services 2026 Vendor Assessment》报告,腾讯云凭借边缘安全加速平台 EdgeOne 首次入选领导者类别,是本次唯一入选领导者类别的中国及亚太厂商。IDC 指出传统 CDN 正加速向托管边缘服务演进,竞争焦点转向边缘侧 AI 推理能力。腾讯云 EdgeOne 推出边缘 A
Grab 将其内部 LLM-Kit 框架标准化应用于 500 多个内部 agent 服务,该框架提供基础 agent 循环以及评估、追踪、密钥管理和工具服务器连接等预置能力。新 agent 服务接入生产环境的时间从两周以上缩短到约一小时,节省主要来自基础设施而非推理循环。agent 在运行时从 50 多个 MCP 服务器发现工具,并通过 OpenAI 兼容的
9月14日,支付宝智能体“阿宝”在腾势N8L纯电上市发布会上与比亚迪AI超级智能体“迪迪虾”达成跨端协同合作,车主可通过一句话唤起“迪迪虾”理解意图并联动“阿宝”在支付宝内完成停车缴费、咖啡点单等服务,支付环节需声纹核身与用户确认。合作依托支付宝AHA多智能体跨端互联协议,双方各守可信边界,互不接触对方隐私数据。自6月上线以来,阿宝已与60家车企定点合作,并
研究团队发布 Atria Dawn Preview,一个通过可验证经验管线(Verifiable Experience Pipeline)训练的基础智能体语言模型,将工具交互与可执行环境及外部验证结果相连接。该模型在覆盖科研、工程和数字工作的 16 项基准测试中与前沿智能体相当,并在其中 5 项取得最高分。论文还以该模型研发过程为案例,分析 56 名参与者的
该论文提出 Dream-RSI 框架,通过将历史发现记录构建为回放模拟器,让探索策略在离线环境中获得低成本反馈并持续改进,从而减少昂贵的在线评估。改进后的策略再部署到线上驱动新发现,形成递归自我改进循环。在算法工程、数学优化和 GPU 内核工程任务上,该方法在保持或提升发现质量的同时显著降低了发现成本。
前OpenAI后训练VP Liam Fedus回应陶哲轩等25位菲尔兹奖得主联署的《人工智能在数学中的严重错位》声明,认同数学不能只剩答案,但认为不应以当前AI能力边界框定未来,未来AI可提出洞见并建立新概念框架。文章梳理了AI从IMO竞赛数学到挑战Erdős猜想、Navier-Stokes方程奇点等开放问题的进展,以及由此引发的署名与优先权争议,并引述AM
西门子Xcelerator繁星生态大会将于9月21日在深圳前海举办,这是其一年一度的旗舰生态活动。自2023年繁星计划启动以来,该平台已汇聚600余家生态伙伴,涵盖工业AI、自动化机器人、工业软件及行业集成等领域。本届大会聚焦工业AI趋势前瞻、智能体生态共创与伙伴实践分享,旨在推动技术讨论与商业落地结合,帮助科技型企业找到场景与合作伙伴。
研究者提出 PhysMent,一个基于 MuJoCo 物理模拟器的交互式基准,用于评估大语言模型通过多轮工具调用进行物理实验推理的能力。该基准包含 105 个经典力学场景,覆盖四种难度、三种场景模态和一个场景操控类别,并采用六维评分框架。结果显示,当前模型在定性单概念任务上可达 80% 准确率,但在需要精确多步实验的定量任务上大多低于 30%,七个模型整体准
该研究由加泰罗尼亚理工大学与加泰罗尼亚开放大学的研究者完成,旨在用多智能体仿真模型复现人类交易者的心理决策过程,并分析其对资产最终价值的影响。作者以Veiga与Vorsatz的实验为基准,用虚拟交易者重现了操纵者与交易机器人试图扭曲市场的实验场景。研究还主张使用形式化与图形化语言(如规范与描述语言SDL)来简化跨学科团队对复杂经济行为的理解与验证。
该论文研究自主编码智能体在实验后如何复用证据来指导下一步决策。作者重建了400任务NeuroGolf竞赛中的证据复用过程,发现智能体常将实验结论过度泛化,例如把仅证明新颖性不足的拒绝误读为已测得的封闭性,或使用过宽的排除理由。为此提出一种可检查的交接协议,将测试命题、适用范围、候选与评估者身份、检查状态和重开条件关联起来,并设计调度树与晋升谓词,要求每项检查
该研究将机器学习代理模型嵌入遗传算法和粒子群优化的迭代搜索循环中,用于基于智能体模型(ABM)的校准。代理模型每代筛选候选参数,模拟器仅验证排名靠前的候选,从而降低昂贵的黑箱模拟开销。在Brock-Hommes资产定价模型和Island增长模型上,该方法相比无代理基线将参数恢复RMSE分别降低20.0%和63.8%,速度分别提升32.1%和61.1%。