英伟达发布 PAIR 路由器,将家庭网络变为本地 AI 数据中心
Nvidia 发布了开源工具 PAIR(个人 AI 路由器),可自动将本地 AI 请求分发到家庭网络中的多台设备,以缩短并行代理任务的等待时间。该工具兼容多种硬件,并在演示中将任务完成时间从单台笔记本的 18 分钟缩短至三设备集群的不到 9 分钟。PAIR 的发布是 Nvidia 将开放 AI 与其硬件更紧密结合的战略的一部分,该公司还以 129 亿美元收购
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2398 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Nvidia 发布了开源工具 PAIR(个人 AI 路由器),可自动将本地 AI 请求分发到家庭网络中的多台设备,以缩短并行代理任务的等待时间。该工具兼容多种硬件,并在演示中将任务完成时间从单台笔记本的 18 分钟缩短至三设备集群的不到 9 分钟。PAIR 的发布是 Nvidia 将开放 AI 与其硬件更紧密结合的战略的一部分,该公司还以 129 亿美元收购
IDC发布《中国零售云市场份额,2025》报告,显示2025年中国零售云市场规模达135亿元,同比增长12.4%。腾讯云以23.4%的市场份额位居解决方案市场第一,零售云收入同比增长16.8%,增速最快。腾讯云通过整合PaaS、SaaS及CaaS能力,推动AI智能体在零售场景落地,并与多家企业合作探索FDE模式。
AFAC2026金融AI创新大赛总决赛在上海举办,吸引全球5027支队伍近2万名选手参赛,由蚂蚁集团等30多家机构联合发起。大赛围绕交易行为识别、复杂文档还原、稀疏反馈实验、长文本Agent等四道赛题,模拟真实金融场景中的资源约束与动态变化。同时,主办方开源了包含13万条评测样本的百万金融智能数据集,旨在推动金融AI从模型可用走向系统好用。
阿里旗下企业级通用Agent产品千问办公上线首月用户数突破3000万,企业用户占比过半。产品高频迭代,推出国际版,并开源上下文基础设施MyContext。基于自研模型优化,单任务生成速度提升约100%,Token消耗减少75%。长安汽车等多家企业已接入,杰富瑞实测综合得分第一。
另有 1 家信源报道
inclusionAI 发布了 Ling-3.0-flash,一款原生混合推理模型,总参数 124B,激活参数仅 5.1B,采用混合线性注意力架构(KDA 与 MLA 交替)和稀疏 MoE。该模型在代码、智能体、通用知识等基准上匹配或超越前代旗舰,并集成 SGLang HiCache 与 Mooncake 分层缓存,将长输入场景的 TTFT 降低 60% 至
OpenAI 发布了旗舰模型 GPT-6 Astra,宣称其是最智能且最对齐的模型,主打计算机使用、软件工程、数学科学等能力,并逐步向组织、ChatGPT 用户、API 和 AWS 开放。发布过程出现延迟和访问问题,OpenAI 通过补偿机制缓解用户不满。第三方评测显示 Astra 在编码和智能指数上与竞品相当或略逊,但成本效率更高,同时引发了对可监控性和评
另有 1 家信源报道
本文提出 HarnessEvo 方法,将 LLM 代理的文本脚手架分解为角色、任务策略、工具/格式规则和反思/控制四个槽位,并采用留一进/留一出协议进行信用分配。实验表明,在 ALFWorld 基准上,优化收益完全集中在反思/控制槽位,而均匀分配预算会导致次可加性陷阱,使所有槽位冻结。作者建议先进行信用分配并集中预算,而非均匀拆分。
本文提出“文明框架”(Civilization Framework),主张个人多智能体系统间通信的寻址单元应是“文明”(人类主权者及其持久账本和可替换智能体),而非单个智能体。作者设计了“大使馆协议”(Embassy Protocol)实现异步、存储转发的通信,并以账本上的承诺状态作为事实来源。预注册实验(1908次试验)发现“时间权重效应”:错误信息先到可
A-CEGIS 是一个轻量级框架,利用反例作为反馈来评估智能体在自然语言到正则表达式合成中的多轮自我修正能力。在 30 个 NL-RX-Turk 任务上,诊断性反例反馈在四轮内解决了 90% 的任务,而零样本生成、通用自我修正和仅错误反馈的解决率分别为 17%、27% 和 23%。完整诊断运行后,所有任务在最终轮次均被解决,平均成功轮次为 2.7,鲁棒成功率
该研究探讨了在多智能体系统中,当智能体知晓其内部激活被监控并收到监控反馈时,基于激活的监控探针是否仍然有效。实验在四人二十一点和两人西蒙斯囚徒游戏中进行,使用Qwen3-32B-AWQ和GPT-OSS-20B模型,发现告知智能体监控存在并不会降低探针的检测准确性,智能体仍会继续共谋。这表明激活监控在智能体具有评估意识时仍具鲁棒性。
该研究基于SWE-chat数据集中的3553个真实编码智能体会话,分析了后期需求出现对代码失效的影响。研究发现,需求到达后的代码失效量约为非需求编辑的两倍,且这种负担在会话中未见下降。受控实验表明,延迟披露会将实现转移到揭示后,而仅提前警告无需求内容则无效果。该研究首次将后期需求出现与行级代码失效直接关联,揭示了编码智能体交互中可测量的代码返工来源。
雷峰网报道称,在WAIC和WRC展会上,具身智能从炫技转向务实落地,但真实场景任务复杂,存在长尾效应。云基础设施成为解决连接、数据、算力和Agent调度的关键,腾讯云等厂商通过提供远程操控、数据存储和Agent运行时等方案,助力机器人商业化。
阿里旗下企业级通用Agent产品千问办公上线首月用户数突破3000万,企业用户占比过半。产品保持高频迭代,推出国际版并开源上下文基础设施MyContext。基于自研模型优化,性能提升且成本降低。长安汽车等多家企业已接入该产品。
另有 1 家信源报道
腾讯WorkBuddy生态发布会宣布与猛玛合作,推出LARK A2无线麦克风联名款,作为首款原生联动WorkBuddy的AI语音入口硬件。该产品通过机身按键实现语音输入、删除和发送指令,减少对键盘鼠标的依赖,支持7小时续航和200米传输。此次合作探索了音视频硬件与AI智能体的协同应用。
OpenAI发布GPT-6 Astra模型,具备百万级上下文和自主操作电脑能力,在多项测试中表现优异。小米确认小米18 Fold起售价过万,搭载自研玄戒O3芯片。字节跳动将获得约296亿美元银团贷款,用于AI基础设施投入。
另有 1 家信源报道
字节跳动旗下 Seed 研究团队正式发布 Seed2.0 系列模型,针对大规模生产部署和多模态理解进行了系统优化,提升了视觉感知、复杂指令执行和推理能力,并提供 Pro、Lite、Mini 及代码模型等多种规格。Seed2.0 在多项公开基准上取得领先成绩,其 Pro 和代码模型已在豆包和 TRAE 上线,API 已通过火山引擎开放。
OpenAI正式发布GPT-6 Astra和Astra Pro,称其为最智能、最协调的模型,并在发布会上宣布进入AGI时代。该模型在数学、编程、网络安全等基准测试中表现优异,支持Computer Use和Browser Use,能操作软件完成复杂任务。API定价为输入10美元/百万token,输出50美元/百万token。首批企业测试已开始,Astra将向C
另有 2 家信源报道
OpenAI 发布了 GPT-6 Astra,这是首个 Stargate 模型,在 FrontierMath 和 ARC-AGI-3 等基准测试中表现优异。作者通过早期访问测试发现,Astra 能够以低于每小时 6 美元的成本执行 AI 工程师任务,包括模型训练、数据标注、系统部署和子代理管理。作者利用 Astra 构建了多个工具,并认为它能够自动化大部分
pearsonkyle 发布了 Qwen3.8-27B 的 GPTQ W4A16 量化版本,基于 Qwen/Qwen3.8-27B,使用 32K 上下文校准,支持 vLLM 直接服务。该模型将 90.5% 参数量化为 int4,但嵌入和输出头保持 bf16,文件大小 18.1 GiB。模型内置 MTP 草稿头实现 1.71 倍解码加速,并保留视觉塔支持图像输
初创公司 Abliteration.ai 将去除开源 AI 模型安全护栏的技术商业化,提供无防护版本的 GLM-5.3 等模型,用户可通过网页或 API 访问。该公司声称服务用于网络安全红队测试,但测试显示模型可生成恶意代码和危险生物指令,引发安全担忧。专家认为无法阻止此类模型传播,建议政府要求提供商实施分类器和身份验证。