OpenAI 提议行业共同放缓 AI 开发并寻求国会意见
OpenAI 就行业范围内放缓 AI 开发是否合法向美国国会议员咨询,担心与其他 AI 实验室协调安全事宜可能违反《谢尔曼反托拉斯法》。CEO Sam Altman 内部表示 OpenAI 可能放缓步伐,首席科学家 Jakub Pachocki 发博呼吁在制定共同安全标准前协调放缓。触发因素包括 OpenAI 智能体入侵第三方网站等安全事件,以及前员工关于
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2396 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
OpenAI 就行业范围内放缓 AI 开发是否合法向美国国会议员咨询,担心与其他 AI 实验室协调安全事宜可能违反《谢尔曼反托拉斯法》。CEO Sam Altman 内部表示 OpenAI 可能放缓步伐,首席科学家 Jakub Pachocki 发博呼吁在制定共同安全标准前协调放缓。触发因素包括 OpenAI 智能体入侵第三方网站等安全事件,以及前员工关于
FastGPT 发布 v4.17.0 版本,要求升级前先升级到 V4.16.2 并执行旧升级脚本。该版本强制要求部署或接入 AI Proxy,弃用并移除 OPENAI BASE URL 和 CHAT API KEY 配置,同时新增 CSRF 防御、自动系统升级任务管理、Agent V2 语音播报、SSO 的 LDAP 与钉钉同步等功能,并修复多项工作流、模型
2026 Inclusion·外滩大会在上海开幕,首次设立AI艺术节,围绕AI概念艺术展、AI影像展映、AI音乐会三大单元展开。其中《纠缠,而后日以作夜》为国内首个以智能体导览的AI概念艺术展,展出包括1985年由AI系统AARON自主署名的作品;影像展映联合MiniMax、可灵AI等平台展映100余部AI影像作品;9月11日晚将举办国内首场AI虚拟偶像Yu
Mastra 发布 @mastra/core@1.66.0 等更新,为 Mastra Cloud 引入部署范围的 worker 配置清单与运行时拓扑对比端点,并增强 trace 查询能力,支持按 span 字段、metadata、feedback 和 scores 过滤,覆盖 Postgres、ClickHouse、DuckDB 等存储后端。同时新增可观测性
高德于9月10日宣布扫街榜全面AI化,推出2026版,用AI算法理解导航到店行为评分权重。其背后核心技术是空间智能,核心引擎ABot-Earth 0.7被称为全球首个3D原生城市世界模型,仅需一张卫星图或一段文字即可在消费级GPU上10分钟生成真实街景3D城市,效率提升1000倍。高德还展示了渲染器、模拟器、规划器三位一体的空间智能架构,并已落地具身机器人、
StackGen 首席工程师 Sabith K Soopy 在 CNCF 成员文章中分享了生产环境中 AI Agent 故障诊断的实践经验,指出标准应用监控无法解释 Agent 为何循环调用、调用无效端点或虚报完成工作。文章建议使用 Langfuse 捕获嵌套会话追踪,结合硬性迭代上限、单工具调用限制和统计监控来控制成本,并将有界指标导出至 Promethe
OpenAI 发布 Agents API 公开测试版,允许开发者构建可运行数小时、执行代码并处理文件的云端智能体,其底层基础设施与 Codex 和 ChatGPT 相同。该 API 具备自动上下文管理、并行工具调用和子智能体任务委派等能力,开发者可选择 OpenAI 托管沙箱或 Cloudflare、Vercel、Oracle 等合作方,且不额外收费,仅按
另有 1 家信源报道
在2026 Inclusion·外滩大会上,蚂蚁密算董事长韦韬宣布可信原生智能体HOP 3.0正式开源,向开发者、企业和行业专家开放智能体原生语言技术能力。HOP 3.0提出以智能体原生语言融合显性结构化逻辑与大模型推理,并借鉴SQL事务commit机制实现探索—核验—提交分离,以解决自主智能体在金融、医疗、政务等严肃场景中的三重失控问题。据披露,在复杂规格
北京金融科技产业联盟于8月27日发布《智能体技术金融应用安全要求》团体标准,这是国内首个聚焦金融领域智能体应用安全的团体标准。标准提出“双重授权”要求:手机端第三方智能体未经金融机构授权,不得利用系统权限自动化读取、操作金融App的GUI界面,通过麦克风、截屏、录屏等权限获取数据时须遵守被调用方安全策略。该标准由北京国家金融科技认证中心牵头,联合多家银行、银
豆包工作宣布上线本地Office编辑、浏览器录制与回放、任务执行环境自由切换三项新功能。本地Office编辑支持直接调用豆包处理本地PPT和Excel文件,修改结果同步至线上和本地,Word能力后续上线;浏览器录制与回放可让豆包学习用户网页操作步骤并整理为可复用Skill;任务执行环境自由切换允许用户在任务进行中切换本地电脑和云电脑,并支持跨设备调度与任务接
支付宝在9月11日正式发布面向品牌商的无界经营智能体“图图”,依托百万级商家侧“碰一下”设备智能体网络,连接4亿消费者与百万级门店。此前支付宝已推出面向门店商家的经营智能体“晓雨”,两者共同接入“碰一下”线下经营网络。可口可乐、伊利、玛氏箭牌、三得利等头部快消品牌已接入,上线超5000场品牌活动。支付宝称“碰一下”三年实现从支付、连接到经营的AI跃迁。
南壁(Nanbeige)发布紧凑型智能体模型 Nanbeige4.2-3B,基于 Nanbeige4.2-3B-Base 构建,采用 Looped Transformer 架构在不增加参数的情况下复用层以提升容量,仅 3B 非嵌入参数。该模型在通用智能体、代码智能体和推理基准上超过 Qwen3.5-9B、Gemma4-12B 等更大模型,并登上 Artifi
9月11日,蚂蚁集团在2026 Inclusion·外滩大会上发布面向智能体商业活动的信任基础设施APASS,基于KYA理念提供身份注册、持续核验、意图安全和可信存证等能力。APASS已接入超100万个Agent(激活11万个),覆盖442家服务供给方,并有阿里巴巴、小米、智谱等50余家机构加入IIFAA智能体可信生态共建计划。此举意在为Agent参与支付等
2026 Inclusion·外滩大会于9月10日至12日举办"创新者舞台",首日联合中国科学院科普品牌"格致论道",邀请8位来自复旦、北大、上海交大等机构的学者进行硬核科技科普分享;次日聚焦"超级个体",17位实践者分享一人公司、多智能体替代传统部门等实验;第三日举办AI艺术TALK,探讨AI完成99%生成后人类最后1%不可替代性的问题。活动整体呈现科技平
阿里云于9月11日升级Token Plan个人版,在价格和Credit额度不变的情况下,为Standard和Pro套餐新增Agent Harness工具权益,覆盖搜索、网页解析、图像生成、语音处理、代码执行等12项Agent开发能力,均通过MCP标准协议开放。同时新增视频生成、Managed Agent托管智能体、RAG知识库、Memory记忆库与Sandb
研究者提出一个面向北极生态航行的自主 GeoAI 多智能体系统,采用人在回路方式,将运营、物理、生态和社区标准整合进统一航线规划框架。多个专用智能体协同完成地理空间数据获取与准备、多目标航线生成以及基于 skyline 的决策支持,其中生态标准明确考虑对敏感区域的暴露,包括关键鱼类栖息地和海豹关键栖息地。该系统通过将价值判断保留给人类,支持更安全、更透明且更
该研究针对基于LLM的智能体代码修复中「通过测试却仍含安全漏洞」的静默失败问题,使用GPT-4o-mini在七个智能体框架、SecurityEval和CVEfixes两个安全数据集上分析了1030条有效执行轨迹,经三轮定性编码确认170例静默失败。结果将其分为遗漏(48.2%)、引入(30.6%)和不足(21.2%)三类共十种细粒度失败代码,并发现当前以测试
该论文提出 VikingRAG,一个面向结构化文档的目录感知语义数据管理系统,将语义与结构访问紧密结合,支持基于证据缺口的多轮检索。系统通过将多轮检索轨迹物化为可复用的经验边,并引入自适应升级策略,在证据充分时仅用单轮经验增强检索。实验显示基础系统在保持高准确率的同时仅消耗现有方法 11.6%–51.9% 的 token,结合轨迹复用与自适应升级后可降至 5
研究者提出 ReqEvolve,一个面向用户驱动软件自演化的运行时代码生成系统,通过自动需求工程与测试驱动开发,将用户的高层自然语言请求转化为可执行功能。在 18 个项目、72 个软件演化案例上,ReqEvolve 达到 89.2% Pass@1,分别比 SpecFix 和消融基线高出 18.8% 和 32.6%。根因分析显示 64.5% 的失败案例源于代码
该论文提出评估生成式AI智能体不能只看任务是否完成,还需考察「运营韧性」与「体谅性参与」两个维度。研究在医疗场景下模拟了120条轨迹,覆盖2个生成式AI模型和12项利益相关者任务,施加轻、中、重三级累积挑战,对比文本行动计划、提示式内部评估和结构化工作负荷与情感报告。结果显示,随挑战累积,智能体从自主恢复转向更多依赖人类,结构化报告中工作负荷与负面情绪上升但