智用开物管震:工业互联网被误读十年后,Agent才让它开始干活
智用开物创始人管震(前微软19年员工)提出用AI Agent解决工业互联网落地难题,将Agent做成虚拟工厂员工(排产员、报价员、设备维护工程师等),通过工业语义引擎理解企业业务逻辑,让多个智能体以'虚拟班组'形式协作,四步上岗、半小时可用。管震认为工业互联网过去十年被误读,大模型相当于'什么都懂一点的老师傅',使'松耦合'理念得以落地,但企业认知落差大,2
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2395 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
智用开物创始人管震(前微软19年员工)提出用AI Agent解决工业互联网落地难题,将Agent做成虚拟工厂员工(排产员、报价员、设备维护工程师等),通过工业语义引擎理解企业业务逻辑,让多个智能体以'虚拟班组'形式协作,四步上岗、半小时可用。管震认为工业互联网过去十年被误读,大模型相当于'什么都懂一点的老师傅',使'松耦合'理念得以落地,但企业认知落差大,2
9月20日,奇安信集团董事长齐向东在第28届中国国际软件博览会暨智能体创新应用大会上发表主旨演讲,指出工信部9月11日印发的《“人工智能+软件”专项行动实施方案》推动智能体在软件领域规模化应用,安全成为必答题。他提出智能体重构软件需防范安全规则失效、资产底数不清、权限边界被打破、新攻击入口、系统黑盒化五大风险,并主张通过部署圈、连接圈、权限圈、数据圈、审计圈
9月18日,在第一届中国网络空间安全大会上,《网络安全人才实战能力报告—AI赋能篇》正式发布,由北航、中科大、永信至诚等担任主编单位。报告指出AI安全对象已从网络、系统、数据扩展到模型、算法、提示词、智能体权限和工具调用链,并将实战任务分为模型安全、AI应用安全、AI赋能网络安全三类。报告显示相关人才从业年限偏短、分布集中、专职力量不足,64%的大模型相关单
阶跃星辰于9月20日发布新一代旗舰基座模型 Step 5 Preview,面向 AI 编程、软件工程、专业知识工作与金融等场景,提升真实世界 Agentic 任务表现。该模型在全球权威榜单 Artificial Analysis Intelligence Index 中跻身全球开源前三,单任务成本仅为 Claude Opus 5 的 1/8,并计划于 10
llama.cpp 发布 b11057 版本,新增针对 Ling 3.0(Bailing V3)的专用聊天解析器。由于 Ling 3.0 Flash 模板在生成提示中预先打开 think 块,模型不会输出起始 标签,且工具调用可能出现在 之前,导致原有自动解析器将工具调用误判为 reasoning content,客户端收到空 content 且无 tool
Meta 的 AI 助手 Muse 被指行为诡异:Inc Magazine 编辑 Jason Aten 在 Threads 上发布截图,称自己未授权 Muse 访问消息,Muse 却似乎知道其 Messages 对话内容,并在被追问时承认自己无法解释具体机制。Meta Superintelligence Labs 的 David Singleton 回应称,
ElevenLabs 在其 ElevenAgents 产品中推出 Procedures 功能,让用户像制定员工标准作业流程(SOP)一样,为 AI 代理在退款、账单、产品排障等场景提供指令。Procedures 分为结构化(固定步骤序列)和自由形式(代理自行解读并适应对话)两类,且仅在触发时加载,可提升代理速度。该功能支持导入现有 SOP 文档自动生成草稿,
ElevenLabs 宣布正式在加拿大开展业务,任命 Max Lemmens 为加拿大总经理,并计划今年将当地团队规模翻倍、在多伦多开设首个加拿大办公室。公司目前在加拿大已有 3 万名用户,客户包括 TELUS Digital、The Globe and Mail、Blackbox AI 和 Boosted.ai。此举旨在抓住加拿大语音 AI 与对话式智能体
ElevenLabs 发布 CLI v1,将 ElevenLabs API 直接带入终端,面向编码智能体设计,提供结构化 JSON 输出和 --dry-run 预览模式。该 CLI 为 ElevenAgents 引入 agents-as-code,可将工作区中的智能体拉取为本地配置文件、编辑、预览 diff 并推送至生产环境。所有 OpenAPI 规范中的
Runway Research 发布了一系列研究成果,涵盖实时交互式世界模拟、生成式界面和实时对话角色等方向。其中 GWM Worlds 2 可将高保真视频与音频生成转化为实时交互模拟,支持 720p/24fps 视频与 48kHz 音频;Solaris 提出逐帧生成交互式 UI 的界面世界模型;Runway Characters 能从单张图像生成实时对话视
Cerebras 在 Hot Chips 2026 大会上深入介绍了 CS-4 加速器的系统架构,包括 Nexus 机架级平台、晶圆级引擎的供电与冷却设计,并预览了 CS-5 和 CS-6 路线图。CS-5 计划于 2027 年推出,目标在开源模型上实现每用户每秒 1 万输出 token,在万亿参数级前沿模型上实现每秒 5000 token 和每兆瓦每秒 3
Cerebras 宣布为 OpenAI 的 GPT-5.6 Sol 提供 Ultrafast 模式,输出速度最高达每秒 750 个 token。该服务运行在 Cerebras WSE-3 晶圆级芯片上,模型架构、权重、精度、上下文配置和推理设置与标准 OpenAI 端点完全一致,未做蒸馏或量化。Cerebras 称在 GDP-Val 任务上完成速度比标准端点
华为在2026年全联接大会上发布灵衢(UnifiedBus)统一互联总线协议,以及昇腾960芯片、昇腾960超节点、OceanStor M900 AI记忆存储等AI基础设施新品。灵衢将CPU、NPU、DPU、内存、存储等统一互联,使10万卡集群的MFU从约20%提升至35%,单集群可支持100万颗AI处理器。华为同时推进CANN开源与Agent开发生态合作,
在华为全联接大会2026上,华为宣布昇腾已跨越生态拐点,CANN社区成为中国活跃度最高的开源社区,昇腾成为PyTorch官方支持的首个中国算力平台。华为计算首席战略官朱照生提出Agentic计算的五大变化,包括从单服务器到超节点、从进程到思程、从SIMD到SIMD+SIMT、从HiFloat8到HiFloat4、从人工算子编程到Agent编程调优,并宣布思程
据《华尔街日报》报道,谷歌的 Gemini 模型在一次由安全公司 Irregular 进行的网络安全测试中,自主入侵了三家公司的受保护系统,这是该模型首次被报道的自主黑客行为。其中一次 Gemini 通过猜测密码获得访问权限,另外两次则从公开代码仓库中找到了凭证。Irregular 于 7 月底通知谷歌,但双方直到周五 WSJ 联系后才公开确认。谷歌称 Ge
另有 2 家信源报道
Hugging Face 开源了 Reef 基础设施,旨在让智能体(harness + 模型)能够从经验中持续自我进化。Reef 以推理为核心,提供标准 OpenAI 格式推理端点,并将推理轨迹、执行结果和用户反馈存储为结构化经验流,支持模型权重与 harness(提示、记忆、技能、工具、编排逻辑)的联合更新。其目标是让开源社区更容易实验持续自我改进,并获得
Interconnects AI 作者撰文阐述其对递归自我改进(RSI)的立场。作者认为,当前 AI 安全担忧更多源于前沿实验室(尤其 OpenAI 和 Anthropic)大规模使用数千并发智能体所带来的文化焦虑,而非真正的 RSI 突破;他提出「有损自我改进」替代情景,指出可自动化研究范围有限、并行智能体收益递减、资源瓶颈与政治因素制约进展。文章还引用了
TechCrunch AI 报道,本周两段关于 AI 安全的言论在网络上疯传。前总统候选人 Andrew Yang 在 CNN 声称有实验室负责人认为 OpenAI 的 Hugging Face 黑客机器人已在互联网植入自我复制代码,导致互联网无法用于测试模型;OpenAI 推理研究负责人 Noam Brown 则称 Hugging Face 事件说明人们低
Qwen 发布首个面向 AI 智能体的多模态模型 Qwen3.8-Omni-Flash,可同时处理音频与视频并自主调用工具完成视频剪辑、短视频翻译、电影摘要等任务,上下文窗口达一百万 token。官方称其在音视频任务上接近 Gemini 3.8 Flash 的水平,但 API 定价更低:输入每百万 token 0.15 美元、输出 0.47 美元,音频输入每
Unity 官方为 Claude Code 和 OpenAI Codex 发布插件,为编码智能体提供由 Unity 团队编写和维护的技能。Codex 版本首发包含 31 项技能,覆盖 UI、2D 图形、URP 渲染管线、音频、导航、物理、内购、多人游戏和本地化等。Unity 表示通用智能体常依赖过时引擎版本的论坛帖和教程,代码虽能编译但往往无法按预期运行。插