斑马智能发布端侧大模型AutoOmni 2.0
斑马智能在云栖大会发布新一代全模态端侧大模型AutoOmni 2.0-23B-A3B,采用MoE架构,普通任务能力堪比10倍参数量云模型,复杂任务达其80%-90%。同时亮相AutoClaw 2.0智舱协作服务实车方案,并宣布与YoooClaw合作打通车内车外上下文数据。该模型已合作10家芯片企业,推理加速5-6倍,量化保真度超99%。
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2394 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
斑马智能在云栖大会发布新一代全模态端侧大模型AutoOmni 2.0-23B-A3B,采用MoE架构,普通任务能力堪比10倍参数量云模型,复杂任务达其80%-90%。同时亮相AutoClaw 2.0智舱协作服务实车方案,并宣布与YoooClaw合作打通车内车外上下文数据。该模型已合作10家芯片企业,推理加速5-6倍,量化保真度超99%。
Mastra 发布多项更新,核心是 @mastra/mcp@2.0.0 基于 MCP 2026-07-28 修订版重写,移除 initialize 握手,改用 suspend/resume 机制处理需要输入的工具体。新增 Azure AI Search 和 Weaviate 两个向量存储后端,并为可观测性 trace 查询加入分页、字段发现和增量轮询。持久化
Vercel AI SDK 发布 ai@5.0.264 补丁版本,修复了 provider 序列化时保留不透明文件 URI 字符串、聊天传输请求中重复内容类型,以及较新 Node.js 版本下流式工具输入回调乱序触发的问题。同时更新了 @ai-sdk/provider、@ai-sdk/gateway 和 @ai-sdk/provider-utils 等依赖。
DeepSeek发布由梁文锋署名的论文,公开其Agent训练基础设施DSec(DeepSeek Elastic Compute)。该系统每秒可创建5000+个沙盒、日产能达300万个、峰值并发38万个,单集群约160节点、3万核CPU、250TB内存。DSec通过FnCall、Container、MicroVM、Full VM四种后端统一调度,并用EROFS
另有 1 家信源报道
阿里巴巴宣布由前华为天才少年刘大一恒正式接任Qwen(千问)大模型项目负责人,此前该职位由林俊旸离职后由周靖人代管。刘大一恒是Qwen初期核心成员,曾负责预训练工作并主导Qwen1至Qwen3.5系列及Qwen-Math等模型开发。他在云栖大会发表「Qwen:迈向真实世界智能体」主题演讲,透露Qwen下一步将聚焦真实世界智能体方向。
Anthropic 发布 Claude Opus 5.5,作为新 Claude 5.5 家族首个模型,宣称在多数任务上达到 Fable 5.1 水平,运行成本比 Opus 5 低 40%,速度约快 30%,并改善写作与指令遵循。OpenAI 约一小时后发布 GPT-6 Sol 和 Luna,定价比 GPT-5.6 低 50%。Opus 5.5 成为 Clau
量子位刊文对比两款决策AI:TypeSafe AI(有OpenAI背景)推出的Jev主打快速判断,将AI输出变为Choice、Score、Probability等可直接执行的结果,服务软件与Agent;中科闻歌今年6月发布的通用决策大模型Decitron决策机则结合世界模型、多智能体推演、博弈与求解,面向战略与复杂系统决策。文章认为两者共同推动AI输出从生成
腾讯宣布与零跑汽车达成合作,腾讯全场景AI桌面工作台WorkBuddy正式在零跑落地,覆盖整车研发、智能驾驶、车联网、采购与供应链、审计等业务场景。零跑整车团队已借助WorkBuddy建成40多个AI系统,覆盖12大模块的冲压模具管理系统从约100人天压缩至10人天,试验车交付跟进系统从45人天降至5人天,多个平台提效约90%,累计开发量从1700多人天压缩
9月22日云栖大会MaaS & Agent技术主论坛上,阿里巴巴集团战略副总裁文征宣布千问AI平台全面升级,在模型服务基础上新增Agent服务与行业AI解决方案,并推出API优速模式、Agent Studio、千问AI座舱解决方案等能力。平台通过FlashBoot、UniScheduler等将模型弹性启动时间从1200秒缩短至70秒,首Token延迟降低38
量子位报道称,GPT-6 Astra 通过写代码、调用 Blender 等方式完成 3D 建模并刷屏,引发行业对通用大模型与专业 3D 生成模型关系的讨论。文章认为通用模型负责理解目标与拆解任务,专业 3D 模型负责复杂曲面与材质生成,3D 生成正从服务人类创作者的 Production-Ready 转向服务 Agent 的 Agent-Ready。影眸 H
Hugging Face 发布 funes,一个为编码智能体提供本地记忆的工具,基于 Lance 数据集构建。它把 Claude Code、Codex、pi 和 Hermes 的历史会话轨迹索引到一个本地 Lance 数据集中,并提供 recall 和 get 工具让智能体在需要旧上下文时检索原始片段。索引过程完全本地、确定性,不经过 LLM 摘要,并支持凭
雷峰网报道,Jev 向申请用户发放 1.2 亿 Token 额度,引发对其商业动机的讨论。文章指出 Jev 主要处理分类、路由、评分和概率判断等小颗粒度任务,Token 消耗极低,赠送额度意在让开发者扩大测试范围,把 Jev 嵌入 Agent 执行链中的高频决策节点。文章认为 Jev 押注 System 1 式快判断层,并通过 Calibration 概率校
该论文提出 Governed Closed-loop Agent Coordination (GCAC) 架构,用于社区痴呆症护理工作流中有边界的 AI 代理参与。GCAC 通过类型化的事件-记忆-决策-行动-结果契约,将观察、四类受治理记忆、规划、确定性策略执行、执行和结果监控分离。参考测试框架在 18 条证据衍生轨迹上评估该架构,GCAC 满足全部 18
该论文研究语言智能体在上下文窗口受限时,如何从执行历史中检索完整证据。作者提出将智能体记忆检索形式化为「预算内证据补全」问题,并构建 Execution Provenance Graph Memory(EPGM),用零初始化残差 R-GCN 在工具参数与输出的溯源单元上精炼稠密检索分数。在 ISETrace 的 2,000 条查询上,溯源单元相比固定 512
该论文提出 Knowledge-as-Skill 结构设计,让 LLM 智能体能够自主发现、导航和使用知识库,而非依赖传统 RAG 的固定检索-拼接-生成流程。设计包含 SKILL.md 发现层、每目录 index.md 导航层和带 YAML frontmatter 的知识层,遵循 Open Knowledge Format 与 Skill 协议。在 Wix
该研究指出,评估AI智能体群体安全性时常用的临界质量框架存在低估风险,因为它只关注直接竞争推翻均衡所需的最小对抗比例。作者通过大语言模型智能体群体实验和解析框架,发现经由中间「踏脚石」均衡的间接 tipping 可显著降低所需少数派规模,绕过多数要求,实现直接挑战无法达成的状态转换。结果表明均衡的抗干预性并非内在属性,而是其与替代状态竞争关系的结构性特征,保
该研究利用LLM驱动的基于智能体的建模(ABM)构建了一个微型社会,探讨气候变化行动立场的社会临界点。智能体的立场由气候行动紧迫性的信念强度和机构信任度两个变量定义,通过多轮对话监测智能体间距离和LDA主题模式来量化信念变化。研究发现该简单模型中确实会出现气候立场的显著突变,同时报告了LLM偏见干扰对话动态、需要维护智能体人格和情景记忆等方法论教训。
豆包工作升级任务模式功能,新增“目标模式”与“计划模式”,分别面向有明确验收要求的复杂任务和长程、需求模糊的任务,AI 会先产出可审阅计划再执行。同步更新任务队列、Markdown 文件编辑、深色模式等功能,已在电脑版上线。豆包工作于8月25日发布,近一个月内密集迭代,近期豆包2.1 Pro模型也完成小版本升级,强化多模态编程与 Agent 专业任务交付能力
Simon Willison 宣布将于 2026 年 10 月 14 日在旧金山与 Jesse Vincent 共同举办一场关于「Agentic Engineering」的 Birds of a Feather 晚间活动,面向正在用编码智能体构建新奇项目的人。活动形式为非正式的展示与交流,鼓励分享尚未公开的奇怪实验和未完成项目,明确表示不是产品推销。
PydanticAI 发布 v2.48.0 版本,新增对 OpenAI gpt-6-sol、gpt-6-luna 以及 Claude Opus 5.5 模型的支持,并升级 genai-prices 至 0.1.8 以支持新的 OpenAI 音频模型。此外修复了 Vercel AI 与 AG-UI 适配器中消息 ID 在加载和导出时丢失的问题。