xAI 将 Grok 集成至开源智能体 OpenClaw
xAI 宣布其 Grok 模型现已集成到开源、本地优先的智能体平台 OpenClaw 中,用户可使用 SuperGrok 或 X Premium 订阅在 OpenClaw 内调用 Grok 模型。OpenClaw 支持多种硬件和消息平台,提供持久记忆,所有订阅层级均可使用该集成。
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2507 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
xAI 宣布其 Grok 模型现已集成到开源、本地优先的智能体平台 OpenClaw 中,用户可使用 SuperGrok 或 X Premium 订阅在 OpenClaw 内调用 Grok 模型。OpenClaw 支持多种硬件和消息平台,提供持久记忆,所有订阅层级均可使用该集成。
xAI 宣布,从即日起,SuperGrok 或 X Premium+ 订阅用户可直接在开源智能体编码平台 Kilo Code 中使用 Grok 模型,包括用于智能体编码的 Grok Build,无需单独的 API 密钥。Kilo Code 支持 VS Code、JetBrains IDE 和终端,提供规划、编码、调试等专用模式,并支持 500 多种模型。用户
Together AI 博客介绍了 DSGym,一个用于评估和训练数据科学智能体的统一框架,它整合了现有基准并新增了生物信息学和 Kaggle 竞赛任务。通过 DSGym 生成的数据,研究者训练了一个 4B 模型,在开源模型中达到最先进性能。该框架还解决了基准测试中的记忆化问题,并揭示了模型在端到端机器学习流程中的失败模式。
Groq 在 GroqCloud 上推出了 MCP Connectors 的 Beta 版,首批支持 Google Workspace(Gmail、Drive、Calendar)。这些由 Groq 托管的连接器让开发者无需管理自己的 MCP 服务器,即可通过 Responses API 让 AI 代理与 Google 工具交互,具有零部署、低延迟、安全(OA
BAAI Community 发布了一个生产级企业 RAG 系统,支持混合搜索(BM25 + 向量)、基于 LangGraph 的多智能体编排,并集成了 CRAG、HyDE、RAG Fusion 和对话记忆。系统基于 FastAPI、pgvector、Elasticsearch 和 Redis 构建。
xAI 宣布推出 Grok for Outlook,这是面向 Microsoft Outlook 的加载项,可帮助用户总结长邮件线程、以用户风格起草回复并整理收件箱。该加载项还能读取附件、搜索网页和 X 平台,并支持 Word、Excel 和 PowerPoint。即日起,所有付费 X 和 SuperGrok 用户可从 Microsoft Marketpla
xAI 的 Grok Build 新增了工作流功能,用户可以用自然语言描述大型任务,Grok 会将其拆分为脚本,在后台并行运行多达 1024 个代理,并验证结果后生成报告。该功能支持保存和共享工作流,并内置了深度研究命令。
xAI 于 2026 年 7 月 28 日推出 Build Mode 功能,允许用户通过自然语言描述想法,让 Grok 在聊天中实时生成网站、应用、游戏和交互式仪表盘,并可发布为链接。该功能目前以早期测试版形式向 SuperGrok Heavy 订阅用户开放,支持网页、iOS 和 Android 平台。
Hugging Face 博客文章指出,模型路由并非简单的分类问题,而是系统优化问题。作者通过 AppWorld 测试发现,GPT-4.1 的实际成本高于 Claude Sonnet 4.6,原因是缓存读取定价差异。文章强调路由需综合考虑成本、质量、延迟、合规等因素,并介绍了其优化路由器的成本-精度前沿结果。
智谱AI发布了一系列新模型和产品,包括旗舰模型GLM-5.3、GLM-5.2、GLM-5.1、GLM-5、GLM-4.7等,以及多模态模型GLM-5.3-Flash、GLM-5V-Turbo、GLM-OCR等。这些模型在编程、长上下文、多模态理解等方面有显著提升,并推出了GLM Coding Plan团队版和AutoGLM-Phone框架。此外,还发布了语音
Meta 超级智能实验室发布了 Muse Image 并预览了 Muse Video,这是其首批媒体生成模型。Muse Image 具备智能体能力,能使用搜索和编码工具、自我优化,并支持多参考图像合成,已在 Meta AI 应用、meta.ai 等平台上线。Muse Video 提供高保真视频生成和原生音频支持,即将面向创作者推出。模型在 Arena 基准上
Meta 推出 Muse Spark 1.1 多模态推理模型,显著提升智能体任务、工具使用、编码和多模态理解能力,并首次通过 Meta Model API 公开预览提供。该模型支持百万 token 上下文,可编排多智能体系统,在计算机使用和编码方面表现优异,同时通过安全评估。
Anthropic 发布了 Claude Sonnet 5,这是其最强大的代理型 Sonnet 模型,在编码、代理任务和专业工作中表现出色,性能接近 Opus 4.8 但价格更低。该模型即日起在所有计划中可用,并通过 Claude API 提供,具有限时优惠定价。早期合作伙伴反馈显示其在复杂任务中的自主性和效率显著提升,安全评估也显示其不良行为率低于前代。
Anthropic 发布了 Claude Opus 5,这是 Opus 系列的新一代模型,在编码、知识工作和智能体任务上表现优异,接近 Fable 5 的智能水平但价格减半。该模型在多个基准测试中创下新纪录,如 Frontier-Bench 和 GDPval-AA,并在成本效率上优于前代 Opus 4.8。早期客户反馈显示其在调试、自动化工作流和科学分析中表
DeepSeek 发布 DeepSeek-V4-Flash 正式版 API,模型结构不变,仅重新后训练,在多个基准测试中表现优异。API 调用方式不变,模型名设为 deepseek-v4-flash。DeepSeek-V4-Pro 正式版将尽快发布。
另有 1 家信源报道
Anthropic 发布了 Claude Opus 5 模型,支持 1M token 上下文窗口和 128k 最大输出 token,定价与 Opus 4.8 相同,并已上线多个云平台。Claude Managed Agents 新增了会话预算、顾问模型、推理地理位置控制、GitHub 技能加载和初始事件种子等功能。推理钩子功能在 Claude Enterpr
Google DeepMind 发布 Gemini Robotics ER 2,这是其最强大的具身推理模型,旨在作为机器人的高级大脑,支持视频理解、任务编排和多机器人协作。该模型通过 Gemini API 和 Google AI Studio 向开发者公开,并已在 Gemini Enterprise Agent Platform 提供私有预览。Gemini
Langfuse 发布 v4.1.0 版本,包含多项新功能和修复。新功能包括在 PR 描述中固定预览 URL、增强实验表单验证、扩展应用内代理的后台执行、显示已弃用 API 的最后使用时间、在复制提示时自动生成 API 密钥等。修复涉及助手工具调用副作用、仪表板组件版本、评估器 JSONPath 验证、ClickHouse 评分过滤优化、非流式 LLM 请求
Google Gen AI Python SDK 发布 v2.16.0 版本,新增环境资源支持,并集成环境服务到 SDK 中。同时,该版本为 GoogleMaps 工具增加了 grounding types 的 places 和 routing 支持。文档更新提示了下一个主要版本即将到来的变更。
Agno 发布了 v2.8.6 版本,新增了 Smallest AI 文本转语音工具包、AgentOS 的指标刷新状态查询接口,以及 OpenSearch 向量数据库支持。同时优化了工具包装性能,修复了指标刷新阻塞和编码问题。