SpaceX 正式完成对 Cursor 的收购
AI 编程初创公司 Cursor 正式被 SpaceX 收购,成为其一部分。SpaceX 此前已收购 xAI,并拥有全球最大的 GPU 集群,Cursor 将利用该基础设施扩展其 AI 编程工具。此次收购最初于 4 月宣布,交易金额为 600 亿美元,现已完成。
技术方向 · 让模型自主规划、调用工具、完成多步任务的技术方向 · 共 2463 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
AI 编程初创公司 Cursor 正式被 SpaceX 收购,成为其一部分。SpaceX 此前已收购 xAI,并拥有全球最大的 GPU 集群,Cursor 将利用该基础设施扩展其 AI 编程工具。此次收购最初于 4 月宣布,交易金额为 600 亿美元,现已完成。
Flue 2 由 Astro 创建者 Fred Schott 发布,引入了受 React 启发的 Agent Hooks,使代理能够动态管理状态、监听生命周期事件并附加资源。Schott 认为代理必须依赖 harness 环境,Flue 基于开源 Pi 构建,旨在提供比传统 web 框架更灵活的代理组合方式。该框架已用于构建支持机器人和分诊机器人,并强调与
DoorDash 机器学习与 AI 负责人 Sudeep Das 在 QCon AI 大会上分享了公司从传统一次性预测向智能体推荐平台转型的经验。他介绍了利用语言原生消费者记忆、RQ-VAE 语义 ID 进行目录表示以及基于检索的搜索,显著提升了相关性和转化率指标。
Cloudflare 推出了 agent tracing,这是 Cloudflare Agents 的首个组件,用于在统一仪表板中收集部署的 agent 会话。该功能在现有 Workers tracing 基础上增加了 agent 级 span,并附带定价日期:测试期间免费,自 2026 年 10 月 1 日起纳入 Workers Observability
阿里开源了Qwen3.8-27B模型,总参数270亿,支持原生多模态、262K上下文,在SWE-bench Pro等多项代码和Agent评测中超越Claude Opus 4.6 Max。模型内置可调节的推理档位和preserve thinking功能,并支持通过Transformers、vLLM等框架部署,可在消费级显卡上运行。
DeepSeek Harness插件生态在GitHub上爆发,已有超过700个相关仓库。开发者为其开发了多类插件,包括多Agent团队管理、侧边栏IDE、文件引用、长期记忆、Claude数据迁移、视觉理解等实用功能,以及电子宠物、小游戏、复古广告等趣味插件。这些插件极大扩展了DeepSeek Harness的能力,使其从单一Agent工具演变为可高度定制的开
华为鸿蒙推出元服务及ASCF跨端框架,帮助开发者低成本迁移小程序等存量资产,并借助AI插件和零代码工具提升开发效率。京东、深圳万象城等案例显示,该方案能缩短开发周期并带来商业增长。鸿蒙通过系统级入口和智能分发,推动服务从App向轻量元服务转型。
本文提出 MAS-DecStream 系统,其核心是 LLM-MR-CNP 协议,扩展了经典合同网协议,引入语义化 CFP 生成、渐进式上下文披露、多轮提案修订、协商记忆和确定性验证。实验基于阿里 ASI 追踪数据,结果显示该方案将延迟违规率降至 3%,消除资源过度承诺,在 20 个代理下冲突解决率达 0.91,效用相比多轮规则基线提升最多 22%。研究表明
OpenAI 发布了 Agents JavaScript SDK v0.16.0,新增了确定性的 SDK 测试工具,支持 Standard Schema 输入输出,并增强了运行、提供者和 Realtime 行为的安全性。该版本还修复了多个核心、沙箱和 Realtime 相关的问题,提升了稳定性和兼容性。
PydanticAI 发布 v2.31.0 版本,新增功能允许 UIEventStream 无需 run input 构建,并为 AGUIEventStream 提供独立的 thread id/run id。同时修复了 FallbackModel 失败跨度归属错误以及 Temporal 工作流沙箱中 openai 传递问题。
OpenAI 发布了 Agents Python SDK 的 v0.21.0 版本,主要新增了 provider-neutral 的测试工具(agents.testing、agents.realtime.testing、agents.voice.testing),用于无需 provider 请求的确定性测试,并更新了对 OpenAI Python v3 和
Z.ai 发布了 GLM-5.3 模型,目前仅在编程计划中提供,API 即将上线,两周后开放权重。该模型在多个基准测试中超越了 Moonshot AI 的 Kimi K3,部分指标甚至超过 Claude Fable 5 和 GPT-5.6-Sol,且参数量仅为 Kimi K3 的三分之一。Z.ai 表示 GLM-5.3 基于 GLM-5.2 的相同基础模型,
阿里巴巴的Qwen团队发布了Qwen3.8系列模型,包括核心的Qwen3.8-27B多模态稠密模型和更大的Qwen3.8-2.4T-A95B模型,权重以Apache 2.0许可证开源。Qwen3.8-27B在编码和办公任务上优于更大的Qwen3.7-Plus,并增强了智能体能力,原生支持262K上下文,可通过YaRN扩展到100万,支持图像和视频处理。模型已
OpenAI 推出了名为“Computer History”的新功能,通过 macOS 辅助功能记录用户的点击、按键和应用切换等交互事件,生成可搜索的时间线,供 ChatGPT 和 Codex 作为上下文使用。该功能取代了之前的“Chronicle”预览版,不捕获屏幕截图或音频,且需要管理员和用户双重同意。OpenAI 警告存在提示注入风险,并建议敏感应用暂
Ollama 发布 v0.32.12 版本,新增对 Qwen 3.8 27B 模型的支持。该版本针对 Apple Silicon 设备进行了优化,以提升性能和输出质量,特别适用于重复任务和编码代理场景。Qwen 3.8 在编码、专业工作、研究及长周期代理任务中表现出显著提升。
普林斯顿大学与英国AI安全研究所联合发布了一项研究,通过“影子评估”方法测试前沿AI模型(如Claude Opus 4.8和GPT-5.6)的自主研究能力。结果显示,这些模型能完成工程任务,但在研究判断、创造性问题解决和资源管理上存在系统性缺陷,生成的两篇论文均被原审稿人拒绝。该研究对Anthropic和OpenAI关于AI可加速自身研究的说法提出了质疑。
AWS 机器学习博客介绍了 Amazon Nova Forge 的多轮强化学习自定义奖励函数设计。文章强调奖励函数决定模型学习行为,并展示了通过 BYOO 在自有环境运行奖励逻辑,以及使用 GRPO 优化累计奖励。还讨论了奖励评估流程、代码安全执行和常见陷阱,并提供了相关基础设施和示例代码。
AWS 展示了如何将 SageMaker AI 上的 OpenAI 兼容端点与 Bedrock AgentCore 运行时结合,构建多智能体工作流。该架构通过 Bedrock AgentCore 容器连接编排器(Claude Haiku 4.5)、预算智能体(Claude Sonnet 4.6)和财务分析智能体(Qwen 3.5 9B),实现成本优化、数据驻
LangChain4j 发布了 1.19.0 和 1.19.0-beta29 版本,主要更新包括:MCP 客户端更新至 2026-07-28 规范,支持 Milvus V2 服务及混合搜索,新增工具操作补偿机制,以及 AnthropicBatchChatModel 支持 Anthropic Message Batches API。此外,还增加了 watson
Cloudflare 宣布推出新的 Cloudflare One 功能,用于识别和检查 MCP(模型上下文协议)流量,显示哪些用户和服务器在生成该流量,并控制受管网络路径上的直接连接。这些控制措施结合 MCP Server Portals,帮助管理员确保代理使用经批准的路径,防止影子 MCP 流量。文章详细分析了 MCP 工具调用的结构,并比较了在客户端、网