VibeWorlding:多模态智能体端到端构建 3D 开放世界的统一框架
VibeWorlding 是一个用于基准测试和训练多模态智能体的统一框架,旨在从用户查询端到端构建交互式 3D 开放世界。该框架包含 VWE-BENCH 基准(含 2,616 个 3D 资产、323 个种子世界和 6,828 个查询)和 VibeWorlding-Gym 强化学习训练环境。实验表明,当前前沿多模态大模型(如 GPT-5.5 和 Qwen3.8
公司与模型 · OpenAI 的全部动态:GPT 系列模型、ChatGPT 与 Sora 产品、公司战略与人事
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 01:14
VibeWorlding 是一个用于基准测试和训练多模态智能体的统一框架,旨在从用户查询端到端构建交互式 3D 开放世界。该框架包含 VWE-BENCH 基准(含 2,616 个 3D 资产、323 个种子世界和 6,828 个查询)和 VibeWorlding-Gym 强化学习训练环境。实验表明,当前前沿多模态大模型(如 GPT-5.5 和 Qwen3.8
DeepSeek 于 8 月 17 日上调 V4 Pro API 价格,其中缓存命中价格在高峰时段涨幅高达 11 倍,从 0.025 元/百万 Token 涨至 0.3 元/百万 Token。涨价原因是长上下文需求激增导致后端缓存颠簸,存储、IO 和调度成本上升。文章分析了 DeepSeek 的 KV 压缩和冷热分层技术,并对比了 Anthropic 和 O
据彭博社报道,Anthropic 的年化收入运行率在7月底超过650亿美元,高于5月的470亿美元和去年底的90亿美元。其投资者预计2026年全年收入将在1000亿至1200亿美元之间。Anthropic 已提交机密IPO文件,预计最早于今年秋季上市,寻求至少2万亿美元的公开估值,这将是史上最大规模的上市。
另有 1 家信源报道
支付公司 Stripe 以 70 亿美元收购 AI 模型路由平台 OpenRouter,交易在 90 天前其 13 亿美元 B 轮融资后完成。OpenRouter 年化收入 1.4 亿美元,毛利率约 70%,月处理 250 万亿 token,拥有 800 万开发者。该交易凸显模型聚合层的价值,但也引发对中间层利润压缩的担忧。
Import AI 第469期介绍了三个AI研究进展:DiG-bench基准测试通过70个游戏评估AI在未知环境中的发现能力,结果显示Opus 5和Fable 5表现最佳但远未达到人类水平;Paradigm Research发布了一个模拟递归自我改进的浏览器游戏;AI初创公司Inherent发布了论文,介绍其构建的AI科学家模型Faraday,用于监督前沿模
本文提出了一种名为S2VOPD的自监督视觉在策略蒸馏方法,通过从原始图像蒸馏到强增强的学生视图,无需特权标注或更大教师模型即可提升小视觉语言模型性能。在六个细粒度感知基准上,该方法将Qwen3.5-4B的准确率从70.7%提升至77.4%,超越包括Qwen3-VL 235B在内的所有开源模型,并超过GPT-5.4。在相同训练数据下,该方法恢复了使用特权信息方
Anthropic 宣布将采用 Google DeepMind 开发的开源水印技术 SynthID-Text 的变体,为 Claude 生成的文本添加不可见水印,以满足欧盟《人工智能法案》的透明度要求。该水印通过利用文本生成中的低风险词汇选择模式来标记内容,不影响输出质量或用户成本。Anthropic 表示,其他 AI 开发商如 Google 和 OpenA
YC 开源了企业级 Agent 管理工具 QM,上线三天获得 3.9k GitHub Star 并登顶 Hacker News。QM 通过作用域隔离、持久化沙箱、模型无关架构和三级安全策略,解决企业场景中 Agent 的数据隔离、权限治理和环境一致性问题。其核心设计是让 Agent 代表具体员工并使用公司分配的凭证,而非赋予独立超级权限,从而支持审计和责任追
菲尔兹奖得主Timothy Gowers指出,近期AI在数学领域的重大突破多通过寻找反例实现,如OpenAI模型解决Erdős单位距离问题、Claude协助发现雅可比猜想反例等。Gowers认为AI擅长在巨大搜索空间中寻找特殊对象,但缺乏人类数学家的直觉判断力,并预测AI将快速进步。
诺基亚计划关闭杭州研发中心并裁员1600人,因中国业务持续下滑。DeepSeek API峰谷定价方案生效,高峰时段价格翻倍。苹果与阿里合作深化,阿里参与训练面向中国市场的更强模型。Claude出现大规模服务故障,影响Claude.ai、Claude Code等服务。
Anthropic CEO Dario Amodei回应投资者Gavin Baker的批评,否认其AI风险警告导致公众反弹,认为AI负面看法本质上是信任危机,源于公众对科技行业的不信任。他承认AI公司未兑现造福世界的承诺,并反驳了监管等于权力集中的简化观点,强调Anthropic的政策提案旨在限制前沿AI公司而有利于小竞争者。
xAI联合创始人、杭州95后吴宇怀以7000万美元(约5亿人民币)购入硅谷希尔斯伯勒的豪宅,成为北加州今年最大住宅交易。吴宇怀曾参与AlphaStar、STaR、Minerva等项目,2023年加入xAI,今年2月离职。此次购房或与其在xAI的股权收益有关,也反映了AI人才通过IPO实现财富跃迁的趋势。
李飞飞在Huberman Lab访谈中表示,AI不是人类的替代者,而是个人能力的放大镜。她回顾了视觉在AI发展中的基石作用,从ImageNet到Sora的演进,并指出AI缺乏私人情感体验和真正的共情。她强调AI在医疗等领域的辅助价值,主张全社会共同参与AI治理,而非仅由科技企业决定。
北航90后副教授何静因在B站以通俗方式讲解AI应用而走红,其慕课视频播放量破百万,引发对其学历和学术效率的争议。何静回应称,其研究领域要求快速响应现实,并强调跨学科视角和稀缺性选择的重要性。她计划继续通过B站科普AI,并利用AI工具辅助回复评论。
Amazon DynamoDB 推出了原生向量搜索功能,允许开发者直接在 DynamoDB 中存储嵌入向量并执行近似最近邻查询,无需单独的向量数据库。该功能支持过滤相似性搜索和可配置的向量索引,适用于语义搜索、代理记忆、RAG 等场景。AWS 表示该功能可扩展至数万亿向量,并保持毫秒级延迟,但成本可能高于 S3。
Anthropic第二季度营收超过115亿美元,同比增长逾14倍,调整后营业利润首次转正。投资人押注其以超过2万亿美元估值冲刺IPO,若成行将超越SpaceX成为史上估值最高的IPO。但分析指出,营收增长可能受Tokenmaxxing短期透支影响,且高额算力合同成本仍是盈利挑战。
本文介绍了一个从零构建AI文本检测器的端到端项目,包括数据集构建、模型训练、本地部署和RLVR。作者以Substack的AI检测功能为灵感,旨在通过构建简单的检测器来教育读者理解AI检测器的工作原理,并探讨其局限性。项目最终产出一个AI检测API和用户友好的UI,并展示了如何利用检测器作为验证器来训练小语言模型生成难以被检测的文本。
美国康涅狄格州一名自诉原告Matthew Elliott在法庭文件中嵌入白色隐形文本,试图向可能处理文件的AI系统注入提示,以影响自动审查结果。法院发现异常空白后识破该行为,法官Walter Spader Jr.将其比作秘密影响陪审员,并取消了Elliott的电子文件提交权限。法官同时表示欢迎使用AI准备文件,但警告此类操纵行为不可接受。
至知创新研究院联合Safe AI Forum、牛津大学、斯坦福大学和清华大学提出稀疏权重分解(SWD)方法,直接从预训练权重中分解出可干预的稀疏单元,无需训练替代网络。实验表明,SWD在匹配替换保真度时数据成本不到训练型基线的1%,并在GPT-2、Qwen2.5和Qwen3.5-27B上以更少的瓶颈单元和活跃连接达到任务回路要求。该方法还支持全模型替换和ze
Nolan Lovett在《Human Resource Development Review》发表研究,指出企业理性采用AI替代初级岗位,虽获效率收益,却导致整个职业领域的专业知识流失,形成“认知公地悲剧”。他提出“验证锚定”和“人类储备悖论”,警告到2030-2045年可能显现专家短缺,并建议设立无AI学习环境、分阶段引入AI及保持人类绩效基线。