又一 DeepMind 研究员离职,称近期构建超级智能"本质上不负责任"
Google DeepMind 新西兰技术专家 Robert O'Callahan 宣布离职,称 AI 当前变化速度过快,其此前参与开发的芯片设计工具让 AI 更便宜更快,如今他认为这一贡献已无法被合理化。他表示近期追求超级智能是"本质上不负责任的",并警告认知投降、AI 诱发的精神病与孤独、权力集中、经济冲击、网络安全风险及问责缺失等问题,认为 AI 的害
公司与模型 · Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与云平台
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 23:05
Google DeepMind 新西兰技术专家 Robert O'Callahan 宣布离职,称 AI 当前变化速度过快,其此前参与开发的芯片设计工具让 AI 更便宜更快,如今他认为这一贡献已无法被合理化。他表示近期追求超级智能是"本质上不负责任的",并警告认知投降、AI 诱发的精神病与孤独、权力集中、经济冲击、网络安全风险及问责缺失等问题,认为 AI 的害
Google 正在测试名为 "Call for Me" 的功能,允许 Gemini 代表用户给商家打电话。目前仅限美国 Pixel 11 用户且需付费 Gemini 订阅和 Phone 应用测试版。Gemini 可传递用户授权的个人信息,处理预订、改约、查库存等任务,能应对电话菜单和等待,并提供实时转录让用户随时接管。该功能延续了 Google Duplex
另有 2 家信源报道
Latent Space 发布 AINews 改版计划,将 Discord 与 AINews 合并,并探索迁移至 Beehiiv 及新主页,同时重新开放赞助与 PR 合作。本周 AI 动态密集:Anthropic 发布 Claude Opus 5.5、OpenAI 推出 GPT-6 系列(Astra/Sol/Luna)、Google 发布 Gemini 3.
Google 发布 Gemini 3.8 Live 更新,新增 Live Avatar 功能,让用户在与模型对话时看到实时动画 AI 形象进行唇形同步和表情反馈。该功能目前仅面向 Gemini Enterprise 客户,支持 97 种语言切换且不降低视频保真度,并允许企业创建自定义形象。输出带有 SynthID 隐形水印及身份保护措施。
另有 1 家信源报道
Google Research 提出一个统一的多智能体框架,作为 Gemini 和 Veo 之上的编排层,自动生成时间一致的长篇视频叙事,缓解现有线性流水线中的身份漂移和级联失败问题。该框架包含 Co-Director、CANVAS、A²RD 和 VQQA 等组件,将长篇视频生成建模为全局优化与世界状态跟踪问题,并原生继承 SynthID 水印等安全机制。评
Google 的 Suncatcher 项目计划将 AI 数据中心送入轨道,利用太阳能供电。一颗名为 MVP 的实验卫星将于 10 月 1 日由 SpaceX 猎鹰 9 号发射,据称可处理基本 AI 查询。SpaceX 和 Blue Origin 也在研究轨道数据中心,但面临散热、宇宙辐射和发射成本等巨大障碍;Google 经理估计需约 1 万颗卫星才能匹敌
Google 将其 AI 驱动的虚拟衣橱功能推广至美国、巴西和印度的所有 iOS 与 Android 用户,该功能可根据照片中的穿着自动整理衣物并支持分类筛选与搭配。此次更新还伴随 Google Photos 的多项新功能,包括 Gemini Spark 单提示词选图、提亮与分享,升级版标记工具,以及更多 AI Remix 模板。Google 表示用户穿着数
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在原生实时对话模型基础上加入近实时视频生成能力,实现带口型同步、自然表情和流畅轮次切换的视觉化虚拟形象。该功能支持异步工具调用、97 种语言的原生语音到语音同步,并可通过参考图定制品牌形象,即日起在 Gemini Enterprise 上线。所有输出均嵌入
另有 1 家信源报道
Google 在 Pixel 11 上推出 Gemini 代打电话的早期实验功能,用户可让 Gemini 代为致电本地商家,完成预订、查询库存或改约等事务。Gemini 会自我介绍、应对自动语音菜单、等待接通并与对方交谈,用户可通过实时转录查看并随时接管通话。该功能面向美国 Pixel 11 上加入 Phone by Google 公测的 Gemini 付费
另有 2 家信源报道
Google 推出名为“Call for Me”的新功能,允许 Gemini 代替用户拨打商家电话。该功能初期面向美国付费订阅 Gemini 的 Pixel 11 用户,需配合 Android 版 Google Phone 应用测试版使用。Gemini 可在通话中分享用户批准的个人信息,处理查询库存、预订餐厅、改约时间等任务,用户可实时查看通话转录并随时接管
另有 2 家信源报道
谷歌计划于10月1日通过SpaceX猎鹰9号火箭发射一颗搭载其Tensor Processing Unit(TPU)的卫星,作为Project Suncatcher实验计划的第一步,测试AI芯片在太空飞行、辐射和极端温度下的表现。谷歌的目标是最终将AI数据中心送入轨道,并计划明年再发射两颗卫星。项目高管Travis Beals表示,芯片在轨道上只能运行约15
Google DeepMind 新任负责人 Koray Kavukcuoglu 首次以负责人身份公开露面,表示希望 Gemini 4 远早于年底发布,目前处于后训练早期阶段,内部已用于编码工具 Antigravity。他称 AGI 是否实现“不是正确的对话”,应关注能否构建可信的智能体,这标志着 DeepMind 从 AGI 研究实验室向 Gemini 产品
Google DeepMind 新任负责人 Koray Kavukcuoglu 首次以该部门领导身份接受媒体采访时表示,Gemini 4 已进入精修阶段,公司计划远早于年底发布该模型。自 2025 年 11 月 Gemini 3 系列后,Google 未再推出旗舰模型,而 OpenAI 的 GPT-6 和 Anthropic 的 Mythos 系列已相继发布
Google 宣布 Google Beam 全球扩张,硬件以 HP Dimension with Google Beam 形式交付,覆盖美国、加拿大、英国、法国、德国和日本六国,并拥有 18 家渠道合作伙伴。Google 内部八周研究显示,使用 Beam 的团队连接感提升 50%,反馈被清晰理解容易度提升 33%,后续会议需求下降 21%。此外,Google
Google 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Flash-Lite TTS,支持 100 多种语言。Flash TTS 可通过文本描述从零设计音色,并支持用 30 秒音频样本进行声音克隆,Flash-Lite TTS 面向低成本大规模语音生成。两款模型均支持逐行舞台指示、双人对话和非语言音效,通过 Gemini API
Google 发布了两款新的 Gemini 文本转语音模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,提供超过 2000 种声音库,并支持仅用 30 秒音频样本创建自定义声音。Simon Willison 用 GPT-6 Astra 快速搭建了一个自带密钥的试玩界面,利用 Gemini API 的开放
YouTube 在 Creator Studio 中推出一系列 AI 工具,包括分析脚本和粗剪并给出节奏、结构与叙事建议的故事助手,支持最多三个剪辑版本的 A/B 测试,以及自动为不同观众展示最合适预览图的动态缩略图。Gemini 作为聊天式编辑助手接入 Shorts 和 YouTube Create 应用,可重排画面、裁剪片段并同步音乐。此外,YouTub
另有 1 家信源报道
Google DeepMind 发布 Private AI Compute 架构的技术更新,将私密、服务端记忆引入其平台。该方案通过加密存储与仅存于用户设备的密钥,实现跨设备的持久化 AI 记忆,同时保持设备端级别的隐私标准。数据在云端安全隔离区(secure enclave)中临时解密处理并立即重新加密,使 Google 自身也无法访问用户数据。
Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向创意角色设计与逐行表演控制,后者面向高吞吐、低成本的配音与语音代理场景。新模型支持自然语言生成定制音色、30 秒样本声音复刻、2000+ 预置音色及 100 多种语言,并配备同意验证、SynthI
YouTube 宣布推出名为 custom feeds 的新功能,允许用户用自然语言描述自己想看的视频类型,由 Google 的 Gemini AI 模型据此生成个性化推荐流,并固定在首页顶部独立标签页中。该功能将于下个月起在网页端和移动端逐步上线,支持创建多个自定义信息流,但不会取代 YouTube 主推荐流。此举跟随 Bluesky、Threads、In