返回主题地图

Google / Gemini

公司与模型 · Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与云平台

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 23:05

核心动态标题或摘要核心在讲该厂商及其模型,当前共 307 条。
9月26日周六 · 1 条
标题直接命中命中实体:google deepmind
THE DECODER观点2

又一 DeepMind 研究员离职,称近期构建超级智能"本质上不负责任"

Google DeepMind 新西兰技术专家 Robert O'Callahan 宣布离职,称 AI 当前变化速度过快,其此前参与开发的芯片设计工具让 AI 更便宜更快,如今他认为这一贡献已无法被合理化。他表示近期追求超级智能是"本质上不负责任的",并警告认知投降、AI 诱发的精神病与孤独、权力集中、经济冲击、网络安全风险及问责缺失等问题,认为 AI 的害

9月25日周五 · 9 条
标题直接命中命中实体:gemini
THE DECODER产品发布5

Google 测试 "Call for Me":Gemini 可代用户致电商家

Google 正在测试名为 "Call for Me" 的功能,允许 Gemini 代表用户给商家打电话。目前仅限美国 Pixel 11 用户且需付费 Gemini 订阅和 Phone 应用测试版。Gemini 可传递用户授权的个人信息,处理预订、改约、查库存等任务,能应对电话菜单和等待,并提供实时转录让用户随时接管。该功能延续了 Google Duplex

另有 2 家信源报道

摘要核心命中命中实体:google
Latent Space商业3

AINews 改版:Discord 与 AINews 合并,本周前沿模型密集发布

Latent Space 发布 AINews 改版计划,将 Discord 与 AINews 合并,并探索迁移至 Beehiiv 及新主页,同时重新开放赞助与 PR 合作。本周 AI 动态密集:Anthropic 发布 Claude Opus 5.5、OpenAI 推出 GPT-6 系列(Astra/Sol/Luna)、Google 发布 Gemini 3.

标题直接命中命中实体:google
The Verge AI产品发布6

Google Gemini 3.8 Live 推出 Live Avatar 功能

Google 发布 Gemini 3.8 Live 更新,新增 Live Avatar 功能,让用户在与模型对话时看到实时动画 AI 形象进行唇形同步和表情反馈。该功能目前仅面向 Gemini Enterprise 客户,支持 97 种语言切换且不降低视频保真度,并允许企业创建自定义形象。输出带有 SynthID 隐形水印及身份保护措施。

另有 1 家信源报道

标题直接命中命中实体:google
Google Research Blog一手来源研究3

Google 研究:多智能体框架自动生成连贯长视频

Google Research 提出一个统一的多智能体框架,作为 Gemini 和 Veo 之上的编排层,自动生成时间一致的长篇视频叙事,缓解现有线性流水线中的身份漂移和级联失败问题。该框架包含 Co-Director、CANVAS、A²RD 和 VQQA 等组件,将长篇视频生成建模为全局优化与世界状态跟踪问题,并原生继承 SynthID 水印等安全机制。评

标题直接命中命中实体:google
THE DECODER商业2

Google Suncatcher 项目拟将 AI 数据中心送入轨道

Google 的 Suncatcher 项目计划将 AI 数据中心送入轨道,利用太阳能供电。一颗名为 MVP 的实验卫星将于 10 月 1 日由 SpaceX 猎鹰 9 号发射,据称可处理基本 AI 查询。SpaceX 和 Blue Origin 也在研究轨道数据中心,但面临散热、宇宙辐射和发射成本等巨大障碍;Google 经理估计需约 1 万颗卫星才能匹敌

标题直接命中命中实体:google
TechCrunch AI产品发布2

Google Photos 虚拟衣橱功能登陆 iOS 和 Android

Google 将其 AI 驱动的虚拟衣橱功能推广至美国、巴西和印度的所有 iOS 与 Android 用户,该功能可根据照片中的穿着自动整理衣物并支持分类筛选与搭配。此次更新还伴随 Google Photos 的多项新功能,包括 Gemini Spark 单提示词选图、提亮与分享,升级版标记工具,以及更多 AI Remix 模板。Google 表示用户穿着数

标题直接命中命中实体:google deepmind
Google DeepMind News一手来源产品发布6

Google DeepMind 推出带 Live Avatar 的 Gemini 3.8 Live

Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在原生实时对话模型基础上加入近实时视频生成能力,实现带口型同步、自然表情和流畅轮次切换的视觉化虚拟形象。该功能支持异步工具调用、97 种语言的原生语音到语音同步,并可通过参考图定制品牌形象,即日起在 Gemini Enterprise 上线。所有输出均嵌入

另有 1 家信源报道

标题直接命中命中实体:gemini
The Verge AI产品发布5

Gemini 可代你致电商家,免去等待接通

Google 在 Pixel 11 上推出 Gemini 代打电话的早期实验功能,用户可让 Gemini 代为致电本地商家,完成预订、查询库存或改约等事务。Gemini 会自我介绍、应对自动语音菜单、等待接通并与对方交谈,用户可通过实时转录查看并随时接管通话。该功能面向美国 Pixel 11 上加入 Phone by Google 公测的 Gemini 付费

另有 2 家信源报道

标题直接命中命中实体:gemini
TechCrunch AI产品发布5

Google 测试 Gemini 代用户致电商家功能

Google 推出名为“Call for Me”的新功能,允许 Gemini 代替用户拨打商家电话。该功能初期面向美国付费订阅 Gemini 的 Pixel 11 用户,需配合 Android 版 Google Phone 应用测试版使用。Gemini 可在通话中分享用户批准的个人信息,处理查询库存、预订餐厅、改约时间等任务,用户可实时查看通话转录并随时接管

另有 2 家信源报道

9月24日周四 · 8 条
标题直接命中命中实体:google
The Verge AI商业1

谷歌下周将发射搭载AI芯片的卫星

谷歌计划于10月1日通过SpaceX猎鹰9号火箭发射一颗搭载其Tensor Processing Unit(TPU)的卫星,作为Project Suncatcher实验计划的第一步,测试AI芯片在太空飞行、辐射和极端温度下的表现。谷歌的目标是最终将AI数据中心送入轨道,并计划明年再发射两颗卫星。项目高管Travis Beals表示,芯片在轨道上只能运行约15

摘要核心命中命中实体:google deepmind
THE DECODER商业1

DeepMind 新掌门:不追 AGI,只求 Gemini 4 尽快发布

Google DeepMind 新任负责人 Koray Kavukcuoglu 首次以负责人身份公开露面,表示希望 Gemini 4 远早于年底发布,目前处于后训练早期阶段,内部已用于编码工具 Antigravity。他称 AGI 是否实现“不是正确的对话”,应关注能否构建可信的智能体,这标志着 DeepMind 从 AGI 研究实验室向 Gemini 产品

标题直接命中命中实体:deepmind
The Verge AI模型发布2

Google DeepMind 新负责人称 Gemini 4 已接近就绪

Google DeepMind 新任负责人 Koray Kavukcuoglu 首次以该部门领导身份接受媒体采访时表示,Gemini 4 已进入精修阶段,公司计划远早于年底发布该模型。自 2025 年 11 月 Gemini 3 系列后,Google 未再推出旗舰模型,而 OpenAI 的 GPT-6 和 Anthropic 的 Mythos 系列已相继发布

标题直接命中命中实体:google
Google AI一手来源产品发布2

Google Beam 全球扩张:新增地区、合作伙伴与客户

Google 宣布 Google Beam 全球扩张,硬件以 HP Dimension with Google Beam 形式交付,覆盖美国、加拿大、英国、法国、德国和日本六国,并拥有 18 家渠道合作伙伴。Google 内部八周研究显示,使用 Beam 的团队连接感提升 50%,反馈被清晰理解容易度提升 33%,后续会议需求下降 21%。此外,Google

标题直接命中命中实体:google
THE DECODER模型发布1

Google 发布 Flash TTS 系列模型,支持文本描述设计音色

Google 发布两款文本转语音模型 Gemini 3.8 Flash TTS 和 Flash-Lite TTS,支持 100 多种语言。Flash TTS 可通过文本描述从零设计音色,并支持用 30 秒音频样本进行声音克隆,Flash-Lite TTS 面向低成本大规模语音生成。两款模型均支持逐行舞台指示、双人对话和非语言音效,通过 Gemini API

摘要核心命中命中实体:google
Simon Willison's Weblog模型发布1

Gemini 3.8 TTS 试玩场:两款新语音模型与自定义声音

Google 发布了两款新的 Gemini 文本转语音模型 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts,提供超过 2000 种声音库,并支持仅用 30 秒音频样本创建自定义声音。Simon Willison 用 GPT-6 Astra 快速搭建了一个自带密钥的试玩界面,利用 Gemini API 的开放

标题直接命中命中实体:gemini
THE DECODER产品发布1

YouTube 为 Creator Studio 添加脚本辅导、智能缩略图和 Gemini 编辑等 AI 工具

YouTube 在 Creator Studio 中推出一系列 AI 工具,包括分析脚本和粗剪并给出节奏、结构与叙事建议的故事助手,支持最多三个剪辑版本的 A/B 测试,以及自动为不同观众展示最合适预览图的动态缩略图。Gemini 作为聊天式编辑助手接入 Shorts 和 YouTube Create 应用,可重排画面、裁剪片段并同步音乐。此外,YouTub

另有 1 家信源报道

标题直接命中命中实体:google deepmind
Google DeepMind News一手来源产品发布2

Google DeepMind 为 Private AI Compute 引入安全服务端记忆

Google DeepMind 发布 Private AI Compute 架构的技术更新,将私密、服务端记忆引入其平台。该方案通过加密存储与仅存于用户设备的密钥,实现跨设备的持久化 AI 记忆,同时保持设备端级别的隐私标准。数据在云端安全隔离区(secure enclave)中临时解密处理并立即重新加密,使 Google 自身也无法访问用户数据。

9月23日周三 · 2 条
摘要核心命中命中实体:google deepmind
Google DeepMind News一手来源模型发布2

Gemini 3.8 文本转语音模型发布

Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,前者面向创意角色设计与逐行表演控制,后者面向高吞吐、低成本的配音与语音代理场景。新模型支持自然语言生成定制音色、30 秒样本声音复刻、2000+ 预置音色及 100 多种语言,并配备同意验证、SynthI

摘要核心命中命中实体:google
TechCrunch AI产品发布1

YouTube 将用 Gemini 让用户自建推荐算法信息流

YouTube 宣布推出名为 custom feeds 的新功能,允许用户用自然语言描述自己想看的视频类型,由 Google 的 Gemini AI 模型据此生成个性化推荐流,并固定在首页顶部独立标签页中。该功能将于下个月起在网页端和移动端逐步上线,支持创建多个自定义信息流,但不会取代 YouTube 主推荐流。此举跟随 Bluesky、Threads、In