Google 发布 Lyria 3.5 音乐生成模型正式版
Google 在 Gemini API 中正式发布下一代音乐生成模型 Lyria 3.5(lyria-3.5),进入 GA 阶段。该模型支持生成长度完整的歌曲,在音乐连贯性、自然人声以及时长与结构控制方面有所提升,并支持文本和图像输入,输出 44.1 kHz 高保真立体声音频。
公司与模型 · Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与云平台
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 23:05
Google 在 Gemini API 中正式发布下一代音乐生成模型 Lyria 3.5(lyria-3.5),进入 GA 阶段。该模型支持生成长度完整的歌曲,在音乐连贯性、自然人声以及时长与结构控制方面有所提升,并支持文本和图像输入,输出 44.1 kHz 高保真立体声音频。
谷歌发布了Gemini 3.8 Flash模型,该模型通过更多推理步骤和迭代工具调用实现更强性能,但可能因token消耗增加而提高使用成本。该模型在软件工程和自主智能体基准测试中表现优异,同时谷歌推出了面向政府和可信伙伴的Fairwind计划,提供Gemini 3.8 Flash Cyber和CodeMender代理。
另有 1 家信源报道
Google 发布了 Gen AI JavaScript SDK 的 v2.21.0 版本,新增了对 Gemini 3.8 Flash 模型的支持,并更新了 Flash 模型的描述。该版本通过 GitHub 发布,主要面向开发者,便于在 JavaScript 应用中集成最新的 Gemini 模型。
另有 1 家信源报道
谷歌发布Gemini 3.8 Flash及其网络安全版本3.8 Flash Cyber,这是六周内第三款Flash模型。该模型在编码和智能基准上超越前代,价格与3.7 Flash持平,但推理成本更高。谷歌强调其性能提升源于额外推理步骤,并推荐效率敏感场景使用3.7 Flash。
Google DeepMind 推出 Fairwind 计划,向政府、企业和关键基础设施运营商提供 Gemini 3.8 Flash Cyber 模型和 CodeMender 工具,用于自主发现和修复漏洞。该计划旨在帮助防御者以更低成本、更快速度(几分钟内生成补丁)应对网络威胁,目前已有超过 650 家合作伙伴参与。同时,Google.org 宣布累计网络安
另有 1 家信源报道
Google DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber 两款新模型,基于六周内第三次 Flash 更新。3.8 Flash 在软件工程、智能体任务和多步推理上显著提升,定价与 3.7 Flash 相同;3.8 Flash Cyber 专攻网络安全,具备漏洞发现和自动修补能力,通过 Fairwind 计划提供
YouTube顶级创作者MrBeast与谷歌达成多年合作,将在其视频中推广Gemini、Google Health和Fitbit Air。首期视频于9月5日发布,MrBeast团队将利用Gemini在丛林、沙漠和北极等极端环境中生存。此举发生在MrBeast频道订阅数突破5亿后,也反映了YouTube为应对Netflix竞争而加强创作者合作。
谷歌为其Gemini Flash模型新增了基于代理的视频分析功能,该功能不再按固定帧率扫描视频,而是由模型自主决定分析哪些片段及方式。据谷歌称,这可将令牌使用量减少高达88%,成本降低66%,并提高准确性。该功能现已在Gemini API中提供,用于在长视频中查找特定场景,未来将集成到Gemini应用和YouTube中。
另有 1 家信源报道
Gemini API 发布说明宣布 Gemini 3.8 Flash 模型正式全面可用(GA)。该模型被定位为最智能的 Flash 系列模型,专为长周期软件工程、自主智能体及复杂企业工作流设计。用户可通过模型页面和最新模型指南开始使用。
谷歌正与好莱坞多家大型电影公司洽谈,拟支付巨额费用以获取其版权内容用于训练AI模型,例如向迪士尼支付约4000万美元以获得单个角色的生成权。此举旨在提升Gemini等AI产品的公众接受度,并改变AI行业的负面叙事。然而,对电影公司而言,合作虽带来短期收益,却可能引发工人失业和公众反感,存在较大风险。
谷歌宣布为安卓手机推出五项新功能,包括减少晕车的“Motion Assist”、帮助盲人和低视力用户的“Guided Vision”、通过Gemini记住物品位置的“remembered items”、Google Messages中的Keep集成以及聊天个性化选项。这些功能部分追赶苹果,部分利用Gemini提升体验。
谷歌推出名为 Google Pics 的 AI 图像创建和编辑工具,集成于 Workspace 套件,面向商业客户和 AI 订阅用户。该工具由 Nano Banana 图像生成模型驱动,支持通过提示词创建海报、社交媒体帖子等视觉内容,并提供对象隔离、文本修改和协作编辑功能。与 Canva 和 Adobe Express 不同,Google Pics 强调 A
另有 2 家信源报道
Google DeepMind 发布了 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 的智能体视频理解功能,该功能通过原生视频工具动态搜索和检查视频片段,相比静态处理可降低高达 88% 的 token 消耗和 66% 的成本,同时准确率提升最高 7%。该功能现已通过 Gemini API 在 Google AI St
另有 1 家信源报道
Google DeepMind 新任负责人 Koray Kavukcuoglu 表示,前沿 AI 领导力是公司唯一重要的事,并坚信谷歌将重回前沿。他承认当前模型略低于前沿水平,但强调团队和资源足以缩小差距。他未透露 Gemini 4 和 Gemini 3.5 Pro 的具体进展,但指出 Flash 系列正从语言模型向编码智能体转变。
谷歌推出面向Workspace用户的新创意设计工具套件Google Pics,基于Gemini和Nano Banana生成式AI模型,提供精细的图像生成和编辑功能,如对象选择编辑、文本修改、分辨率提升等。该工具以独立应用形式及集成于Docs和Slides中推出,旨在帮助企业用户更轻松地创建专业级营销图像,减少对第三方设计工具的依赖。
另有 2 家信源报道
谷歌宣布推出基于Nano Banana图像生成与编辑模型的Google Pics工具,面向Google AI Pro和Ultra订阅用户及多数Workspace商业客户。该工具提供对象分割、图像内文本编辑与翻译、协作编辑及多版本生成等功能,并集成到Slides、Docs和Drive中,使用户无需切换应用即可完成图像创作与编辑。
另有 2 家信源报道
德国非营利组织AlgorithmWatch通过欧盟《数字服务法》获取谷歌搜索API数据,对2026年德国东部三州选举相关查询进行了4480次搜索,发现谷歌AI概览在选举问题上的显示频率低于非政治问题,且模式不一致,如关于极右翼AfD的问题触发概览的比例较低。AI概览引用的来源高度集中,近一半链接指向十个域名,其中谷歌自家平台YouTube被引用最多。AI对政
Google 的 AI 搜索(AI Overviews)在用户输入与特定国籍(如非洲人、印度人、巴基斯坦人)独处时,会建议拨打紧急服务电话,而对英国人则建议喝茶和闲聊天气。该问题最初由 Reddit 用户发现,Futurism 测试证实。Google 回应称结果不符合标准,正在修复,并指出“alone”是触发词。修复后,针对国籍的异常建议已消失,但针对 Fa
Google 发布了 Gen AI JavaScript SDK 2.20.0 版本,新增了对 audio/webm MIME 类型的支持、GEAP 的 translation config SDK 支持,以及 Interactions API 的视频理解功能。同时修复了文件上传请求中冗余 Content-Length 的问题,并暴露了 Processing
Google 发布了 Gen AI Python SDK 的 v2.21.0 版本,新增了文件下载到磁盘或文件类对象的目标参数、支持 audio/webm MIME 类型、为 GEAP 添加翻译配置支持,以及为 Interactions API 添加视频理解支持。同时修复了 Interactions SDK 中 ProcessingCallStep 和 Pr