Red Hat 发布 gemma-4-12B-it FP8 动态量化模型
Red Hat 发布了基于 Google gemma-4-12B-it 的 FP8 动态量化版本,使用 vLLM 的 llm-compressor 工具对权重和激活进行量化,并提供了完整的量化脚本和评估方法。该模型已在 RHOAI 3.5、RHAIIS 3.5 和 vLLM 0.24.0 上验证,旨在提升推理效率。
公司与模型 · Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与云平台
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-26 23:05
Red Hat 发布了基于 Google gemma-4-12B-it 的 FP8 动态量化版本,使用 vLLM 的 llm-compressor 工具对权重和激活进行量化,并提供了完整的量化脚本和评估方法。该模型已在 RHOAI 3.5、RHAIIS 3.5 和 vLLM 0.24.0 上验证,旨在提升推理效率。
谷歌传奇工程师Jeff Dean在KDD 2026上自曝离职前最后48小时的经历,包括向139名亲近同事宣布离职、参加约1500人的告别会、深夜回复数百条消息等。他于8月6日正式离开谷歌,随后与Sanjay Ghemawat等人共同创办新公司Discovery Loop,担任联创兼CEO,旨在用AI加速机器学习与科学研究。
一篇研究论文展示了如何通过重放加密的推理块,从Claude、GPT和Gemini等前沿模型中提取隐藏的推理痕迹,并成功移植到其他模型或会话中,从而显著提升开源模型性能。初步扫描约7000个公共痕迹发现62个API密钥、33个邮箱和33个密码等敏感数据泄露。该漏洞已负责任披露,部分已修复,但类似攻击仍可能发生。
研究人员发现,Anthropic、OpenAI 和 Google 等大型语言模型提供商返回给客户端的加密推理痕迹块在不同会话、用户和模型间可互换,存在架构漏洞。通过将该痕迹注入同一提供商的较弱模型中,可强制其解码并输出明文,从而绕过反蒸馏机制,实现私有数据提取、隐藏危险信息泄露和隐形提示注入。研究团队从公共仓库中解码了 315,320 个推理块,恢复了 36
另有 1 家信源报道
安全研究人员发现了一个影响所有主要AI提供商API的漏洞,可以读取推理模型的加密思维过程。通过越狱,他们使用较小的模型转录更强大模型的原始推理,并在公开会话中暴露了密码和API密钥。该漏洞还加剧了关于推理蒸馏的争议,并揭示了模型内部使用难以理解的语言或考虑欺骗行为。
亚马逊近期简化了订单确认邮件,不再列出具体商品名称,仅显示商品类别,引发用户不满。亚马逊发言人表示此举是为了引导用户使用其应用和网站获取详细信息,并减少在外部共享客户信息以提升隐私。分析认为,这可能是亚马逊为应对AI购物代理(如Google的Gemini Spark)带来的竞争,保护其与消费者的直接关系。
戴盟机器人宣布完成数亿元融资,由蚂蚁集团领投,老股东超额跟投,两个月内连续完成两轮融资。该公司孵化于香港科技大学,专注于触觉感知与物理AI,发布了全球首个触觉锚定世界模型Daimon-TWM,并已实现视触觉传感器万片级出货,服务全球200余家客户。融资将用于推动触觉感知、数据与模型的商业化落地,覆盖3C精密制造和汽车智造等场景。
另有 1 家信源报道
DreamFast 发布了基于 Google Gemma 3 12B IT 的 abliterated 版本 Heretic v2,通过 Heretic v1.3.0 减少模型拒绝行为,同时保持质量,并针对视频生成模型 LTX-2 优化。该模型提供 FP8、INT8 (ConvRot)、NVFP4、MXFP8 和 GGUF 等多种量化格式,支持从 Ada 到
该研究提出一种基于激活工程的虚假信息检测框架,通过对比真实与虚假陈述的激活差异提取“虚假方向”,并在推理时将未知声明的最后token激活投影到该方向进行分类,无需微调或外部知识检索。方法在Gemma、Llama和Qwen家族的11个模型(270M至12B参数)上评估,在LIAR和FACTors基准上匹配或超越零样本和少样本提示基线,尤其在小模型上提升显著,但
Om AI联汇完成数亿元融资,并开源全球首款端侧原生模型VLX-Seek 1.5。该模型有3B和10B两个版本,采用流式多模态架构,在无人机视角、指代表达理解等任务上超越英伟达LocateAnything等更大模型。公司旨在通过端侧原生路线,推动物理AI在机器人、无人机等场景的规模化落地。
谷歌DeepMind发布了DiffusionGemma的技术报告,该模型基于Gemma-4-26B-A4B改造而成,无需从头训练,采用文本扩散方法并行生成256个token,在H100上达到每秒1500 token的速度。通过两阶段训练(重建和SD·RL)平衡质量与速度,在推理基准上平均提升10分,但绝对性能仍低于自回归模型,且存在重复循环和多用户吞吐量下降
据Semafor和CNBC报道,谷歌DeepMind的人才流失主要归因于芯片短缺、利益冲突和谷歌的官僚作风。CEO Demis Hassabis约一年前已退居二线,将日常管理交给Koray Kavukcuoglu,他自认是科学家而非管理者。研究人员对TPU芯片访问受限感到不满,而谷歌云却将芯片卖给Anthropic等竞争对手。谷歌还宣布与前沿AI实验室Mir
AI实验室Mirendil与谷歌云签署了一项价值超过1亿美元的多年合作协议,以获得其自我改进AI研究所需的计算资源。该协议使Mirendil能够使用谷歌的TPU和英伟达GPU,以及托管训练集群。Mirendil的联合创始人兼CEO Benham Neyshabur表示,这笔交易约占该公司6月底种子轮融资的一半,该轮融资估值达10亿美元。Mirendil旨在开
PydanticAI 发布 v2.24.0 版本,主要包含多项 bug 修复,涉及 Google、Bedrock、OpenRouter、Groq 等提供商,以及 AG-UI 协议兼容性改进。修复了 Google 提供商超时参数、Bedrock 流处理、Kimi 推理模型识别等问题,并新增了对 Groq 复合模型名称的支持。
SpaceX 的 AI 收入同比增长超过三倍,达到 26 亿美元,主要来自向 Anthropic 和 Google 等公司提供算力的交易。尽管 AI 部门本季度亏损 15 亿美元,但整体亏损收窄至 1.43 亿美元。公司资本支出达 183.7 亿美元,主要用于建设 AI 算力,同时 Starship 的开发推高了太空部门成本。马斯克表示 SpaceX 正在以
据《纽约时报》报道,特朗普政府曾考虑对中国开源权重AI模型(如月之暗面的Kimi K3)实施制裁和贸易禁令,指控其窃取美国技术。OpenAI和Anthropic支持限制,而英伟达、Meta、微软和谷歌等科技巨头强烈反对。在行业抵制后,政府暂时放弃强硬措施,转而专注于提升美国模型的竞争力。
Together AI 的研究显示,语音识别系统在识别不同语言背景说话者所说的街道名称时,平均转录错误率达 39%,非英语母语者的准确率比英语母语者低 18%。他们提出了名为“跨语言风格迁移”的合成数据生成技术,用不到 1000 个训练样本将错误率相对降低 60%。该研究还引入了 SF Streets 和 US Streets 两个新基准,并估计仅旧金山出租
Anthropic 于 2026 年 6 月 30 日宣布,因美国出口管制而暂停的 Claude Fable 5 和 Mythos 5 已恢复访问,Fable 5 将于 7 月 1 日全球重新上线。此前,亚马逊研究人员发现绕过 Fable 5 安全防护的方法,促使 Anthropic 训练了改进的安全分类器,并联合亚马逊、微软、谷歌等提出行业通用的越狱严重性
PydanticAI 发布 v2.22.0 版本,包含多项新功能和错误修复。新功能包括允许 MCPToolset 客户端跳过可选 MCP 任务、默认在支持的模型上启用 Gemini VALIDATED 工具模式、添加 RunContext.is tool available 等。此外,修复了多个与 Temporal 工作流、事件循环、工具验证相关的问题,并更
苹果CEO蒂姆·库克在最后一次财报电话会议上表示,Siri AI升级可能对重度用户设置付费墙,用户可通过iCloud+订阅购买更多计算资源。新版Siri AI已在iOS 27测试版中提供,计划今年秋季全面推出。苹果在AI助手领域落后,曾向谷歌授权Gemini模型,并因iPhone 16 AI功能宣传问题支付2.5亿美元和解金。