谷歌Pixel 2026发布会前瞻:新设备与名人阵容
谷歌将于8月12日举办Made by Google 2026活动,预计发布Pixel 11系列、新一代Pixel Fold、Pixel Watch 5及可能的Pixel Tag追踪器。活动由喜剧演员Trevor Noah主持,邀请多位名人嘉宾,但预购倒计时比活动早8小时结束,暗示手机可能提前揭晓。去年活动因名人效应吸引840万观众,今年谷歌进一步强化娱乐化路
产业与政策 · 加速卡、算力供给与硬件供应链 · 共 19 条
谷歌将于8月12日举办Made by Google 2026活动,预计发布Pixel 11系列、新一代Pixel Fold、Pixel Watch 5及可能的Pixel Tag追踪器。活动由喜剧演员Trevor Noah主持,邀请多位名人嘉宾,但预购倒计时比活动早8小时结束,暗示手机可能提前揭晓。去年活动因名人效应吸引840万观众,今年谷歌进一步强化娱乐化路
英伟达CEO黄仁勋宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR等华尔街机构合作,建立独立融资平台,计划撬动超过5000亿美元第三方资本用于AI基础设施建设。黄仁勋提出AI工厂概念,将GPU算力包装为可投资的基础设施资产,并回应了循环融资的质疑。文章同时提及算力价格近期上涨,但也警示了类
AWS 发布了 SageMaker AI Spaces 插件,用于在 Amazon EKS 集群上运行 JupyterLab 和 Code Editor 等交互式 IDE。该插件使数据科学家能在现有集群上快速启动开发环境,无需切换到独立 JupyterHub 或本地笔记本,从而保留 GPU 节点、共享存储和 IAM 角色。相比传统方案(需 3-5 天设置),
初创公司Discovered Materials利用AI代理群寻找新型半导体材料,以解决芯片过热问题,并已获得900万美元种子轮融资。该公司结合Anthropic模型和自训练的物理模型进行材料筛选,已发现多种与现有芯片材料性能匹配的新材料,但尚未公开细节。其创始人认为,AI加速了材料发现过程,但实际合成仍是瓶颈。
苹果正在测试中国DRAM厂商长鑫存储的内存芯片,用于iPhone和MacBook,以应对AI带来的内存需求增长。同时,苹果加速推进中国版Apple Intelligence,阿里千问已确认进入其AI体系,百度则参与开发AI搜索功能。这些举措表明苹果正通过中国芯片和AI服务来应对当前的内存短缺和本地化需求。
Firebird 在亚美尼亚启动了独联体地区最大的 AI 工厂,由 NVIDIA 加速计算和 Dell 基础设施提供支持,计划到 2027 年底部署超过 7 万块 NVIDIA Rubin 和 Blackwell GPU,总容量达 300 兆瓦。该工厂基于 NVIDIA DSX 平台,能效提升 40%,并已吸引 Perplexity 等客户。NVIDIA 和
AMD 收购了加拿大 AI 初创公司 Taalas,该公司将 AI 模型直接嵌入芯片,实现极速推理。其演示芯片运行 Llama 3.1-8B 时每秒处理超 1.6 万 token,远超竞品。AMD 计划将该技术整合进其加速器路线图,与 Instinct GPU 一起提供系统级解决方案。
据彭博社报道,OpenAI 计划于 2027 年推出首款智能音箱,售价超过 300 美元。该设备为无屏幕的甜甜圈形状,大小类似冰球,配备麦克风、扬声器、摄像头和灯光,并具有移动部件。它旨在像 ChatGPT 的语音模式一样工作,但能学习并适应用户,感觉更生动。苹果公司因 OpenAI 挖角其 400 多名员工而提起诉讼,指控其窃取硬件商业机密,这可能导致该产
另有 2 家信源报道
OpenAI 计划于2027年推出一款冰球大小的智能音箱,售价超过300美元,由Jony Ive的LoveFrom工作室联合设计。该设备无屏幕,带有可动部件和摄像头,旨在提供更生动的交互体验。此外,苹果正起诉OpenAI涉嫌窃取金属加工商业秘密,OpenAI否认并已申请驳回诉讼。
据彭博社报道,OpenAI 正在开发一款甜甜圈形状的 AI 智能音箱,售价可能在 300 至 400 美元之间,采用高品质金属材质,并具有独特的活动部件。该设备由 OpenAI 与 Jony Ive 的设计工作室 LoveFrom 合作开发,预计于 2027 年发布。此举旨在将 ChatGPT 更深入地融入用户生活,但智能音箱市场历来盈利困难,且面临苹果的诉
另有 2 家信源报道
据彭博社记者马克·古尔曼报道,OpenAI 与苹果前设计师乔尼·艾维合作开发的首款 AI 设备是一款电池供电、甜甜圈形状、大小类似冰球、无显示屏的智能音箱,预计于 2027 年发布,售价超过 300 美元。该设备具有独特外观和可动部件,通过灯光、摄像头和传感器与用户交互,类似 ChatGPT 语音模式但更先进,旨在便于单手携带,可能成为 OpenAI 一系列
另有 2 家信源报道
在CCF Chip 2026大会上,中科通量发布了全球首款RISC-V数据流架构视频智能AIGC芯片金刚GC3,该芯片采用12核设计,支持128路1080P硬解码,INT8算力达200 TOPS。金刚GC3通过数据流架构优化视频处理效率,旨在解决通用芯片在视频AI场景下的能耗和延迟问题,标志着国产RISC-V高端算力在视频专用领域的商业化提速。
OpenAI 发布博文反驳苹果的诉讼,称其指控“草率、激进且针对个人”,并公开了 iMessage 和电子邮件记录作为证据。苹果指控前员工 Chang Liu 和 Tang Tan 窃取商业机密,但 OpenAI 表示这些指控基于虚假信息,且公司无意获取苹果机密。OpenAI 试图通过公开沟通记录影响公众舆论,而非法律回应。
另有 1 家信源报道
NVIDIA技术博客发布了一篇教程,介绍如何在共享GPU基础设施上运行隔离的租户Kubernetes集群。该方案使用单一控制平面集群和GPU池,通过KAI Scheduler和vCluster两个开源工具,为每个团队提供独立的Kubernetes控制平面(包括API服务器、控制器、数据存储、同步器和调度器),同时共享底层GPU硬件。教程以一块NVIDIA L
vLLM 发布 v0.21.0 版本,包含 367 个提交,来自 202 位贡献者。该版本正式弃用 transformers v4,要求 C++20 编译器,并引入 KV 卸载与混合内存分配器集成、推理预算感知的投机解码、Blackwell 上的 TOKENSPEED_MLA 后端等新特性。同时新增多种模型架构支持,并在性能、硬件支持(如 AMD ROCm、
Groq 在 GroqCloud 上预览了 Moonshot 的 Kimi K2 模型,并解释了其 LPU 架构如何通过 TruePoint 数值格式、SRAM 存储和静态调度等技术,在不损失精度的情况下实现万亿参数模型的快速推理。该架构通过选择性降低精度和优化内存层次,实现了比传统 GPU 更高的推理速度和更低的延迟。
Together AI 宣布推出基于 NVIDIA Blackwell 平台的 GPU 集群,并配套优化的 AI 加速软件栈 Together Kernel Collection。该集群在训练 70B 参数模型时速度比 H100 快 90%,达到每节点每秒 15,200 tokens。Together AI 利用 ThunderKittens 框架开发了自定
Groq 公司发布了其 LPU(语言处理单元)AI 推理技术的详细介绍,该处理器专为运行大型语言模型等 AI 工作负载而设计,相比 GPU 在架构层面能效提升高达 10 倍。LPU 采用软件优先、可编程流水线架构、确定性计算与网络以及片上内存等核心设计原则,旨在提供更快的推理速度和更高的效率。Groq 的 GroqCloud 平台由 LPU 驱动,展示了其在
Together AI 的 kernels 团队在 2022 年通过 FlashAttention 实现了 2-3 倍加速,证明了 GPU 优化仍有巨大潜力。2025 年 3 月,该团队在获得 NVIDIA Blackwell GPU 后的一周内,利用 ThunderKittens 库开发出最快的 FP4/FP8 GEMM 内核,性能比 H100 上的 cu