返回主题地图

NVIDIA 英伟达

公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49

相关与对比厂商作为比较对象、合作方或受影响主体,当前共 94 条。
8月24日周一 · 1 条
对比或关联对象命中实体:nvidia
Hugging Face Blog一手来源产品发布

FINCHAL 金融预测挑战赛:区分运气与技能

Hugging Face 博客宣布举办 FINCHAL 金融预测挑战赛,这是一场 AI 与人类交易员的竞赛,涉及 NVIDIA、比特币、黄金和石油四种资产,总奖金 2000 美元。该竞赛旨在通过随机基准和自检评分代码来区分运气与技能,并允许 AI 代理与人类平等参与。竞赛采用仓位连续值(-1 到 1)的评分机制,并固定杠杆为 1,以避免过度投机。

8月23日周日 · 2 条
标题相关提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10594 发布:修复 CUDA 显存浪费问题

llama.cpp 发布 b10594 版本,主要修复了设备信息循环在非 TRACE 日志级别下仍会创建 GPU 上下文并导致 CUDA 后端分配 550 MB 显存的问题。该修复通过检查日志详细级别,在无输出时跳过设备循环,避免不必要的 GPU 资源占用。

标题相关提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10589 发布:新增 CUDA POOL 1D 支持

llama.cpp 发布 b10589 版本,主要新增 CUDA 后端对 POOL 1D 操作的支持,并修复了 editorconfig 兼容性问题。该版本提供了适用于 macOS、Linux、Windows、Android 等多平台的预编译二进制文件,涵盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等后端。

8月21日周五 · 3 条
对比或关联对象命中实体:nvidia
TechCrunch AI商业

Starcloud 融资 2.5 亿美元建设轨道数据中心,应对发射市场紧张

轨道数据中心初创公司 Starcloud 宣布完成 2.5 亿美元融资,使其 A 轮融资总额达到 4.2 亿美元,公司估值达 23 亿美元。资金将用于扩大制造设施并推进其最大的轨道数据中心航天器 Starcloud-3,该航天器计划搭载 SpaceX 的 Starship 火箭发射。由于发射市场紧张,公司正积极预订发射能力,并已向 FCC 申请运营 8.8

对比或关联对象命中实体:nvidia
THE DECODER产品发布

Waymo自研芯片用于自动驾驶出租车,减少对英伟达依赖

Alphabet旗下的自动驾驶子公司Waymo已开发出用于其自动驾驶出租车的定制芯片,以减少对英伟达的依赖。该芯片已在最新一代车辆中运行,能更快处理传感器数据并运行AI模型,性能超过1000 TOPS,由台积电采用5纳米工艺制造。此举旨在降低成本,Waymo正将其安装在与极氪合作打造的新款自动驾驶出租车上。

对比或关联对象命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10534 发布:CUDA 解码交叉点优化

llama.cpp 发布 b10534 版本,主要更新为 CUDA 后端新增按硬件和量化类型调整的切换点,用于优化 mvq 到 MMQ 解码的交叉点。该更新引入了运行时环境变量 GGML CUDA MMVQ MAX 来调整批量大小阈值,并针对 Blackwell、Ada 等硬件进行了调优,在 RTX 5090 上 Q4 K 密集解码在 B=8 时性能提升 2

8月19日周三 · 2 条
正文主语命中实体:nvidia
雷峰网 AI科技评论模型发布

英伟达发布 Cosmos 3 世界基础模型,欲统一具身智能全模态

英伟达在悉尼 RSS 2026 上发布 Cosmos 3,这是一个面向物理 AI 的多模态世界基础模型,在单一 Transformer 架构下统一了文本、视觉、音频和动作模态。Cosmos 3 提供 Edge(4B)、Nano(16B)和 Super(64B)三个版本,支持世界理解、未来模拟和动作执行,并完全开源。英伟达物理 AI 专家 Max Li 在演讲

正文主语命中实体:nvidia
雷峰网 AI科技评论研究

RSS 2026:世界模型成为具身智能新核心,英伟达开源Cosmos 3

在RSS 2026大会上,具身智能领域面临物理世界落地的挑战,业界共识转向以世界模型为核心的‘想象力’驱动。Pi团队展示了零样本泛化,OpenDrive Lab提出组合式世界模型,英伟达发布全模态世界模型Cosmos 3并开源,旨在构建物理AI生态。会议凸显机器人从‘死记硬背’向‘举一反三’的转变。

8月18日周二 · 2 条
标题相关提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp v0.1.2 发布:同步 ggml 并优化 CUDA 性能

llama.cpp 发布了 v0.1.2 版本,主要更新包括同步 ggml 子模块、升级 ggml 版本至 0.20.2、修复 xcframework 构建问题、优化 CUDA 性能(MMVQ nwarps=8)、改进 UI 和文档(如 MCP stdio 服务器说明)、增强 mtmd 图像处理(使用 SHA256 哈希)等。该版本还提供了 nightly

对比或关联对象命中实体:nvidia
TechCrunch AI商业

Groq 融资 3.5 亿美元,转型 AI 云服务提供商

AI 芯片初创公司 Groq 宣布获得 3.5 亿美元融资,由 Disruptive 领投,Nvidia 计划参投,估值 35 亿美元,较去年 9 月的 69 亿美元有所下降。Groq 正从 AI 芯片制造商转型为提供 Nvidia GPU 和 AI 基础设施服务的 neocloud 公司,计划到 2027 年将数据中心容量从 54 兆瓦扩展到 200 兆瓦

8月17日周一 · 1 条
正文主语命中实体:nvidia
雷峰网 AI科技评论研究

CVPR 2026:3DGS 从画质内卷转向具身智能物理底座

CVPR 2026 上,3DGS 研究从追求画质转向工业落地,多篇论文聚焦前馈生成、GPU 算子重构、抗噪 SLAM 与物理碰撞推算,旨在打通全管线,使其成为具身智能与世界模型的物理底座。代表性工作包括 EcoSplat 实现算力自适应裁剪、SparseSplat 实现智能稀疏化、CaT-GS 提升大场景渲染速度、EDGS 消除高斯分裂、TokenGS 解耦

8月13日周四 · 1 条
对比或关联对象命中实体:nvidia
量子位研究

Ilya首个模型曝光:SSI探索测试时训练,8月或亮相

据量子位报道,前OpenAI首席科学家Ilya Sutskever创办的SSI公司被曝正在开发基于测试时训练(TTT)的小型推理引擎,该模型能在推理过程中更新权重,实现持续学习。爆料称当前版本可能于8月向少数用户开放,且英伟达已与SSI达成战略合作并投资,算力将提升10倍。若属实,这将是SSI成立两年来的首个模型,可能改变AI训练范式。

8月12日周三 · 1 条
对比或关联对象命中实体:nvidia
TechCrunch AI商业

River AI获11亿美元融资,旨在重塑AI训练以打造个人化代理

由xAI联合创始人Igor Babuschkin创立的AI初创公司River AI,在成立仅两个月后获得了由General Catalyst和AMP PBC领投的11亿美元融资,Nvidia、AMD Ventures、Y Combinator和Temasek参投。River AI旨在从头重建AI技术栈,包括训练、模型、产品层和硬件,以开发个人可训练的AI助手

8月11日周二 · 3 条
正文主语命中实体:nvidia
量子位商业

英伟达联合华尔街巨头,拟融资5000亿美元建设AI工厂

英伟达CEO黄仁勋宣布与Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs和KKR等华尔街机构合作,建立独立融资平台,计划撬动超过5000亿美元第三方资本用于AI基础设施建设。黄仁勋提出AI工厂概念,将GPU算力包装为可投资的基础设施资产,并回应了循环融资的质疑。文章同时提及算力价格近期上涨,但也警示了类

标题相关提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10353 发布:修复 CUDA/Metal 的 ROLL 操作

llama.cpp 发布 b10353 版本,修复了 CUDA 和 Metal 后端中 ggml roll 操作对非连续输入产生错误结果的问题。该修复要求 src 张量连续,并添加了相应的测试用例。同时提供了多个平台的预编译二进制文件。

对比或关联对象命中实体:nemotron
llama.cpp Releases一手来源产品发布

llama.cpp b10344 发布:新增 Nemotron MTP 支持

llama.cpp 发布 b10344 版本,主要新增了对 Nemotron 模型的多 token 预测(MTP)支持,并引入了 mtp flags 配置。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,方便用户部署。

8月10日周一 · 1 条
对比或关联对象命中实体:nvidia
量子位模型发布

Om AI联汇开源端侧原生VLX-Seek 1.5,3B模型多项评测超越英伟达

Om AI联汇完成数亿元融资,并开源全球首款端侧原生模型VLX-Seek 1.5。该模型有3B和10B两个版本,采用流式多模态架构,在无人机视角、指代表达理解等任务上超越英伟达LocateAnything等更大模型。公司旨在通过端侧原生路线,推动物理AI在机器人、无人机等场景的规模化落地。

8月9日周日 · 2 条
对比或关联对象命中实体:cuda
雷峰网 AI科技评论商业

摩尔线程上半年营收17.36亿元超去年全年,商业化提速

国产GPU公司摩尔线程发布2026年半年度报告,上半年营收17.36亿元,同比增长147.42%,已超2025年全年,亏损大幅收窄。公司研发投入持续增加,旗舰产品MTT S5000实现规模化量产,夸娥智算集群在多城市部署,并完成多个大模型训练项目。公司构建了云边端全场景算力布局,MUSA生态兼容CUDA,开发者超80万。

标题相关提及命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10330 发布:CUDA 融合 rms norm 与 rope 操作

llama.cpp 发布 b10330 版本,主要更新是在 CUDA 后端中融合了 rms norm、mul 和 rope 操作,并添加了相关测试和内存范围检查。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件。

8月8日周六 · 1 条
对比或关联对象命中实体:cuda
llama.cpp Releases一手来源产品发布

llama.cpp b10327 发布:修复 CUDA 量化 cpy 内核线程块计数

llama.cpp 发布 b10327 版本,主要修复了 CUDA 下量化 cpy 内核启动时线程/块数量计算错误的问题,并增加了不均匀块数量的测试用例。该版本提供了适用于 macOS、Linux、Windows、Android 等多个平台的预编译二进制文件,涵盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等后端。