返回主题地图

NVIDIA 英伟达

公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 229 条。
9月27日周日 · 2 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源21

llama.cpp 发布 b11202:修复 Windows 下 wake fd 警告

llama.cpp 发布 b11202 版本,主要修复了 Windows 平台上 server 的 wake fd 警告问题,由 Adrien Gallouët 提交。该版本同时提供 macOS、Linux、Windows、Android 等多平台及多种后端(CUDA、Vulkan、ROCm、SYCL、OpenVINO 等)的预编译二进制包。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源19

llama.cpp 发布 b11201:回滚统一 KV 自动适配上下文长度改动

llama.cpp 发布 b11201 版本,主要变更是回滚了此前合并的 PR #28849(统一 KV 缓存下自动适配最大上下文长度的改动),恢复原提交 b04d4e5 之前的行为。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN

9月26日周六 · 5 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源14

llama.cpp 发布 b11199:修复 jinja 编译错误

llama.cpp 发布 b11199 版本,主要修复了 jinja 模板相关的编译错误(PR #29468)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源11

llama.cpp 发布 b11193:Hexagon 后端用二进制检查查找软件除法调用

llama.cpp 发布 b11193 版本,主要变更是为 Hexagon 后端引入通过二进制检查工具查找软件除法调用的脚本,并修复了表格对齐问题。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源10

llama.cpp 发布 b11192:更新 cpp-httplib 至 0.58.0

llama.cpp 发布 b11192 版本,主要变更是将内置的 cpp-httplib 依赖更新至 0.58.0(PR #29407)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,包含 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源8

llama.cpp 发布 b11185:提取共享 Unicode 路径/字符串辅助函数

llama.cpp 发布 b11185 版本,主要变更是将共享的 Unicode 路径与字符串辅助函数提取到 common 模块(PR #29415),由 Adrien Gallouët 提交。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制,支持 CUDA、Vulkan、ROC

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源8

llama.cpp b11183:Metal FA kernel 按数据类型拆分

llama.cpp 发布 b11183 版本,主要变更是将 Metal 后端的 flash attention(fa)kernel 按数据类型拆分为独立库,并附带一处注释小修正。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端的预编译二进制包。

9月25日周五 · 13 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源7

llama.cpp b11181 发布:提高 HIP 版本要求以支持 fp8

llama.cpp 发布 b11181 版本,主要变更是提高 HIP 版本要求以支持 fp8,避免在 HIP 6.2 中缺少 hip fp8 e4m3 支持的问题。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

正文顺带提及命中实体:nvidia
TechCrunch AI商业2

Ricursive Intelligence 谈 AI 何时开始设计自己的硬件

TechCrunch 报道,由前 Google AlphaChip 负责人 Anna Goldie 和 Azalia Mirhoseini 创立的 Ricursive Intelligence 正在开发能自动设计芯片并从设计中学习的 AI 系统,目标是将芯片设计周期从两三年缩短到数周。两人此前在 Google 共同领导 AlphaChip,其成果曾用于多代

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源7

llama.cpp 发布 b11180:修复 RPC 分配缓存键

llama.cpp 发布 b11180 版本,主要修复了 RPC 后端中 get alloc size 缓存键未包含 nb 参数的问题,并将计算结果下限设为 ggml nbytes。该改动由 Georgi Gerganov 等人提交,旨在提升 RPC 内存分配计算的正确性。同时发布了覆盖 macOS、Linux、Windows、Android 等多平台及 C

正文顺带提及命中实体:nvidia
量子位研究3

Skild AI 机器人自我对弈140年学会踢球

美国具身智能公司 Skild AI 发布人形机器人 Messinator,其大脑基于旗舰机器人基础模型 S1,并在 NVIDIA Isaac Sim 虚拟足球场中通过强化学习与自我对弈训练约 140 年。训练中仅设定进球奖励,机器人自行学会盘带、护球、抢断和倒地起身等动作,并迁移到真实人形机器人上。该成果延续了 Skild AI 跨硬件基础模型 Skild

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源7

llama.cpp b11178:修复 MUSA/MTT S5000 算子失败与构建问题

llama.cpp 发布 b11178 版本,集中修复 MUSA 后端(摩尔线程 MTT S5000 / PH1)的多个问题。改动包括:让 MUSA 使用 16 字节拷贝、启用 CUB 路径、采用上游代码路径、移除多余编译期守卫、在 PH1 上禁用 MMQ 路径,并修复 fused TOPK MOE 内核在 MUSA 上的死锁。修复后 27B 模型困惑度从

正文顺带提及命中实体:nvidia
雷峰网 AI科技评论研究3

梁文锋署名11篇论文:从MoE到DSec的底层技术狙击史

雷峰网AI科技评论梳理了梁文锋过去三年署名的11篇论文,涵盖DeepSeek LLM、DeepSeekMoE、DeepSeek-V2、DeepSeek-Coder-V2、DeepSeek-V3、DeepSeek-R1、NSA、mHC、DSpark及最新DSec等。文章称这些论文分别从数据配比、MoE架构、MLA注意力、代码能力、低成本训练、纯强化学习推理、硬

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源5

llama.cpp b11175:Hexagon 后端新增 q5 k 量化支持

llama.cpp 发布 b11175 版本,主要变更为在 Hexagon 后端新增 q5 k 量化类型支持(PR #29123)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。此次更新提升了高

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源4

llama.cpp b11174:Hexagon 后端 CONCAT 采用 DMA

llama.cpp 发布 b11174 版本,主要变更是为 Hexagon 后端在连续 dim1 的 CONCAT 操作中引入 DMA,并针对 DMA64 更新了 CONCAT DMA 实现。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROC

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源4

llama.cpp b11173 发布:修复 Metal 图捕获

llama.cpp 发布 b11173 版本,主要修复 Metal 后端的图捕获(graph capture)逻辑:当图没有节点时提前返回,移除 capture compute 的冗余重置,在捕获错误信息中提示 METAL CAPTURE ENABLED=1,并向 ggml metal op init 传入 capture compute == 0 以仅在捕

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源4

llama.cpp b11167:Hexagon 后端支持 I32 CPY 与 CONT

llama.cpp 发布 b11167 版本,主要变更为 Hexagon 后端新增对 I32 类型 CPY 和 CONT 操作的支持(PR #29379)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源3

llama.cpp 发布 b11165 版本

llama.cpp 发布 b11165 版本,主要变更是测试相关的 flush status(#28352)。该版本为 macOS/iOS、Linux、Android、Windows、openEuler 等多平台提供预编译二进制包,覆盖 CPU、CUDA 12/13、Vulkan、ROCm、OpenVINO、SYCL、Snapdragon 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源3

llama.cpp b11163 发布:新增 llama batch ext 批处理 API

llama.cpp 发布 b11163 版本,核心变更是新增 llama batch ext API(PR #24669),支持在同一个 batch 中同时处理 token、embedding 和 state,并引入 llama embd、llama batch ext add embd、llama batch ext set embd state 等接口,

正文顺带提及命中实体:nvidia
TechCrunch AI商业1

TechCrunch 2026 创始人峰会定档 11 月 4 日波士顿

TechCrunch 宣布将于 2026 年 11 月 4 日在波士顿 SoWa Power Station 举办全天制 Founder Summit,面向各阶段创始人,聚焦融资、AI 原生创业与领导力。活动前身为 Early Stage 和 All Stage,议程包含多场演讲与分组讨论,并设有 11 月 1-7 日的周边活动周。门票分投资者 399 美元