返回主题地图

NVIDIA 英伟达

公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 229 条。
9月15日周二 · 1 条
正文顺带提及命中实体:nvidia
Latent Space观点

Richard Socher 谈 Recursive:用 AI 自动化 AI 研究

Richard Socher 在 Latent Space 播客中介绍其新公司 Recursive,该公司已筹集 46.5 亿美元种子轮,目标是构建可自动化 AI 研究本身的「Eureka Machine」。他声称 Recursive 的 AI 研究系统在不到两天内于优化任务上超越人类及其智能体,并在 NVIDIA GPU 内核优化中无需 CUDA 专家团队

9月14日周一 · 6 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10964,版本号升至 0.4.1

llama.cpp 发布 b10964 版本,将版本号提升至 0.4.1(PR #28900)。该版本为 macOS、iOS、Linux、Android、Windows 及 openEuler 等多个平台提供预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b10952 发布:修复 SYCL oneDNN scratchpad 内存池释放顺序

llama.cpp 发布 b10952 版本,主要修复了 SYCL 后端中 oneDNN scratchpad 破坏内存池释放顺序的问题(PR #28704)。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10951:优化 llama decode 调用时机

llama.cpp 发布 b10951 版本,其中一项改动是将 llama n rs seq 检查移到 llama decode 调用之前,若检查为真则直接返回,从而在不需要时避免调用 llama decode。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SY

正文顺带提及命中实体:nvidia
Hugging Face New and Trending Models一手来源开源

handy-computer 发布 nemotron-3.5 流式 ASR 的 GGUF 量化版

handy-computer 在 Hugging Face 发布了 nvidia/nemotron-3.5-asr-streaming-0.6b 的 GGUF 量化版本,供 transcribe.cpp 使用。该模型是 0.6B 参数的 cache-aware 流式 FastConformer 编码器加 RNN-T 解码器,支持 32 种语言区域的多语言语音

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10948:WebGPU 测试排除 HY V4

llama.cpp 发布 b10948 版本,主要变更是将 HY V4 从 WebGPU 的 test-llama-archs 测试中排除(PR #28855,由 Stanisław Szymczyk 共同提交)。该版本同时提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CUDA、V

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10946:修复 s390x VXE repack 辅助函数

llama.cpp 发布 b10946 版本,主要变更是为 ggml-cpu 的 s390x 架构添加对 VXE 专用 repack 辅助函数的保护(PR #28775)。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、Ope

9月13日周日 · 4 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b10937:OpenCL 行对齐规则扩展至 q4 K/q5 K/q8 0

llama.cpp 发布 b10937 版本,主要变更是将 OpenCL 后端的 noshuffle 行对齐规则从仅适用于 q6 K 扩展到 q4 K、q5 K 和 q8 0 量化类型(PR #28575)。该版本同时提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10935:新增 LOG JSON 结构化日志宏

llama.cpp 发布 b10935 版本,主要变更是为 common 模块新增 LOG JSON 宏,用于记录结构化数据,并在 fit 中加入了演示用法。该版本同时提供了覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10933:jinja 支持点属性整数常量

llama.cpp 发布 b10933 版本,主要变更是 jinja 模板支持点属性整数常量(PR #28817)。该版本同时提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10932:修复 clang 预编译头时间戳构建问题

llama.cpp 发布 b10932 版本,主要修复了 CMake 构建中 clang 预编译头(PCH)因时间戳不一致导致构建失败的问题,该选项覆盖 ccache 视为 MSVC 但底层为 clang 的编译器,包括 clang-cl 和 Intel LLVM 驱动。同时该版本提供了覆盖 macOS/iOS、Linux、Android、Windows 及

9月12日周六 · 9 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10931:UI 新增缓存功能

llama.cpp 发布 b10931 版本,主要变更是为 UI 添加缓存功能(PR #28802),由 Adrien Gallouët 提交。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10930:修复 server 模型上限下载问题

llama.cpp 发布 b10930 版本,主要修复了 server 在模型数量达到上限时仍允许下载模型的问题(对应 issue #26809,PR #28530)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b10929 发布:为 AMD GCN 添加 HIP 配置表

llama.cpp 发布 b10929 版本,主要变更是为 ggml-cuda 后端添加针对 AMD GCN 架构的 HIP 专用配置表(PR #27841)。该版本同时提供覆盖 macOS、Linux、Windows、Android 等平台的预编译二进制包,包含 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。此次更新提升了 AM

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10927:更新 cpp-httplib 至 0.56.0

llama.cpp 发布 b10927 版本,主要变更是将内置的 cpp-httplib 依赖更新至 0.56.0(PR #28787)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10926:优雅处理不支持的 tq1 0 量化

llama.cpp 发布 b10926 版本,主要变更是由贡献者 syscl 提交的补丁,使程序能够优雅地处理不支持的 tq1 0 量化格式(PR #28681)。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVIN

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10923:修复 OpenCL 后端中止问题

llama.cpp 发布 b10923 版本,主要修复了 OpenCL 后端导致程序中止的若干 bug(PR #27630)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b10922:OpenCL 新增 A8 Q4 K 二值化 GEMM 内核

llama.cpp 发布 b10922 版本,主要变更是为 OpenCL 后端新增了一个 A8 Q4 K 非 MoE 二值化 GEMM 内核 kernel gemm noshuffle q4 k f32 32b trans ila a8 bin,并修复了布局兼容性、重命名了二值内核选择辅助函数。该提交由高通工程师 Li He 参与贡献,同时发布了覆盖 mac

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b10921:修复 WebGPU 张量绑定对齐

llama.cpp 发布 b10921 版本,主要修复 WebGPU 后端张量绑定对齐问题:将绑定偏移回退到与张量距离为整数个块的位置,使块量化视图在着色器中获得有效的元素偏移。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b10917 发布:修复 MSVC 下 PCH 构建问题

llama.cpp 发布 b10917 版本,修复了此前在 MSVC 下为 llama-server 启用预编译头(PCH)时引入的构建问题,该修复跳过 MSVC 场景下的 PCH。此次发布同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后