返回主题地图

NVIDIA 英伟达

公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给

关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49

顺带提及正文出现过,但不是文章的主要讨论对象,当前共 229 条。
9月22日周二 · 4 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b11078:新增采样参数环境变量配置

llama.cpp 发布 b11078 版本,新增通过 LLAMA ARG 环境变量配置 temperature、top-p、min-p 及各类惩罚参数的能力,使 llama-server 可完全通过环境文件(如 Debian 上的 systemd)控制。同时使用 llama-gen-docs 重新生成 readme 文件,并提供了覆盖 macOS、Linu

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11076 版本

llama.cpp 发布 b11076 版本,主要变更为移除测试中的过时注释(#29140)。该版本同步提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11075:简化 ggml-metal 融合算子声明

llama.cpp 发布 b11075 版本,主要改动是简化 ggml-metal 后端中融合算子(fusion pattern)操作列表的声明方式,从 ops all 派生非空融合算子并去掉模式向量中的 all 后缀。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROC

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11074:修复 JSON 枚举处理

llama.cpp 发布 b11074 版本,主要修复了 JSON 枚举(enum)处理问题,为枚举值添加了 common json value 处理逻辑,并曾添加 tests/test-json.cpp 测试但按要求移除。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端(CUDA、Vulkan、ROCm、SYC

9月21日周一 · 6 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b11073:SYCL 合并 MKL-FA softmax 加载

llama.cpp 发布 b11073 版本,主要变更是 SYCL 后端对 MKL-FA softmax 加载进行合并(coalesce),替代原先每行一个 work-item 的实现方式,并改进了变量命名可读性。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译包,覆盖 CUDA、Vulkan、ROCm、SYCL、Ope

正文顺带提及命中实体:nemotron
Interconnects AI观点

开放模型当前的力量格局:中美竞争现状

Interconnects AI 作者向美国国会议员及幕僚介绍开放权重模型在中美竞争中的现状。文章指出,自 2025 年 4 月起中国 AI 公司在开放权重模型领域明显领先,Hugging Face 下载量约为美国的两倍(32 亿对 16 亿),在 Artificial Analysis 智能指数上中国模型 GLM-5.3、Kimi K3 等得分 42-45

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b11070:Hexagon 后端 DMA 与 64 位映射重构

llama.cpp 发布 b11070 版本,主要针对 Hexagon 后端进行大规模重构,重写缓冲区和 DMA 处理以支持 64 位映射。改动涵盖二进制算子、softmax、GDN、矩阵乘法等内核的 DMA 化,并新增检查脚本与开发者文档。同时提供 macOS、iOS、Linux(含 CUDA、ROCm、Vulkan、SYCL 等)及 Android 多平

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11068:修复 macOS 27 SDK Metal 弃用警告

llama.cpp 发布 b11068 版本,主要修复了 macOS 27 SDK 下 Metal 后端的弃用警告(PR #29136)。该版本同时提供覆盖 macOS/iOS、Linux、Windows、Android 及 openEuler 的多平台预编译二进制,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:nvidia
Hugging Face Blog一手来源研究

OpenRouter 排行榜:425 个模型的价格、实测速度与韩语质量

该项目基于 OpenRouter 公开 API 构建了一个覆盖 425 个模型的排行榜,展示每百万 token 价格、服务商、精度、可用性、上下文长度、实测响应速度和韩语质量。作者对 330 个模型从敬语、韩国制度知识、格式遵循、术语等七个维度独立评分,发现约三分之一模型韩语评级为 F,且质量、性价比、速度领先者几乎从不重合。此外,作者用付费 API 对 3

正文顺带提及命中实体:nvidia
智东西商业

中国最大独立Token工厂硅基流动再融资,年内累计近29亿

AI基础设施企业硅基流动(SiliconFlow)宣布完成B+轮二期和C轮融资,投资方包括中国互联网投资基金、国新基金、中国移动链长基金等,2026年度累计融资金额近29亿元。融资将用于推理引擎、异构算力调度、模型与芯片适配等核心技术研发,强化Token供应平台能力并加快全球市场拓展。该公司成立于2023年,按2025年Token年吞吐量计是中国最大的独立生

9月20日周日 · 5 条
正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11063:修复 AST 非法 UTF-8 处理

llama.cpp 发布 b11063 版本,主要更新是在 common/peg 中处理 AST 里的非法 UTF-8 序列,并按照 Unicode 建议返回最大子部分(maximal subpart),同时移除了 strict 参数。该版本同步提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vu

正文顺带提及命中实体:nvidia
THE DECODER研究

Runway 研究实时 AI 视频生成:边描述边直播

Runway 公布其实时视频生成研究,用户可在描述过程中直接流式生成视频,而非输入提示词后等待。该方案基于其首个通用世界模型 GWM-1(构建于 Gen-4.5 之上),逐帧生成并接受镜头运动、机器人指令或音频作为控制。Runway 认为实时生成可缩短等待时间、降低 GPU 成本,并将计算负载从训练转向使用;同时指出视频模型逐帧累积误差是核心难题,其通过用自

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11060:修复 mamba 时间步投影连续性

llama.cpp 发布 b11060 版本,主要修复了 mamba 实现中时间步投影输入的内存连续性问题,并在归一化后跳过不必要的连续拷贝。该版本同时提供覆盖 macOS、Linux、Windows、Android 等多平台及 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端的预编译二进制包。

正文顺带提及命中实体:nvidia
TechCrunch AI政策

特朗普提议为AI改名并组建AI Force

特朗普在 Truth Social 上发起投票,提议为 AI 重新命名,候选名称包括 Superior Intelligence、Extreme Intelligence 和 Supreme Intelligence,并称 AI 安全担忧是民主党制造的骗局。他还表示将成立类似太空军的 AI Force,并很快任命 AI 事务负责人。此举呼应了近期 AI 安全

另有 2 家信源报道

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b11055:hexagon 后端新增 GEGLU QUICK 支持

llama.cpp 发布 b11055 版本,主要变更为在 hexagon 后端新增对 GEGLU QUICK 的支持(PR #29114)。该版本同时提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

9月19日周六 · 5 条
正文顺带提及命中实体:nvidia
The Verge AI政策

AI监管之争未休:CEO阵营分裂,特朗普政府立场摇摆

围绕AI监管的争论持续升温。Anthropic CEO Dario Amodei提出三步计划放缓AI发展,OpenAI CEO Sam Altman、Google DeepMind联合创始人Demis Hassabis及Elon Musk一度公开表示认同。但Meta CEO Mark Zuckerberg反对限制企业自主权,并与Musk、Nvidia CEO

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11052:json-schema 支持正则转义连字符

llama.cpp 发布 b11052 版本,主要变更是其 json-schema 功能现在接受正则表达式模式中的转义连字符(PR #29127)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11050:修复 Metal FA 支持检查

llama.cpp 发布 b11050 版本,主要修复了 Metal 后端 Flash Attention 支持检查的问题(#29122)。该版本同步提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp 发布 b11049:测试架构生成 dummy 词表

llama.cpp 发布 b11049 版本,主要变更为 test-llama-archs 生成 dummy test vocab(#29084),该改动由 pi:llama.cpp/DeepSeek-V4-Flash-Vision-Exp 协助完成。发布同时提供 macOS/iOS、Linux、Android、Windows、openEuler 等多平台预

正文顺带提及命中实体:cuda
llama.cpp Releases一手来源开源

llama.cpp b11046:OpenCL 新增 flash attn bin kernel 支持

llama.cpp 发布 b11046 版本,主要变更为在 OpenCL 后端新增对 bin kernel flash attn f32 f16 bin 的支持,并对 prefill 阶段的 flash attention 做了保护性处理。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译包,覆盖 CUDA、Vul