llama.cpp 发布 b11202:修复 Windows 下 wake fd 警告
llama.cpp 发布 b11202 版本,主要修复了 Windows 平台上 server 的 wake fd 警告问题,由 Adrien Gallouët 提交。该版本同时提供 macOS、Linux、Windows、Android 等多平台及多种后端(CUDA、Vulkan、ROCm、SYCL、OpenVINO 等)的预编译二进制包。
公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49
llama.cpp 发布 b11202 版本,主要修复了 Windows 平台上 server 的 wake fd 警告问题,由 Adrien Gallouët 提交。该版本同时提供 macOS、Linux、Windows、Android 等多平台及多种后端(CUDA、Vulkan、ROCm、SYCL、OpenVINO 等)的预编译二进制包。
llama.cpp 发布 b11201 版本,主要变更是回滚了此前合并的 PR #28849(统一 KV 缓存下自动适配最大上下文长度的改动),恢复原提交 b04d4e5 之前的行为。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN
llama.cpp 发布 b11199 版本,主要修复了 jinja 模板相关的编译错误(PR #29468)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b11193 版本,主要变更是为 Hexagon 后端引入通过二进制检查工具查找软件除法调用的脚本,并修复了表格对齐问题。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。
llama.cpp 发布 b11192 版本,主要变更是将内置的 cpp-httplib 依赖更新至 0.58.0(PR #29407)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,包含 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b11185 版本,主要变更是将共享的 Unicode 路径与字符串辅助函数提取到 common 模块(PR #29415),由 Adrien Gallouët 提交。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制,支持 CUDA、Vulkan、ROC
llama.cpp 发布 b11183 版本,主要变更是将 Metal 后端的 flash attention(fa)kernel 按数据类型拆分为独立库,并附带一处注释小修正。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端的预编译二进制包。
llama.cpp 发布 b11181 版本,主要变更是提高 HIP 版本要求以支持 fp8,避免在 HIP 6.2 中缺少 hip fp8 e4m3 支持的问题。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
TechCrunch 报道,由前 Google AlphaChip 负责人 Anna Goldie 和 Azalia Mirhoseini 创立的 Ricursive Intelligence 正在开发能自动设计芯片并从设计中学习的 AI 系统,目标是将芯片设计周期从两三年缩短到数周。两人此前在 Google 共同领导 AlphaChip,其成果曾用于多代
llama.cpp 发布 b11180 版本,主要修复了 RPC 后端中 get alloc size 缓存键未包含 nb 参数的问题,并将计算结果下限设为 ggml nbytes。该改动由 Georgi Gerganov 等人提交,旨在提升 RPC 内存分配计算的正确性。同时发布了覆盖 macOS、Linux、Windows、Android 等多平台及 C
美国具身智能公司 Skild AI 发布人形机器人 Messinator,其大脑基于旗舰机器人基础模型 S1,并在 NVIDIA Isaac Sim 虚拟足球场中通过强化学习与自我对弈训练约 140 年。训练中仅设定进球奖励,机器人自行学会盘带、护球、抢断和倒地起身等动作,并迁移到真实人形机器人上。该成果延续了 Skild AI 跨硬件基础模型 Skild
llama.cpp 发布 b11178 版本,集中修复 MUSA 后端(摩尔线程 MTT S5000 / PH1)的多个问题。改动包括:让 MUSA 使用 16 字节拷贝、启用 CUB 路径、采用上游代码路径、移除多余编译期守卫、在 PH1 上禁用 MMQ 路径,并修复 fused TOPK MOE 内核在 MUSA 上的死锁。修复后 27B 模型困惑度从
雷峰网AI科技评论梳理了梁文锋过去三年署名的11篇论文,涵盖DeepSeek LLM、DeepSeekMoE、DeepSeek-V2、DeepSeek-Coder-V2、DeepSeek-V3、DeepSeek-R1、NSA、mHC、DSpark及最新DSec等。文章称这些论文分别从数据配比、MoE架构、MLA注意力、代码能力、低成本训练、纯强化学习推理、硬
llama.cpp 发布 b11175 版本,主要变更为在 Hexagon 后端新增 q5 k 量化类型支持(PR #29123)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。此次更新提升了高
llama.cpp 发布 b11174 版本,主要变更是为 Hexagon 后端在连续 dim1 的 CONCAT 操作中引入 DMA,并针对 DMA64 更新了 CONCAT DMA 实现。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROC
llama.cpp 发布 b11173 版本,主要修复 Metal 后端的图捕获(graph capture)逻辑:当图没有节点时提前返回,移除 capture compute 的冗余重置,在捕获错误信息中提示 METAL CAPTURE ENABLED=1,并向 ggml metal op init 传入 capture compute == 0 以仅在捕
llama.cpp 发布 b11167 版本,主要变更为 Hexagon 后端新增对 I32 类型 CPY 和 CONT 操作的支持(PR #29379)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN
llama.cpp 发布 b11165 版本,主要变更是测试相关的 flush status(#28352)。该版本为 macOS/iOS、Linux、Android、Windows、openEuler 等多平台提供预编译二进制包,覆盖 CPU、CUDA 12/13、Vulkan、ROCm、OpenVINO、SYCL、Snapdragon 等多种后端。
llama.cpp 发布 b11163 版本,核心变更是新增 llama batch ext API(PR #24669),支持在同一个 batch 中同时处理 token、embedding 和 state,并引入 llama embd、llama batch ext add embd、llama batch ext set embd state 等接口,
TechCrunch 宣布将于 2026 年 11 月 4 日在波士顿 SoWa Power Station 举办全天制 Founder Summit,面向各阶段创始人,聚焦融资、AI 原生创业与领导力。活动前身为 Early Stage 和 All Stage,议程包含多场演讲与分组讨论,并设有 11 月 1-7 日的周边活动周。门票分投资者 399 美元