Richard Socher 谈 Recursive:用 AI 自动化 AI 研究
Richard Socher 在 Latent Space 播客中介绍其新公司 Recursive,该公司已筹集 46.5 亿美元种子轮,目标是构建可自动化 AI 研究本身的「Eureka Machine」。他声称 Recursive 的 AI 研究系统在不到两天内于优化任务上超越人类及其智能体,并在 NVIDIA GPU 内核优化中无需 CUDA 专家团队
公司与模型 · 英伟达的 AI 芯片与生态动态:GPU 新品、CUDA 生态、机器人平台与 AI 算力供给
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-27 05:49
Richard Socher 在 Latent Space 播客中介绍其新公司 Recursive,该公司已筹集 46.5 亿美元种子轮,目标是构建可自动化 AI 研究本身的「Eureka Machine」。他声称 Recursive 的 AI 研究系统在不到两天内于优化任务上超越人类及其智能体,并在 NVIDIA GPU 内核优化中无需 CUDA 专家团队
llama.cpp 发布 b10964 版本,将版本号提升至 0.4.1(PR #28900)。该版本为 macOS、iOS、Linux、Android、Windows 及 openEuler 等多个平台提供预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b10952 版本,主要修复了 SYCL 后端中 oneDNN scratchpad 破坏内存池释放顺序的问题(PR #28704)。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b10951 版本,其中一项改动是将 llama n rs seq 检查移到 llama decode 调用之前,若检查为真则直接返回,从而在不需要时避免调用 llama decode。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SY
handy-computer 在 Hugging Face 发布了 nvidia/nemotron-3.5-asr-streaming-0.6b 的 GGUF 量化版本,供 transcribe.cpp 使用。该模型是 0.6B 参数的 cache-aware 流式 FastConformer 编码器加 RNN-T 解码器,支持 32 种语言区域的多语言语音
llama.cpp 发布 b10948 版本,主要变更是将 HY V4 从 WebGPU 的 test-llama-archs 测试中排除(PR #28855,由 Stanisław Szymczyk 共同提交)。该版本同时提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CUDA、V
llama.cpp 发布 b10946 版本,主要变更是为 ggml-cpu 的 s390x 架构添加对 VXE 专用 repack 辅助函数的保护(PR #28775)。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、Ope
llama.cpp 发布 b10937 版本,主要变更是将 OpenCL 后端的 noshuffle 行对齐规则从仅适用于 q6 K 扩展到 q4 K、q5 K 和 q8 0 量化类型(PR #28575)。该版本同时提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、
llama.cpp 发布 b10935 版本,主要变更是为 common 模块新增 LOG JSON 宏,用于记录结构化数据,并在 fit 中加入了演示用法。该版本同时提供了覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO
llama.cpp 发布 b10933 版本,主要变更是 jinja 模板支持点属性整数常量(PR #28817)。该版本同时提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b10932 版本,主要修复了 CMake 构建中 clang 预编译头(PCH)因时间戳不一致导致构建失败的问题,该选项覆盖 ccache 视为 MSVC 但底层为 clang 的编译器,包括 clang-cl 和 Intel LLVM 驱动。同时该版本提供了覆盖 macOS/iOS、Linux、Android、Windows 及
llama.cpp 发布 b10931 版本,主要变更是为 UI 添加缓存功能(PR #28802),由 Adrien Gallouët 提交。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b10930 版本,主要修复了 server 在模型数量达到上限时仍允许下载模型的问题(对应 issue #26809,PR #28530)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b10929 版本,主要变更是为 ggml-cuda 后端添加针对 AMD GCN 架构的 HIP 专用配置表(PR #27841)。该版本同时提供覆盖 macOS、Linux、Windows、Android 等平台的预编译二进制包,包含 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。此次更新提升了 AM
llama.cpp 发布 b10927 版本,主要变更是将内置的 cpp-httplib 依赖更新至 0.56.0(PR #28787)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
llama.cpp 发布 b10926 版本,主要变更是由贡献者 syscl 提交的补丁,使程序能够优雅地处理不支持的 tq1 0 量化格式(PR #28681)。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVIN
llama.cpp 发布 b10923 版本,主要修复了 OpenCL 后端导致程序中止的若干 bug(PR #27630)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、Vulkan、ROCm、OpenVINO、SYCL、CUDA 等多种后端。
llama.cpp 发布 b10922 版本,主要变更是为 OpenCL 后端新增了一个 A8 Q4 K 非 MoE 二值化 GEMM 内核 kernel gemm noshuffle q4 k f32 32b trans ila a8 bin,并修复了布局兼容性、重命名了二值内核选择辅助函数。该提交由高通工程师 Li He 参与贡献,同时发布了覆盖 mac
llama.cpp 发布 b10921 版本,主要修复 WebGPU 后端张量绑定对齐问题:将绑定偏移回退到与张量距离为整数个块的位置,使块量化视图在着色器中获得有效的元素偏移。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包。
llama.cpp 发布 b10917 版本,修复了此前在 MSVC 下为 llama-server 启用预编译头(PCH)时引入的构建问题,该修复跳过 MSVC 场景下的 PCH。此次发布同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后