CrowdGPT 发布社区分布式模型 Crowd-v1
CrowdGPT 发布了其首个社区分布式语言模型架构 Crowd-v1,约 10 亿参数,采用 Transformer、GQA、RoPE、SwiGLU 和权重绑定设计。该模型以随机初始化权重发布,并非预训练模型,目的是为 CrowdGPT 客户端提供统一的模型定义和权重格式,供参与者共同进行分布式训练。发布包含 BF16/FP32 权重文件、配置和 SHA-
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
CrowdGPT 发布了其首个社区分布式语言模型架构 Crowd-v1,约 10 亿参数,采用 Transformer、GQA、RoPE、SwiGLU 和权重绑定设计。该模型以随机初始化权重发布,并非预训练模型,目的是为 CrowdGPT 客户端提供统一的模型定义和权重格式,供参与者共同进行分布式训练。发布包含 BF16/FP32 权重文件、配置和 SHA-
Hugging Face 上发布了 audio.cpp 项目维护的 GGUF 模型包仓库,将大量语音模型(涵盖 TTS、ASR、语音转换、音频生成、声源分离、说话人分离等任务)转换为 audio.cpp 原生 GGUF 格式并提供量化版本。仓库列出了各模型对应的 GGUF 精度(如 BF16、Q8、Q4、F16、F32)及原始许可证,并提示量化包虽经自动化指
llama.cpp 发布 b11205 版本,主要变更是 CUDA 后端支持 Nemotron 3 的 Puzzle state size 96,用于 SSM scan。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b11203 版本,主要变更为 CUDA 后端的 FWHT(快速沃尔什-哈达玛变换)内核新增 F16 输入支持。该改动将源数据类型改为模板参数,使内核可直接读取 F16 源而无需先转换为 F32 副本,原有 F32 路径保持不变。同时引入共享谓词 ggml cuda op mul mat use fwht,统一 supports o
llama.cpp 发布 b11202 版本,主要修复了 Windows 平台上 server 的 wake fd 警告问题,由 Adrien Gallouët 提交。该版本同时提供 macOS、Linux、Windows、Android 等多平台及多种后端(CUDA、Vulkan、ROCm、SYCL、OpenVINO 等)的预编译二进制包。
Hugging Face 上发布了 audio-cpp/Yue2-3B-GGUF 仓库,提供适配 audio.cpp 推理框架的 Yue2-3B 音乐生成模型 GGUF 权重,包含 BF16、Q8 0、Q4 0 三种量化版本及配套 VAE 权重。该仓库在 0.8.1 版本中加入 LoRA 支持,并附带多种条件生成(直接生成、完整规划、旋律条件、乐谱条件)的示
Hugging Face 用户 Alissonerdx 发布了名为 BFS(Best Face Swap)的 LoRA 模型集合,用于在 Qwen Image 2.1、Qwen Image Edit 2509/2511、Flux 2 Klein、Krea 2 及实验性 LTX-2 等基础模型上实现换脸、换头和换身体。该仓库提供多个版本的权重文件与配套 Com
开发者 Alissonerdx 在 Hugging Face 发布了面向 MiniMax H3 视频生成模型的实验性 LoRA 集合,并打包适配 ComfyUI。该集合包含锐度增强、风格迁移、VFX 编辑、换脸和动态壁纸等多个 LoRA,以及一个潜在空间放大器检查点,均基于 MiniMaxAI/MiniMax-H3 与 Comfy-Org 的 ref2va
llama.cpp 发布 b11201 版本,主要变更是回滚了此前合并的 PR #28849(统一 KV 缓存下自动适配最大上下文长度的改动),恢复原提交 b04d4e5 之前的行为。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN
Hugging Face 上出现一个名为 ComfyPod-Models 的镜像仓库,由 AiAngelGallery 发布,用于托管免费 AI Angel ComfyPod RunPod 模板所下载的模型文件,按 ComfyUI 的 models/ 目录结构组织。仓库声明所有文件与上游源逐字节一致(SHA-256 校验),目的是防止上游仓库移动或删除文件导
Robinson Labs 在内部审查后撤下了其发布的模型 RobinsonLabs/Qwen3.5-122B-A10B-abliterated-GGUF,并已从仓库中移除权重。该机构表示不建议继续依赖此前已下载的副本。
索辰科技与战略投资企业美梦空间在第五届全球数字贸易博览会上联合发布Physical-WAM物理-世界动作模型和RoboTwin-Phys物理漂移评测基准。Physical-WAM通过PhysLens、PhysDream、PhysAct三个模块插入物理Token表征,让机器人具备摩擦、重量、重心等物理感知与预判能力;RoboTwin-Phys新增13类物理扰动
llama.cpp 发布 b11199 版本,主要修复了 jinja 模板相关的编译错误(PR #29468)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
成立仅三个月的公司Simate(Silicon Mate)发布首版通用物理快系统Simate-beta,据公司披露以平均Score 33.95登顶RoboDojo榜单,且基础模型未针对该榜单专门优化。团队核心成员曾将一段式端到端智驾模型推进至对标Tesla FSD并量产落地。公司采用AI for Physical AI路线,搭建SiPAI、AutoResea
开发者JustVugg开源了纯C实现的分层推理框架Colibrì,通过将MoE模型的非活跃专家权重存放在NVMe SSD、按需加载,使744B参数的GLM-5.2可在最低16GB RAM的笔记本上无GPU运行。项目已支持9个模型家族,包括975B的Inkling和2.8T参数的Kimi K3,GitHub已获32k Star。其核心是LRU缓存、专家使用频率
Hugging Face 博客介绍如何将人形机器人接入 LeRobot 全栈开源机器人学习库,以 Unitree G1 为平台,采用 OpenHLM 方案:π0.5 策略根据语言、相机观测和机器人状态预测 SONIC 潜在运动 token,再由运行在 G1 上的快速全身控制器解码为 29 自由度动作。团队通过 VR 遥操作采集约 100 条、71 分钟的全身
Hugging Face 用户 handwoven8588 发布了 CodeRankEmbed-flash-attn,这是对 nomic-ai/CodeRankEmbed 的 bf16 量化版本,权重未重新训练。该仓库在自定义 modeling 文件中内置三层注意力调度(torch varlen、flash attn、eager),用 O(N) 非填充路径替
llama.cpp 发布 b11193 版本,主要变更是为 Hexagon 后端引入通过二进制检查工具查找软件除法调用的脚本,并修复了表格对齐问题。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。
Hugging Face 用户 bloomer010 发布了 inclusionAI/Ling-3.0-flash-VL 的 GGUF 量化版本,基于 llama.cpp 运行。该模型为 124B 总参数、每 token 仅激活 5.5B 的 MoE 多模态模型,支持图像和视频输入,原生 128K 上下文,可通过 YaRN 扩展至 256K。llama.cp
llama.cpp 发布 b11192 版本,主要变更是将内置的 cpp-httplib 依赖更新至 0.58.0(PR #29407)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,包含 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。