Vercel AI SDK 发布 ai@5.0.264 修复多项问题
Vercel AI SDK 发布 ai@5.0.264 补丁版本,修复了 provider 序列化时保留不透明文件 URI 字符串、聊天传输请求中重复内容类型,以及较新 Node.js 版本下流式工具输入回调乱序触发的问题。同时更新了 @ai-sdk/provider、@ai-sdk/gateway 和 @ai-sdk/provider-utils 等依赖。
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Vercel AI SDK 发布 ai@5.0.264 补丁版本,修复了 provider 序列化时保留不透明文件 URI 字符串、聊天传输请求中重复内容类型,以及较新 Node.js 版本下流式工具输入回调乱序触发的问题。同时更新了 @ai-sdk/provider、@ai-sdk/gateway 和 @ai-sdk/provider-utils 等依赖。
llama.cpp 发布 b11121 版本,主要变更为 SYCL 后端新增对 get rows back 算子的支持,目前仅支持 fp32/fp16 精度,并同步更新了 ops.md 文档。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CUDA、Vulkan、ROC
Comfy-Org 在 Hugging Face 上发布了腾讯 Hunyuan3D 2.1 的重新打包版本,将原始模型文件整理为 ComfyUI 可直接使用的单文件格式(hunyuan 3d v2.1.safetensors)。该仓库基于 tencent/Hunyuan3D-2.1,采用腾讯混元社区许可,并提供了对应的 ComfyUI 工作流模板,方便用户在
Comfy-Org 在 Hugging Face 上发布了 FLUX.1-Krea-dev 的 ComfyUI 重打包版本,提供 fp8 量化后的单文件扩散模型 flux1-krea-dev fp8 scaled.safetensors。该模型基于 Black Forest Labs 官方发布的 FLUX.1-Krea-dev 微调模型,沿用其非商业许可,并
Comfy-Org 在 Hugging Face 上发布了 HiDream-I1 的 ComfyUI 重打包模型文件,将 HiDream-ai 的 HiDream-I1-Dev、HiDream-I1-Fast、HiDream-I1-Full 以及 HiDream-E1-1、HiDream-E1-Full 等原始模型转换为 ComfyUI 可直接使用的单文件格
Comfy-Org 在 Hugging Face 上发布了 Flux1-Redux-Dev,这是对 Black Forest Labs 的 FLUX.1-Redux-dev 模型文件进行重新打包的版本,专为 ComfyUI 使用。用户需将 flux1-redux-dev.safetensors 文件放入 ComfyUI 的 models/style mode
阿里巴巴宣布由前华为天才少年刘大一恒正式接任Qwen(千问)大模型项目负责人,此前该职位由林俊旸离职后由周靖人代管。刘大一恒是Qwen初期核心成员,曾负责预训练工作并主导Qwen1至Qwen3.5系列及Qwen-Math等模型开发。他在云栖大会发表「Qwen:迈向真实世界智能体」主题演讲,透露Qwen下一步将聚焦真实世界智能体方向。
Hugging Face 用户 pottokao 发布了 Qwen-Image-2.1 文本编码器(Heretic)的量化版本,提供 GGUF(Q4 K M)、FP8 和 bf16 三种格式,并附带 mmproj 文件以支持 Qwen3-VL 视觉塔。作者指出此前 GGUF 报错源于 ComfyUI-GGUF 未加载视觉塔,并提供了配套补丁节点 ComfyU
Comfy-Org 在 Hugging Face 上发布了 MiniMax-Music-3 的 ComfyUI 重打包模型文件,基于 MiniMaxAI/MiniMax-Music3 原始模型。该仓库提供 DiT、文本编码器和 VAE 等多精度权重文件(fp16、fp32、int8、bf16 等),并附带文本生成音乐的 ComfyUI 工作流模板,方便用户在
llama.cpp 发布 b11119 版本,主要变更是采样器(sampler)中 probe 体积的缩减(PR #29285)。该版本同时提供 macOS、iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
Comfy-Org 在 Hugging Face 上发布了 Wan 2.1 的 ComfyUI 重打包模型文件仓库,将 Wan-AI、alibaba-pai、MAGREF-Video、MeiGen-AI 等多个来源的 Wan 2.1 系列模型(含 T2V、I2V、FLF2V、VACE、Fun 等变体)整理为可直接放入 ComfyUI 目录的 safetens
LiteLLM 发布 v1.104.0-dev.1 开发版本,所有 Docker 镜像使用 cosign 签名,并提供了基于固定 commit hash 和 release tag 的两种验证方式。本次更新包含多项认证安全增强(泄露密码检测、自助改密、强制重置密码)、代理性能优化、OpenRouter 价格同步以及大量 UI 死代码清理。
PydanticAI 发布 v2.48.0 版本,新增对 OpenAI gpt-6-sol、gpt-6-luna 以及 Claude Opus 5.5 模型的支持,并升级 genai-prices 至 0.1.8 以支持新的 OpenAI 音频模型。此外修复了 Vercel AI 与 AG-UI 适配器中消息 ID 在加载和导出时丢失的问题。
Ollama 发布 v0.34.4 版本,修复了服务端间歇性出现的“model not found”错误,并针对思考模型优化了结构化输出的单次处理流程。此外,该版本更新了 llama.cpp 与 MLX 依赖,改进了 MLX 下 Gemma 4 图像分辨率动态选择及 Qwen 3.8 提示处理速度,同时调整了应用端对 ChatGPT/Codex 的检测方式。
llama.cpp 发布 b11118 版本,核心变更是引入 hex-dma 直接映射 DMA 缓存,用于更好地处理 HVX 上的 flash attention 掩码(FA mask)。该版本同时提供 macOS/iOS、Linux、Android、Windows 等多平台预编译包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO
作者 Phạm Nguyễn Ngọc Bảo 发布越南语 TTS 模型 VieNeu-TTS v3 Turbo,支持 48kHz 高保真语音、23 种预设音色、即时声音克隆、情感控制和英越双语切换。配套 vieneu Python SDK v3.7.1 提供免 PyTorch 的 CPU/ONNX 路径,并在 CUDA 上通过连续批处理实现单张 RTX 3
llama.cpp 发布 b11117 版本,主要变更是针对 HIP 后端优化 IQ2/IQ3 量化格式,使用 SWAR(寄存器内并行)技术以位操作实现 vsub4 和 vcmpne4 指令。该版本同时提供覆盖 macOS、Linux、Windows、Android 等多平台及 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端的预编译
llama.cpp 发布 b11114 版本,主要修复了 server 端路由驱逐(eviction)与现有队列之间的竞态问题。改动包括:所有模型加载都经过队列,使队列条目在等待者离开前保护模型不被 tick() 驱逐;同时不再将请求放入正在停止的模型,而是让其加入队列由下一个实例处理。该版本还提供了 macOS、Linux、Windows、Android
Geometric-AI 与 Lucebox 在 Hugging Face 发布了面向 128GB AMD Strix Halo 系统的 DeepSeek-V4-Flash-0731 量化 GGUF 文件,单个 98.29GB 文件在 92 题评测中取得 82/92 分,平均每权重约 2.766 比特。同时还发布了支持图像输入的 DeepSeek-V4-Fl
llama.cpp 发布 b11113 版本,主要变更是 server 不再将日志文件传递给子进程(#29212)。该版本同时提供 macOS/iOS、Linux、Android、Windows、openEuler 等多平台预编译二进制,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。