Langfuse 发布 v4.45.3:依赖升级与多项修复
Langfuse 发布 v4.45.3 版本,主要包含依赖升级与多项修复:将 image-size 升级至 2.0.4,修复 API key 查找失败时记录公钥、拒绝以 /systemone 结尾或带查询字符串的 TypeSafe base URL、切换上游时保留自定义 TypeSafe base URL,以及评估模块中决策模型选择与去重问题。此外新增一位首
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Langfuse 发布 v4.45.3 版本,主要包含依赖升级与多项修复:将 image-size 升级至 2.0.4,修复 API key 查找失败时记录公钥、拒绝以 /systemone 结尾或带查询字符串的 TypeSafe base URL、切换上游时保留自定义 TypeSafe base URL,以及评估模块中决策模型选择与去重问题。此外新增一位首
n8n 发布 2.40.7 版本,主要修复了核心模块的一个问题:将项目级 span 属性传播到节点级 span。该修复涉及 PR #39457,属于可观测性/追踪相关的缺陷修正,不涉及新功能。
n8n 发布 1.123.82 版本,仅包含一项修复:将 adm-zip 依赖升级至 0.6.1。该更新属于常规依赖维护,未涉及新功能或行为变更。
LiteLLM 发布 v1.100.3 版本,该版本将 #39631、#39729、#40639 三个改动回合到 stable/1.100.x 分支。发布说明强调所有 Docker 镜像均使用 cosign 签名,并提供了通过固定 commit hash 或 release tag 验证镜像签名的命令。
LiteLLM 发布 v1.99.4 版本,该版本将 #39631、#39729、#40639 三个改动回合到 stable/1.99.x 分支。发布说明强调所有 LiteLLM Docker 镜像均使用 cosign 签名,并提供了通过固定 commit hash 或 release tag 验证镜像签名的命令。
LiteLLM 发布 v1.98.1 版本,所有 Docker 镜像均使用 cosign 签名,用户可通过固定 commit hash 或 release tag 验证镜像签名。本次更新主要将 Bedrock 的 GPT-6 推理门控修复、Python 3.13 镜像固定等改动回移至 stable/1.98.x 分支。
AgentionAI 在 Hugging Face 发布 Qwen3.8-27B 的 Agention Precision GGUF 量化包,基于 Qwen/Qwen3.8-27B 量化,采用非均匀分配与低损失纠错编码,兼容标准 llama.cpp 无需分支或额外参数,并包含视觉投影器和 MTP 草稿头。作者称在相同文件大小、速度和显存下,各档位量化相比 U
Viggle 在 Hugging Face 上发布了 Qwen-Image-2.1-viggle-turbo v0.2.1,这是基于 Qwen/Qwen-Image-2.1 的少步蒸馏 LoRA 适配器,采用分布匹配蒸馏(DMD)训练。它支持文生图和指令驱动编辑,仅需 6 次 transformer 前向(而非基座的 40 步)且无需无分类器引导,端到端约快
PydanticAI 发布 v2.50.0,引入 DecisionModel 基类以支持 Decisions 协议的路由决策,并调整了 ModelSelectionContext 的消息与提示结构。该版本新增 Gemini 3.8 Live 实时模型支持、OpenAI service tier 暴露及 RunContext.in durable contex
作者在 Hugging Face 发布了一个基于 MiniMax H3 的武打动作风格 LoRA(wushu action),使用 924 段精选武打片段、以全量 int8-convrot DiT 加 bf16 Qwen3-VL 文本编码器训练 1000 步,主打 ComfyUI 即插即用。作者表示该版本表现仍未达预期,计划继续整理素材并训练包含更多运动动作
DSPy 发布 3.4.0 版本,通过 TypeSafe 客户端引入 Jev 集成,新增 Noul、Choice、Score 三种实验性决策类型,将概率证据带入普通 DSPy 签名。同时引入 ReAnchor 优化器,可依据程序指标校准布尔阈值、Score 切分和 Choice 权重。该版本还带来原生 LM 引擎、本地 CPython 解释器、异步 ReAc
llama.cpp 发布 b11175 版本,主要变更为在 Hexagon 后端新增 q5 k 量化类型支持(PR #29123)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。此次更新提升了高
研究者提出 WROP(World Reasoning with Object Permanence)数据基础设施,包含 150 个受认知科学启发的手工设计任务,分为六个认知类别,并通过 Blender 生成器随机化速度、光照、相机角度等参数,每个任务可生成 1 万以上样本。团队发布了 150 万样本训练语料和 300 题评测集,在评测中评估了 14 个视频模
llama.cpp 发布 b11174 版本,主要变更是为 Hexagon 后端在连续 dim1 的 CONCAT 操作中引入 DMA,并针对 DMA64 更新了 CONCAT DMA 实现。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROC
llama.cpp 发布 b11173 版本,主要修复 Metal 后端的图捕获(graph capture)逻辑:当图没有节点时提前返回,移除 capture compute 的冗余重置,在捕获错误信息中提示 METAL CAPTURE ENABLED=1,并向 ggml metal op init 传入 capture compute == 0 以仅在捕
llama.cpp 发布 b11171 版本,主要同步了 ggml 子模块更新,将 ggml 版本提升至 0.25.3,并修复了 ggml graph nbytes 中的 ubsan 错误。该版本同时提供覆盖 macOS、Linux、Windows、Android 等平台的预编译二进制文件,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO
llama.cpp 发布 b11169 版本,主要修复了 llama-grammar 中 token id 解析时的数值截断问题(#29382)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b11168 版本,主要针对 Hexagon NPU 后端进行动态量化器改进。改动包括修复 Q8 0 N=1 MUL MAT 的精度问题、解决寄存器溢出、在所有动态量化路径中改用 DMA,并清理了过时的 run quant task 与相关非 DMA 激活逻辑。该更新由高通与 Hugging Face 的贡献者共同完成,旨在提升骁龙
llama.cpp 发布 b11167 版本,主要变更为 Hexagon 后端新增对 I32 类型 CPY 和 CONT 操作的支持(PR #29379)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVIN
llama.cpp 发布 b11166 版本,主要变更是为 CUDA 后端新增 CONV 2D DW 算子的 F16 内核支持(PR #29064)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,包含 CUDA 12/13、Vulkan、ROCm、SYCL、OpenVINO