Vercel AI SDK 发布 ai@6.0.287 补丁更新
Vercel AI SDK 发布 ai@6.0.287 补丁版本,修复了在转换失败的工具调用时未保留 provider 元数据的问题,并同步更新了 @ai-sdk/gateway 与 @ai-sdk/provider-utils 等依赖。该更新主要提升工具调用场景下的元数据一致性与稳定性。
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Vercel AI SDK 发布 ai@6.0.287 补丁版本,修复了在转换失败的工具调用时未保留 provider 元数据的问题,并同步更新了 @ai-sdk/gateway 与 @ai-sdk/provider-utils 等依赖。该更新主要提升工具调用场景下的元数据一致性与稳定性。
Open WebUI 发布 v0.11.4 版本,主要围绕镜像体积优化与终端/技能能力增强。slim 镜像降至约 175 MB(较上一版缩小约 89%),标准镜像也减少约 170 MB,移除了本地模型、冗余 Python、字体和未使用依赖。新版本还支持终端服务器技能、AGENTS.md 指令文件、自动技能发现、模型背景图、从聊天创建技能、终端命令标签页、文件
Strands Agents SDK 发布 harness-python v0.1.0,该版本由 harness-python/v0.0.0 至 v0.1.0 之间的提交自动生成。主要变更包括上线重新设计的 Strands 网站、修复文档中的失效链接,以及为 strands-harness(harness-py)添加 PyPI 发布流水线和合并后的 harn
Vercel AI SDK 发布 ai@7.0.108 补丁版本,修复了多项与工具调用相关的缺陷,包括阻止受 tool callers 管控的工具被直接执行、在生成被取消时停止待处理的工具调用修复、保留适配 v3 语言模型时的文件数据,以及防止 streamText 执行违反 tool choice 的工具调用。同时更新了 @ai-sdk/gateway 等
llama.cpp 发布 b11080 版本,主要更新是让 tests/test-backend-ops 的 -o 过滤器支持正则表达式条目,普通算子名仍保持精确匹配(如 -o ADD 不会匹配 ADD EX)。同时修复了不必要的 FA vec slice 日志输出,并重排了帮助文本格式。该版本同步提供 macOS、Linux、Windows、Android
llama.cpp 发布 b11078 版本,新增通过 LLAMA ARG 环境变量配置 temperature、top-p、min-p 及各类惩罚参数的能力,使 llama-server 可完全通过环境文件(如 Debian 上的 systemd)控制。同时使用 llama-gen-docs 重新生成 readme 文件,并提供了覆盖 macOS、Linu
llama.cpp 发布 b11076 版本,主要变更为移除测试中的过时注释(#29140)。该版本同步提供 macOS/iOS、Linux、Android、Windows 及 openEuler 等多平台预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b11075 版本,主要改动是简化 ggml-metal 后端中融合算子(fusion pattern)操作列表的声明方式,从 ops all 派生非空融合算子并去掉模式向量中的 all 后缀。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROC
Hugging Face 上发布了一个名为 DogContext/GLM-5.3-Flash-Uncensored-Q2-ds4 的模型,它是 GLM-5.3-Flash 的去审查(abliterated)版本,经 imatrix 校准量化为约 2-bit GGUF,可在单台 128GB Apple Silicon Mac 上常驻运行。该模型保留原生 MTP
LlamaIndex 发布 v0.14.25 版本,核心包 llama-index-core 更新至 0.14.25,移除了已弃用的 ipex-llm 和 optimum-intel IPEX 集成,修复了元数据替换、流式工具调用、函数工具重试等问题,并为 StructuredLLMRerank 增加原生异步支持。同时,大量 agent、callbacks、
llama.cpp 发布 b11074 版本,主要修复了 JSON 枚举(enum)处理问题,为枚举值添加了 common json value 处理逻辑,并曾添加 tests/test-json.cpp 测试但按要求移除。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台多后端(CUDA、Vulkan、ROCm、SYC
LangChain 发布 langchain-core 1.6.4 版本,包含对 chat message history 的弃用处理,以及 anyio 和 soupsieve 两个依赖项的版本升级。该版本为常规维护更新,主要影响使用 langchain-core 的开发者。
微软研究院在《Nature》发表逆合成预测模型 RetroChimera,它结合基于 Transformer 的 R-SMILES 2 与基于图神经网络的 NeuralLoc 两个互补模型,通过学习式集成策略对二者预测排序。盲测中化学家更偏好 RetroChimera 给出的反应预测,优于子模型、既有方法甚至文献记录的反应。该模型已在 GitHub 以 MI
llama.cpp 发布 b11073 版本,主要变更是 SYCL 后端对 MKL-FA softmax 加载进行合并(coalesce),替代原先每行一个 work-item 的实现方式,并改进了变量命名可读性。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译包,覆盖 CUDA、Vulkan、ROCm、SYCL、Ope
NVIDIA 发布博客文章,主张 AI 安全是一个工程问题,需要明确的安全需求、可执行的管控、指定负责人和可验证的证据。文章提出安全应覆盖 agent 技术栈的每一层,包括模型、编排框架和运行时环境,并介绍了 NVIDIA OpenShell 开源安全运行时及 Open Secure AI Alliance 合作伙伴(Cisco、JFrog、CrowdStr
LangGraph 发布 1.2.12 版本,主要新增 interrupt() 的 response schema 参数,并修复 v3 流式投影类型未声明、改为从字节码而非源码检测子图等问题,同时升级 soupsieve、mistune、tornado 等依赖。该版本属于常规迭代,对使用 LangGraph 构建 agent 工作流的开发者有直接影响。
LangGraph 发布 langgraph-sdk 0.4.5 版本,同时发布 langgraph 1.2.12。本次更新包含为 interrupt() 新增 response schema 功能,以及多项依赖升级(anyio、websockets 等)。
Langfuse 发布 v4.40.0 版本,新增将 transcript spans 关联到源 trace 的 trace-batching 功能,并修复了删除 API key 记录后缓存未清除的认证问题。此外还包含若干 Web 页面重构、文档修正和 AGENTS.md 使用方式调整等杂项改动,并迎来一位新贡献者。
llama.cpp 发布 b11071 版本,主要变更是将 Ubuntu CUDA 发布构建的 CUDA 版本升级到 13.4(PR #29202)。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,涵盖 CPU、Vulkan、CUDA 12/13、ROCm、OpenVINO、SYCL 等后端。
Interconnects AI 作者向美国国会议员及幕僚介绍开放权重模型在中美竞争中的现状。文章指出,自 2025 年 4 月起中国 AI 公司在开放权重模型领域明显领先,Hugging Face 下载量约为美国的两倍(32 亿对 16 亿),在 Artificial Analysis 智能指数上中国模型 GLM-5.3、Kimi K3 等得分 42-45