llama.cpp b11112:server 支持 function call output 传入图像
llama.cpp 发布 b11112 版本,主要更新是 server 端在 function call output 中支持 input image,即函数调用输出可以携带图像输入。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。这一
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 699 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
llama.cpp 发布 b11112 版本,主要更新是 server 端在 function call output 中支持 input image,即函数调用输出可以携带图像输入。该版本同时提供 macOS、Linux、Windows、Android 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。这一
Strands Agents SDK 发布 Python 版 v1.57.0,主要新增默认使用 Opus 5 与高思考模式、合并 Strands Harness、BedrockModel 支持 requestTimeout、新增 mcp router 工具与 handoff to user 工具、Graph 和 Swarm 支持快照会话管理,并上线重新设计的
Strands Agents SDK 发布 TypeScript 版本 v1.19.0,主要新增默认使用 Opus 5 与高思考模式、合并 Strands Harness、BedrockModel 支持 requestTimeout、Python 侧新增 mcp router 工具、Graph 与 Swarm 支持快照会话管理,并将 handoff to u
Meta 的 AI 产品 Muse 被早期用户质疑其实是开源项目 OpenClaw 的换皮版本。Meta 超级智能实验室产品负责人 Nat Friedman 在 X 上回应称,Muse 确实在产品层面「深受 OpenClaw 启发」,但是「从零构建」的。他承认团队爱上了 OpenClaw,目标是做出可扩展至数十亿人、安全易用的类似产品。Muse 已登上美国
另有 1 家信源报道
开发者 abenzerps 在 Hugging Face 发布了 Qwen/Qwen-Image-2.1 的 GGUF 量化版本,提供 Q8 0 至 Q4 0 多种量化文件,并配套打包了 Qwen3VL-8B 文本编码器和 VAE,方便在 ComfyUI 中本地运行文生图。该版本不含内置安全过滤器,作者还表示正在开发完全无审查版本。
llama.cpp 发布 b11111 版本,主要更新为在 Vulkan 后端新增 Intel Xe 闪存注意力(flash attention)优化内核,覆盖 Xe-LPG Plus、Xe2、Xe3 架构,并针对 split k 路径做优化。同时更新主机端代码以支持 Intel split k FA 内核路径选择,修复 A770 Linux 上的算子测试失
llama.cpp 发布 b11110 版本,主要变更为 mtmd 模块新增多项 sanity checks(#29276)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制,涵盖 CPU、CUDA 12/13、Vulkan、ROCm、SYCL、OpenVINO、OpenCL 等
小米大模型团队发布并开源新一代原生全模态模型Xiaomi MiMo-V2.6系列,包含MiMo-V2.6-Pro与MiMo-V2.6-Flash,并预告将开放速度提升20倍的MiMo-V2.6-Pro-UltraSpeed。该系列押注大规模强化学习扩展,进行了开源模型迄今最大规模的单次RL训练,并同步开源RL训练环境、框架及技术报告。MiMo-V2.6-Pr
llama.cpp 发布 b11109 版本,主要修复了 Metal 后端中 mul mm id 的 src1 重缩放逻辑,将其置于 ggml prec 门控之下。同时,ggml-webgpu、CUDA 和 Vulkan 后端在 src1 精度为 F32 时拒绝 MUL MAT ID,并修正了 supports op 的返回值。该版本还提供了覆盖 macOS
NVIDIA 发布开源工具包 Topograph,用于发现集群网络拓扑并将其标准化为 Kubernetes 节点标签、Slurm 配置、Slinky ConfigMap 等调度器可识别的格式。它通过 API Server、Node Observer、Node Data Broker、Provider 和 Engine 五个组件保持拓扑视图实时更新,并与 DR
llama.cpp 发布 b11108 版本,主要变更是 ggml 中 IQ1 M 量化格式的构建前缀和(prefix sums)改为每块只计算一次,以优化性能。该版本同时提供覆盖 macOS、iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO
llama.cpp 发布 b11104 版本,主要更新为 llama-server 新增绑定多个地址的能力(PR #28690),并处理了地址重叠、多 TCP 地址下拒绝 --port 0 等边界情况。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制,涵盖 CPU、CUDA、Vu
llama.cpp 发布 b11103 版本,为 HunyuanOCR 目标模型增加 DFlash 投机解码支持,在 Hunyuan 图构建中注册层输入张量,修复了此前因张量为空导致的断言中止问题。同时修复了针对 HunYuan 目标转换 DFlash 草稿模型时的词表处理错误,包括缺失的 fix special tokens 方法和配置读取错误。测试显示图
Hello Robot CEO 兼联合创始人 Aaron Edsinger 将在 TechCrunch Disrupt 2026 的 Real World AI Stage 上现场演示其家用辅助机器人 Stretch 4。Stretch 4 于今年 5 月发布,首批量产已售罄,采用轮式底盘加单伸缩臂设计,面向严重行动障碍用户,可帮助他们自主进食、关百叶窗、挠
Google 开源了 AX,一个基于 Apache 2.0 许可的编排器和声明式运行时,用于执行和扩展自主 AI 智能体工作负载,托管于 agentexecutor.io 和 GitHub 的 google/ax。AX 运行在 Agent Substrate 之上,将智能体视为有状态 actor,提供亚秒级任务挂起与恢复,并定义 Task、Workspace
MinerU 发布 4.0.6 版本,WebUI 新增 EPUB 在线预览功能,支持章节导航与元数据展示。同时修复了 PDF 文本块因缺少行信息在归一化时被整块丢弃的回归问题,并解决了中文段落含行内公式时导出 PDF 崩溃的问题。此外将 docvortex 最低依赖版本提升至 0.4.22。
Interconnects AI 播客主持人 Nathan Lambert 与 Epoch AI 洞察团队负责人 Jean-Stanislas Denain 对谈,讨论递归自我改进(RSI)、中美模型差距、蒸馏是否解释差距、开源与闭源模型安全性等议题。双方均表示对 AI 发展轨迹存在很大不确定性,Denain 认为 OpenAI 和 Anthropic 公开
llama.cpp 发布 b11101 版本,主要变更是允许对 llama 进行重复的 find package 调用(#29228)。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows 及 openEuler 的多平台预编译二进制包,涵盖 CPU、CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多种后端。
小米将MiMo-V2.6-Pro和Flash的大模型强化学习训练全程直播,6天花费约350万美元(约2344万元人民币),Pro以1.02万亿参数、420亿激活在Artificial Analysis Intelligence Index上获46分,位列开源第一。小米同时开源模型权重、技术报告、7000多个RL任务环境和端到端RL训练框架,并披露了异步RL架
小米发布MiMo-V2.6系列开源模型,旗舰版MiMo-V2.6-Pro在Artificial Analysis智能指数上得分46,成为当前最强开源模型,且每百万输入/输出token价格仅为0.435/0.87美元,单任务成本约0.13美元。性能提升主要来自大规模扩展的强化学习,训练不到六天,Pro成本约262万美元。小米同时开源了RL工具包、训练框架及约7