Quarkus LangChain4j 发布 1.13.3 版本
Quarkus LangChain4j 发布 1.13.3 版本,主要更新包括将底层 LangChain4j 升级至 1.19.3,并修复了 Chat Scopes - Websocket 模块名重复的问题。此外,该版本还包含大量由 Dependabot 自动提交的依赖升级,涉及 Quarkus 平台、Kotlin、Testcontainers、MCP Se
技术方向 · 开源模型、框架与仓库动态:权重开放、社区项目、开源与闭源的力量对比 · 共 700 条
只展示置信度达到公开门槛且每篇排名前三的主题标签,降低泛化误贴。
Quarkus LangChain4j 发布 1.13.3 版本,主要更新包括将底层 LangChain4j 升级至 1.19.3,并修复了 Chat Scopes - Websocket 模块名重复的问题。此外,该版本还包含大量由 Dependabot 自动提交的依赖升级,涉及 Quarkus 平台、Kotlin、Testcontainers、MCP Se
llama.cpp 发布 b10985 版本,修复了 RPC 后端的哈希缓存问题。此前 ggml backend rpc 会对所有超过 HASH THRESHOLD 的传输(包括调度器在节点间复制的激活值)进行哈希并写入 rpc-server 的磁盘缓存,导致 Qwen3.8-Flash-Next 双节点拆分下一天内缓存膨胀至 1.4 TB。补丁改为仅对标记
llama.cpp 发布 b10984 版本,主要更新为 CUDA 后端支持行连续的 SUM ROWS 操作,并整理代码、新增 GGML OP MEAN 以复用同一共享内核处理行连续张量,同时为 MEAN 的 permute/slice 添加测试。该版本同步提供 macOS、Linux、Windows、Android 等多平台预编译二进制包。
研究团队发布 ZGCM-1,一个完全开源的 7B 稠密基础模型,从零训练,结合内部推理与外部工具使用,支持 256K 上下文。该模型采用架构与系统协同设计(交错门控滑窗与全注意力、稳定的 FP8 Muon 优化器)、渐进式课程与 MDP 中期训练,并借助智能体集群自主管理集群运维、数据整理与评估。在数学推理和智能体搜索任务上,其表现可与 Qwen3-235B
另有 1 家信源报道
llama.cpp 发布 b10983 版本,主要变更是将 build arch graph() 的函数定义移动到 graph 和 graph 模板特化之后,以修复编译顺序问题。该版本同时提供 macOS、iOS、Linux、Android、Windows 等多平台预编译二进制包,覆盖 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等后端。
llama.cpp 发布 b10980 版本,主要变更是为 OpenCL 后端新增通用的 ssm scan 算子(PR #28881),并修复了空白字符问题。该版本同时提供覆盖 macOS/iOS、Linux、Android、Windows、openEuler 等多平台的预编译二进制包,支持 CUDA、Vulkan、ROCm、SYCL、OpenVINO 等多
无问芯穹联合清华大学、上海交通大学正式开源具身智能端侧推理引擎APXInf,支持RTX 4090、Jetson Orin、Jetson Thor等平台,覆盖模型开发到机器人本体部署的完整链路。APXInf将PI 0.5 FP8在Jetson Thor上的端到端推理延迟从278ms降至26ms以内,达到38.46Hz推理频率,并采用Rust极简运行时加Pyth
另有 1 家信源报道
LangChain4j 发布 1.19.3 和 1.19.3-beta29 版本。本次更新允许为 AgenticScope 序列化所用的 ObjectMapper 配置 ClassLoader,并包含针对 1.19 分支的 MCP 相关回移改动。
llama.cpp 发布 b10977 版本,主要变更是将 Windows x64 平台的 CUDA 构建版本升级到 13.4.1。该版本同时提供 macOS、Linux、Android、Windows 等多平台预编译包,覆盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。
NVIDIA 于 9 月 9 日公开了 Nemotron 3 Ultra 在 2026 年 IMO 上取得 30/42 分(超过 29 分金牌线)的完整数学推理系统,包括两个数学专家 checkpoint、SFT 与 RL 训练数据、推理代码、训练配方、提交证明及 200 道 Nemotron-IMO-Bench。该系统通过多 checkpoint 采样、p
Anthropic CEO Dario Amodei 呼吁行业与政府协调放缓前沿 AI 开发,并要求反垄断豁免以实施该计划,Sam Altman、Elon Musk 等人表示支持。Cohere CEO Aidan Gomez 批评该提议是设置进入壁垒、锁定市场的「卡特尔」,Hugging Face 工程师 Niels Rogge 称其为「最离奇的胡言乱语」。
费城儿童医院(CHOP)利用基于 MONAI 的开源 AI 工具,将儿童心脏建模从过去需数小时的人工操作缩短至数秒,用于先天性心脏病的术前规划。该服务已推广至美国 20 多家儿童医院,波士顿儿童医院每年约 500 例心脏手术借助建模完成。CHOP 还与 NVIDIA 合作,基于 Warp 和 Newton 物理引擎开发 GPU 加速的生物力学仿真,目标是将心
llama.cpp 发布 b10976 版本,主要修复了 Android 平台的 CI 发布流程(#28936)。该版本继续为 macOS、iOS、Linux、Windows、Android 和 openEuler 等多平台提供预编译二进制包,覆盖 CPU、CUDA、Vulkan、ROCm、OpenVINO、SYCL 等多种后端。
ByteShape 在 Hugging Face 发布 Qwen3.8-27B 的 GGUF 量化版本,使用其 ShapeLearn 方法为每个张量学习最优数据类型,以在极低位宽下保持质量。该版本取代此前的 ShapeLearn-Lite 量化,包含 5 个 GPU 优化模型(2.56–3.84 bpw,8.8–13.1 GB),并在数学、编程、指令遵循和智
英伟达开源了名为 SoL-Pi 的工作流优化 Harness,基于开源项目 Pi 改造,通过让 AI 自动审查并优化 Agent 工作流来降低 Token 消耗和 API 成本。团队让 AI 批量提出 152 个优化想法,经自动化沙盒筛选后仅保留 4 个核心机制,包括合并连续操作、压缩上下文历史、工具输出本地化存储、用小模型提炼日志等。在 535 个可验证环
原力灵机的通用具身基础模型 DM0.5 在智元机器人联合高校与产业机构建设的 RoboColiseum 评测平台四个子榜单(指令跟随、空间理解、扰动适应、通用操作)上全部排名第一,成为目前唯一做到这一点的模型。文章介绍了该平台针对仿真与真机一致性、评测基准生命周期短、单点能力不等于真实场景可用等痛点的设计,并分析了 DM0.5 在具身思维链、3D 空间表征、
北京中关村学院7名博士生用一个暑假从零训练出7B大模型ZGCM-1,并开源模型权重、训练代码、数据配方、中间checkpoint和日志。团队组建数百个Agent分头处理数据、跑实验、看日志和做评测,实践「AI4AI」研发范式,并对11类任务的Agent自主性做了L1-L5评级。ZGCM-1在多项通用评测中与Qwen3-8B等相近,部分数学推理和搜索任务可与更
OpenAI CEO Sam Altman、Anthropic CEO Dario Amodei、Google DeepMind 联合创始人 Demis Hassabis 和 SpaceX 的 Elon Musk 在周末大致同意放缓 AI 开发,提出嵌入第三方审计、监管国内实验室和达成全球放缓协议的三步方案。批评者认为这是阻止潜在竞争者、削弱开源运动和规避真
OpenAI 官方 Java SDK 发布 v4.63.2 版本,本次更新仅涉及构建系统,将 graalvm/setup-graalvm 依赖从 1.6.4 升级到 1.6.6,未包含功能或 API 变更。
Hugging Face 上发布了 cRia-LM-75M,一个 75.7M 参数的基座语言模型,采用 Relaxed Recursive Transformer(RRT)架构,用 11 层共享循环块执行两次遍历,第二次遍历使用 rank-172 LoRA 参数。训练分三阶段:Stage 1 在 10B token 上预训练 2K 上下文,Stage 2 用