返回全部动态

SGLang v0.5.14 发布:新增多模型支持与 DeepSeek-V4 性能优化

原标题:v0.5.14

SGLang Releases一手来源产品发布质量 88

AI 摘要

SGLang v0.5.14 发布,新增对 GLM-5.2、LiquidAI LFM2.5、Kimi-K2.7-Code、DiffusionGemma 等模型的支持,并针对 DeepSeek-V4 在 NVIDIA GB300 上实现 5 倍吞吐提升。该版本还引入了 Waterfill 和 LPLB 两种 MoE 负载均衡方法,以及 KDA CuteDSL prefill 内核、线性注意力前缀缓存优化等多项性能改进。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

# Highlights New Model Support: [GLM-5.2](https://docs.sglang.io/cookbook/autoregressive/GLM/GLM-5.2), [LiquidAI LFM2.5](https://docs.sglang.io/cookbook/autoregressive/LiquidAI/LFM2.5), [Kimi-K2.7-Code](https://docs.sglang.io/cookbook/autoregressive/Moonshotai/Kimi-K2.7-Code), [Poolside Laguna-M.1](https://docs.sglang.io/cookbook/autoregressive/Poolside/Laguna-M.1), [DiffusionGemma](https://docs.sglang.io/cookbook/autoregressive/Google/DiffusionGemma), Zyphra ZAYA1, MiMo-V2-ASR **DeepSeek-


发布时间:2026-06-27 06:57
抓取时间:2026-08-02 00:31
来源机构:SGLang
阅读原文github.com