Liquid AI 发布 LFM2.5-VL-3B 多模态模型,面向端侧部署
原标题:LiquidAI/LFM2.5-VL-3B
AI 摘要
Liquid AI 发布了 LFM2.5-VL-3B 多模态模型,基于 LFM2.5-2.6B 语言模型和 SigLIP2 NaFlex 视觉编码器,支持文本和图像处理,具备改进的接地、OCR 和高效推理能力。该模型专为端侧部署设计,在 Apple M5 Max 上达到 228 tok/s,在 AMD Ryzen AI Max+ 395 上达到 116 tok/s,内存占用低于 3.3GB。模型提供多种量化格式(GGUF、ONNX、MLX),支持多语言,适用于实时目标检测、文档 OCR 和端侧翻译等场景。
正文节选
--- library_name: transformers license: other license_name: lfm1.0 license_link: LICENSE language: - ar - zh - en - fr - de - hi - id - it - ja - ko - pl - pt - ru - es - th - vi pipeline_tag: image-text-to-text base_model: LiquidAI/LFM2.5-2.6B-Base tags: - liquid - lfm2.5 - edge --- <div align="center"> <img src="https://cdn-uploads.huggingface.co/production/uploads/61b8e2ba285851687028d395/2b08LKpev0DNEk6DlnWkY.png" alt="Liquid AI" style="width: 100%; max-width: 100%; height: au