TomoroAI 发布多模态嵌入模型 tomoro-colqwen3-embed-4b
原标题:TomoroAI/tomoro-colqwen3-embed-4b
AI 摘要
TomoroAI 发布了 tomoro-colqwen3-embed-4b,这是一个基于 Qwen3-VL-4B-Instruct 和 Qwen3-Embedding-4B 融合的多模态嵌入模型,采用 ColPali 风格的多向量表示,支持文本、图像和视频检索。该模型在 ViDoRe 基准上达到或接近最先进性能,并将嵌入存储占用降低至约 0.82 TB/百万图像,比基线小 13 倍。模型权重以 Apache-2.0 许可证开源。
正文节选
--- license: apache-2.0 license_name: apache-2.0 license_link: https://www.apache.org/licenses/LICENSE-2.0 tags: - sentence-transformers - multi-vector - text - image - video - multimodal-embedding - vidore - colpali - colqwen3 - multilingual-embedding language: - multilingual library_name: transformers pipeline_tag: visual-document-retrieval base_model: - Qwen/Qwen3-VL-4B-Instruct --- # TomoroAI/tomoro-colqwen3-embed-4b ## ⚡ Executive Summary **TomoroAI/tomoro-colqwen3-embed-4b** is a state-