返回全部动态

OpenBMB发布VoxCPM1.5:高质量零样本语音克隆TTS模型

原标题:openbmb/VoxCPM1.5

Hugging Face New and Trending Models一手来源模型发布质量 81

AI 摘要

OpenBMB发布了VoxCPM1.5,这是一个基于MiniCPM4-0.5B的无分词器文本转语音(TTS)模型,支持上下文感知语音生成和零样本语音克隆。VoxCPM1.5将音频采样率提升至44.1kHz,并将LM token率降至6.25Hz,提高了音频质量和效率,同时支持SFT和LoRA微调。该模型在RTX 4090上可实现低至0.17的实时因子(RTF),支持流式合成。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- license: apache-2.0 language: - en - zh base_model: - openbmb/MiniCPM4-0.5B pipeline_tag: text-to-speech library_name: voxcpm tags: - text-to-speech - speech - speech generation - voice cloning --- ## 🎙️ VoxCPM: Tokenizer-Free TTS for Context-Aware Speech Generation and True-to-Life Voice Cloning [![Project Page](https://img.shields.io/badge/Project%20Page-GitHub-blue)](https://github.com/OpenBMB/VoxCPM/) [![MiniCPM Wiki](https://img.shields.io/badge/Docs-ReadTheDocs-8CA1AF)](https://mode


发布时间:2026-08-18 11:06
抓取时间:2026-08-18 11:06
来源机构:Hugging Face
阅读原文huggingface.co