返回全部动态

OpenBMB 发布 VoxCPM-0.5B:无 tokenizer TTS 模型,支持上下文感知语音生成与声音克隆

原标题:openbmb/VoxCPM-0.5B

Hugging Face New and Trending Models一手来源模型发布质量 82

AI 摘要

OpenBMB 发布了 VoxCPM-0.5B,这是一个基于 MiniCPM4-0.5B 的无 tokenizer 文本转语音(TTS)模型,采用端到端扩散自回归架构,直接在连续空间中建模语音,支持上下文感知的语音生成和零样本声音克隆。该模型在 180 万小时的双语语料上训练,在 RTX 4090 上可实现低至 0.17 的实时率(RTF),支持流式合成。用户可通过 PyPI 安装 voxcpm 包,或使用 CLI 和 Web 演示进行快速体验。

以上摘要由 AI 生成,可能存在误差。事实请以原文为准。

正文节选

--- license: apache-2.0 language: - en - zh base_model: - openbmb/MiniCPM4-0.5B pipeline_tag: text-to-speech library_name: voxcpm tags: - text-to-speech - speech - speech generation - voice cloning --- ## 🎙️ VoxCPM: Tokenizer-Free TTS for Context-Aware Speech Generation and True-to-Life Voice Cloning [![Project Page](https://img.shields.io/badge/Project%20Page-GitHub-blue)](https://github.com/OpenBMB/VoxCPM/) [![MiniCPM Wiki](https://img.shields.io/badge/Docs-ReadTheDocs-8CA1AF)](https://mode


发布时间:2026-08-18 11:06
抓取时间:2026-08-18 11:06
来源机构:Hugging Face
阅读原文huggingface.co