返回全部动态
智谱AI发布GLM-TTS语音合成模型,实现低延迟与高情感表达
原标题:2025-12-11 GLM-TTS 语音合成模型上线
AI 摘要
智谱AI发布了GLM-TTS语音合成模型,采用两阶段生成架构,在自然度、情绪表达和语调连贯性上实现升级。该模型支持流式与非流式接口,首帧响应低于400ms,并通过强化学习优化降低了字错误率,在开源评测中取得SOTA情感表达表现。GLM-TTS支持灵活控制语速、音量和风格,适用于客服、阅读、文旅和智能硬件等多场景。
以上摘要由 AI 生成,可能存在误差。事实请以原文为准。
正文节选
🎵 [**GLM-TTS**](/cn/guide/models/sound-and-video/glm-tts) * 在架构上采用两阶段生成,在自然度、情绪表达与语调连贯性上实现全面升级 * 支持流式与非流式接口,首帧响应低于 400ms,实现低延迟的交互式体验 * 强化学习(GRPO)优化显著降低字错误率,并在开源评测中取得 SOTA 情感表达表现 * 支持灵活控制语速、音量与风格,满足客服、阅读、文旅、智能硬件等多场景需求
发布时间:2025-12-11 08:00
抓取时间:2026-08-31 00:41
来源机构:Zhipu AI