
支持多语言
支持多种语言,包括普通话、英语和方言的语音合成。
介绍
探索一个由 CosyVoice 驱动的多语种语音生成世界。
支持中文、英语等多种语言及多种方言,覆盖广泛。
快速响应的语音合成,延迟仅 150 毫秒,完美适配实时场景。
基于 Apache-2.0 协议开源,便于灵活采用与扩展。
CosyVoice 在文本转语音合成领域带来突破性的改进。
产品优势
CosyVoice 提供了多样化的语言支持和低延迟的实时实施,为各种语音合成需求提供了解决方案。

支持多种语言,包括普通话、英语和方言的语音合成。

以极低延迟实时克隆声音,适用于交互式即时应用。

采用 CosyVoice 低延迟流式合成,在实时应用中无缝生成语音。
关键数字
数字来自上游 CosyVoice 模型 README,不是 CosyVoice.org 的用量统计。
支持语种
中、英、日、韩等 9 种语言
首包延迟
流式合成,来自模型 README
中文方言
粤语、四川话等 18 种以上方言
语种、方言和延迟数字来自上游 FunAudioLLM / CosyVoice README.
feature
CosyVoice 独特的功能提升您的语音合成体验。
CosyVoice 提供领先的多语言支持,轻松处理多种语言与方言。
凭借极快的合成速度,CosyVoice 让应用在语音生成中几乎没有延迟。
CosyVoice 采用零样本语音合成,轻松输出高精度语音。
常见问题
以下是关于 CosyVoice 使用和功能的常见问题解答。
应用场景
探索 CosyVoice 凭借高保真语音合成与零样本声音克隆,如何赋能不同场景的应用与创作需求。
借助 CosyVoice 高拟真语音合成,一键生成情感丰富的有声书和播客内容。
快速为短视频、影视解说生成多语言与粤语等18种方言配音,提升剪辑效率。
150ms 超低延迟流式语音合成,实现虚拟助理的极速流利声音交互体验。
支持开心、悲伤等多种情绪表达与原创声音设计,塑造栩栩如生的游戏角色。
支持中、英、日、韩等9种语言,实现跨语言声音克隆,保留音色完美出海。
提供地道的双语教学声音样本,辅助多国语言学习,实现课件快速有声化。