CosyVoice3 - AI配音与文字转语音平台

基于 CosyVoice 模型技术开发的AI配音服务,提供业界领先的文字转语音、声音克隆功能和声音设计功能!

在线AI配音服务

提供业界领先的AI配音服务,集成声音克隆、文字转语音等核心功能!

请输入文本
0/20000 字符
声音克隆
最多20个字符
必须与后续进行语音合成时使用的模型保持一致,否则会合成失败。
用于辅助模型识别样本音频(原始参考音频)的语种,从而更准确地提取音色特征,提升复刻效果。
开启后系统会在复刻前对输入音频进行降噪、音频增强、音量规整等处理。仅适用于 cosyvoice-v3.5-plus、cosyvoice-v3.5-flash和cosyvoice-v3-flash 模型。
10.0 秒
音频预处理后用于声音复刻的参考音频最大时长,单位为秒。仅适用于 cosyvoice-v3.5-plus、cosyvoice-v3.5-flash、cosyvoice-v3-flash 模型。

点击或拖拽音频文件至此处上传

支持格式:MP3、WAV、M4A 大小:≤ 10 MB 时长:10~20秒,最长不超过60秒

音色设计
最多20个字符
必须与后续进行语音合成时使用的模型保持一致,否则会合成失败。
0/500 字符
如何编写高质量的声音描述?查看描述说明教程
0/200 字符

如何使用CosyVoice3

简单四步,快速生成高质量AI配音

01

输入文本

在文本框中输入您需要转换的文字内容,支持多种语言和标点符号。

02

选择模型

从CosyVoice3系列模型中选择适合您需求的模型版本。

03

选择音色

从丰富的音色库中选择您喜欢的声音,包括男声、女声和各种特色音色。

04

生成下载

点击生成按钮,AI将快速为您生成语音文件,支持直接播放和下载。

特色说明

支持 21 种方言合成,覆盖全国主要方言区

方言支持

共 21 种方言(含普通话)

CosyVoice3 模型支持通过指令控制合成方言语音,覆盖全国主要方言区,满足地域化内容创作需求。

普通话 广东话 重庆话 东北话 甘肃话 贵州话 浙江话 河北话 河南话 湖北话 湖南话 江西话 宁波话 宁夏话 青岛话 陕西话 山西话 山东话 上海话 四川话 云南话
使用方式

方言需通过指令控制功能设置,在指令输入框中输入对应方言的指令,例如:

用四川话说这句话

不同模型支持的方言有差异,详细支持情况请查看 方言支持文档

快速指引
  1. 在文本框中输入需要合成的文字内容
  2. 指令控制输入框中填写方言指令
    例:用四川话说这句话
  3. 选择 CosyVoice3 模型版本
  4. 选择音色,点击生成即可