方言配音与文字转语音平台

支持情感与富语言标签的 AI 配音服务,提供文字转语音、声音克隆、声音设计,音色全覆盖支持文(普通话、广东话、重庆话、东北话、甘肃话、贵州话、浙江话、河北话、河南话、湖北话、湖南话、江西话、宁波话、宁夏话、青岛话、陕西话、山西话、山东话、上海话、四川话、云南话)、英语、日语、韩语、俄语、法语、德语、葡萄牙语、泰语、印尼语、越南语、西班牙语、意大利语、马来西亚语、菲律宾语、阿拉伯语!

在线AI配音服务

提供业界领先的AI配音服务,集成声音克隆、文字转语音等核心功能!

请输入文本
0/20000 字符
声音克隆
本系列的系统音色与复刻音色均支持任意指令;复刻音色的方言需写进指令文本,例如在「语音合成」页的指令框填写「请用河南话表达。」。 音色创建后需经审核,仅状态为「审核通过」的音色可用于合成。
最多20个字符
注意:克隆和设计的音色,30天未使用系统将自动清理
必须与后续进行语音合成时使用的模型保持一致,否则会合成失败。
用于辅助模型识别样本音频(原始参考音频)的语种,从而更准确地提取音色特征,提升复刻效果。
开启后系统会在复刻前对输入音频进行降噪、音频增强、音量规整等处理。仅适用于本页的 qwen-audio-3.0-tts-plus、qwen-audio-3.1-tts-flash、qwen-audio-3.0-tts-flash 模型。
10.0 秒
音频预处理后用于声音复刻的参考音频最大时长,单位为秒。仅适用于本页的 qwen-audio-3.0-tts-plus、qwen-audio-3.1-tts-flash、qwen-audio-3.0-tts-flash 模型。

点击或拖拽音频文件至此处上传

支持格式:MP3、WAV、M4A 大小:≤ 10 MB 时长:10~20秒,最长不超过60秒

音色设计
最多20个字符
必须与后续进行语音合成时使用的模型保持一致,否则会合成失败。
声音设计音色暂不支持方言,语言仅支持中文与英文;如需方言请改用系统音色或复刻音色。
0/500 字符
如何编写高质量的声音描述?查看描述说明教程
0/200 字符

如何使用Qwen-Audio-TTS

简单四步,快速生成高质量AI配音

01

输入文本

在文本框中输入您需要转换的文字内容,可插入情感与富语言标签,让配音更有表现力。

02

选择模型

从 Qwen-Audio-TTS 系列模型中选择适合您需求的模型版本。

03

选择音色

从丰富的音色库中选择您喜欢的声音,包括男声、女声和各种特色音色。

04

生成下载

点击生成按钮,AI将快速为您生成语音文件,支持直接播放和下载。

特色说明

支持 21 种方言合成与情感/富语言标签,让配音更有表现力

方言支持

共 21 种方言(含普通话)

Qwen-Audio-TTS 模型支持通过指令控制合成方言语音,覆盖全国主要方言区,满足地域化内容创作需求;声音设计音色暂不支持方言。

普通话 广东话 (粤语) 重庆话 东北话 甘肃话 贵州话 浙江话 河北话 河南话 湖北话 湖南话 江西话 宁波话 宁夏话 青岛话 陕西话 山西话 山东话 上海话 四川话 云南话
使用方式

方言需通过指令控制功能设置,在指令输入框中输入对应方言的指令,例如:

请用河南话表达。

不同模型支持的方言有差异,详细支持情况请查看 方言支持文档

快速指引
  1. 在文本框中输入需要合成的文字内容
  2. 点击情感与富语言标签插入方括号标签
    例:[excited]今天天气真好!
  3. 在指令控制输入框中填写语气或方言指令
    例:请用河南话表达。
  4. 选择 Qwen-Audio-TTS 模型版本
  5. 选择音色,点击生成即可
  6. 音色克隆后长期不使用,系统会自动清理

情感与富语言标签

本系列三个模型独有,标签写在待合成文本中

在文本中直接嵌入方括号标签即可控制情感,或在指定位置插入拟声效果。控制类标签作用于其后的所有文本,直到遇到下一个控制类标签; 富语言类标签只在该位置插入拟声,不影响前后文本的情感风格。在「语音合成」页点击情感与富语言标签按钮可一键插入。

[excited]今天的天气真不错![laughing]我们一起出去玩吧!
↑ [excited] 控制兴奋情感,[laughing] 在该处插入笑声
[serious]请注意安全事项。[excited]好了,现在让我们开始吧!
↑ 同一段文本中切换不同情感

标签必须使用方括号([sad]),不要写成圆括号;标签原样保留英文写法,不要翻译成中文。 查看标签清单