本页目录
下载模型、克隆音色与导入音频短句
对应页面:音色与短句
场景:你想为语音播报打造个性化的声音体验:安装离线模型后使用默认预置音色或新建克隆专属音色生成播报,或者直接导入现成的音效与录音作为固定短句。
第 1 步:下载并安装语音模型
在 中,确认模型下载源(国内网络默认选择自动优先镜像),点击 下载安装。模型下载安装完成后,应用即具备了离线语音克隆与合成能力。
第 2 步:新建或选择音色生成播报(预置或克隆)
前往 ,展开下方的 批量生成 面板:
- 使用预置音色(默认):保持选中 预置音色,系统会根据当前界面语言自动匹配标准稳定的发音,直接勾选短句即可生成,无需任何准备;
- 新建克隆自己的音色:切换到 克隆音色,选择 新建音色,填写 新音色名称,并点击 选择参考音频(WAV) 选取一段 5~10 秒干净清晰的角色干声(WAV 格式,可按需勾选 保留参考音频文件);
- 选好音色后,勾选需要生成的短句,点击 开始生成 进行批量制作。
第 3 步:直接导入任意音频作为短句
如果不想使用 TTS 语音合成,或者想直接播放现成的音效、提示音与外部录音:
- 在 短句库 顶部的短句管理区中输入 短句名称 和播报文本内容;
- 点击 导入音频,选择音频文件(支持 wav / mp3 / flac / ogg / m4a,时长 0.2~30 秒);
- 导入后状态显示为 已导入,导入音频无需模型支持,可直接在各监控功能页中通过 短语库引用 选用。