跳转到正文
Resonance Logs使用说明

技能、浮窗、抓包……

概览音色与短句
本页目录
语音播报

音色与短句

播报文案配置好后,需要生成对应的音频才能播放。本页介绍音色的四种来源,以及如何管理 短句库。
方式准备工作效果适合
预置音色无标准、稳定所有人,开箱即用
克隆音色一段 5~10 秒的干声接近参考音频想要某个角色的声音
微调音色10~30 分钟语音 + 显卡训练还原度最高有经验的进阶用户
导入音频现成的音频文件就是原音频音效、录音、不想用 TTS
生成音频前,需要先在 模型与音色 中安装语音模型。导入音频不需要模型。

方式一:预置音色

在 短句库批量生成 中选择 预置音色(默认选中),勾选短句后点 开始生成。在播报总览中点 一键生成缺失语音 时同样默认使用预置音色。
  • 预置音色按当前界面语言自动选择(简体中文 / English / 日本語),与短句本身是什么语言无关。
  • 切换界面语言后再生成,会自动改用新语言的预置音色。

方式二:克隆音色

只需一段参考音频,无需训练。
克隆音色批量生成
  1. 在 批量生成 中选择 克隆音色。
  2. 选择 使用已有音色,或者 新建音色:填写 新音色名称,点 选择参考音频(WAV)。可以勾选 保留参考音频文件。
  3. 勾选要生成的短句(可以 全选),点 开始生成。
保存过的音色会出现在 模型与音色音色档案 中,下次直接选用即可。
方式三:微调音色(进阶)进阶配置
克隆只依赖几秒参考音频,相似度和稳定性有限。想要更高的还原度,可以用目标角色的语音数据微调一个专属模型,导出后在应用中引用。
大致流程:
  1. 获取素材:B 站视频可以用 bilibilidownloadtool 下载。
  2. 提取音频:用 FFmpeg 转成无损 PCM WAV,保留原始采样率,不要先压成 MP3。
  3. 分离人声:用 Ultimate Vocal Remover 去掉背景音,导出 Vocals 干声,并完整试听检查。
  4. 制作数据集:按静音切分,重采样到 24kHz,用 ASR 转写后人工校对文本。
  5. 训练:生成音频离散码和 speaker embedding,微调 Qwen3-TTS 0.6B CustomVoice。推荐在 Docker 中运行,预构建镜像为 ghcr.io/mozi1924/qwen3-tts-easyfinetuning。
  6. 导出:导出 GGUF 部署目录,在 模型与音色用户微调音色 中点 导入。之后在批量生成中选择 微调音色。
数据与环境要求:
  • 只使用你自己拥有或已获授权的声音数据,一个数据集只包含一个说话人。
  • 建议准备 10~30 分钟干净的有效语音。数据少也能训练,但相似度和稳定性会差一些。
  • 训练建议使用显存 ≥ 16GB 的 NVIDIA 显卡;Windows 下推荐 WSL2 + Docker Desktop。
微调效果示例(日语音色):
  • 蒂娜 CD 结束提醒:ja_01_tina_cd.wav
  • N20 治疗提醒:ja_02_n20_healbot.wav
部署目录移动或文件变化后,微调音色会显示 路径缺失 或 文件已改变。用 重新定位 指向新位置,并用 完整性检查 确认完整。移除引用 只移除引用,不会删除外部文件。

方式四:导入现成音频

不想用 TTS,或者想用一段音效时,可以直接导入音频文件:
  1. 在 短句库 中填写 短句名称,点击 导入音频。
  2. 选择 wav / mp3 / flac / ogg / m4a 文件,大小不超过 50 MiB,时长 0.2~30 秒。
  3. 已有的短句也可以点这一行的 导入音频,用文件替换当前语音。
导入的音频会统一转为单声道 24kHz,状态显示为 已导入,不参与语音生成。在功能页中选择 短语库引用 就能使用它。

管理短句库

短句库 中每条短句都有一个状态:
状态含义
已生成可以直接播放
需重新生成音色或文本改过,旧音频已过期
未生成还没有音频
已导入来自导入的文件
你也可以手动 新增短句,写好常用的句子,在多个功能页中通过短语库引用复用。
自动生成的短语按文案内容区分:同一条播报在不同方案里写了不同文案,会各自保留一份音频;文案相同则共用一份。修改文案后,在新文案的音频生成之前,这条播报会继续播放之前的音频。
删除播报、取消监控对象或修改文案后,旧文案的自动短语会变成未引用短语。它们不会被自动删除:清理之前重新配置同样文案的播报,会直接复用已生成的音频。点击 清理未引用短语 可以一键删除它们,确认框会列出将要删除的短语。清理会检查所有监控方案(不只是当前方案),以下短语不会被清理:
  • 任一方案中仍在使用的,包括暂时关闭的事件;
  • 在功能页中通过 短语库引用 选用的;
  • 新文案还没有音频时,正在代替它播放的旧短语;
  • 带有导入音频的,需要在列表中逐条手动删除;
  • 你手动创建的短句,以及应用自带的提示音。

例

例 用自己的音效提醒 Boss 大招场景:团队约定 Boss 放某个大招时听一声警报,而不是一句 TTS 语音。你手上有一段 2 秒的警报音效 alarm.mp3,想让它在大招读条时以最高优先级播放。

第 1 步:导入音效

  1. 打开 语音播报短句库。
  2. 在 短句名称 中填写「大招警报」。
  3. 点击 导入音频,选择 alarm.mp3。
  4. 列表中出现「大招警报」,状态为 已导入,点 试听 确认声音正常。
导入音频不需要安装语音模型。

第 2 步:在 Boss DBM 中引用

  1. 打开 怪物监控Boss DBM。
  2. 在 语音播报 中添加这个技能,事件选 触发时播报。
  3. 文案来源选 短语库引用,点 选择短语,选「大招警报」。
  4. 优先级 选 紧急。

第 3 步:允许打断

在 总览与播放播放队列策略 中开启 高优先级可打断当前播放。这样即使正在播报别的内容,警报也会立即响起。

分享给队友

把方案 导出 给队友时,播报绑定会一起带过去,但音频文件不会。让队友把同一个 alarm.mp3 也导入短句库:导入短句的 ID 由音频内容决定,同一个文件的 ID 相同,绑定会自动对上。
Resonance Logs
Privacy Policy