このページの内容
モデルのダウンロード、音声のクローン、音声ファイルのインポート
関連ページ:音色とフレーズ
シナリオ:音声読み上げを好みに合わせてカスタマイズしたい場合です。オフラインモデルをインストールしてプリセット音声や新しくクローンした独自音声で読み上げを生成するか、手持ちの効果音や録音ファイルをそのまま固定フレーズとしてインポートします。
ステップ 1:音声モデルをダウンロードしてインストールする
で、モデルのダウンロード元を確認し、ダウンロードしてインストール をクリックします。モデルのインストールが完了すると、オフラインでの音声クローンと読み上げ生成が利用可能になります。
ステップ 2:音声を選択または新規作成して読み上げを生成する(プリセットまたはクローン)
を開き、下部の 一括生成 パネルを展開します:
- プリセット音声を使用(既定):プリセット音声 を選択したままにします。現在の UI 言語に合わせた標準的な音声が自動で使用され、フレーズを選んですぐに生成できます;
- 新しい音声をクローン作成:クローン音声 に切り替え、新しい音声を作成 をクリックします。新しい音声名 を入力し、参照音声(WAV)を選択 をクリックして 5〜10 秒程度のノイズのないキャラクター音声(WAV 形式)を選択します(必要に応じて 参照音声ファイルを保持する をオンにします);
- 音声を選択したら、生成したいフレーズにチェックを入れて 生成開始 をクリックします。
ステップ 3:任意の音声を固定フレーズとしてインポートする
TTS による音声合成を使わず、手持ちの効果音や通知音、外部録音ファイルをそのまま再生したい場合:
- フレーズ集 上部のフレーズ管理欄で フレーズ名 と読み上げテキストを入力します;
- 音声をインポート をクリックし、音声ファイル(wav / mp3 / flac / ogg / m4a に対応、長さ 0.2〜30 秒)を選択します;
- インポート完了後、状態は インポート済み になります。インポートした音声はモデル不要で、各機能ページから フレーズ集から参照 で直接参照できます。