ホーム / ディープラーニングの応用例 / データ生成 / 音声生成

405

音声生成

ディープラーニングの応用例データ生成

音声生成とは、AI が新しい音声を作り出すタスクです。文章を読み上げる音声合成や、楽曲の生成が含まれます。

従来は録音した音の断片をつなぐ方式でしたが、WaveNet 以降は波形を直接生成できるようになり、人の声と区別が難しい品質に達しています。

少量の録音から特定の話者の声を再現することもでき、なりすましへの懸念も指摘されています。