ホーム / ディープラーニングの応用例 / 音声処理 / WaveNet

377

WaveNet

ディープラーニングの応用例音声処理

WaveNet とは、音声の波形そのものを 1 点ずつ生成していくディープラーニングモデルです。2016 年に DeepMind が発表しました。

従来の音声合成は録音した断片をつなぎ合わせる方式が主流でしたが、WaveNet は波形を直接作り出すため、はるかに自然な声になります。

Dilation convolution を使って長い範囲の依存関係をとらえており、音声合成の水準を一段引き上げました。