ホーム / ディープラーニングの応用例 / マルチモーダル / Text-To-Image

423

Text-To-Image

ディープラーニングの応用例マルチモーダル

Text-To-Image とは、文章での指示から、その内容に合う画像を生成するタスクです。

「宇宙飛行士が馬に乗っている水彩画」といった、現実には存在しない組み合わせでも描き出せます。言葉の理解と画像の生成の両方が必要になります。

CLIP のような対応づけの技術と拡散モデルの組み合わせで実用水準に達し、生成 AI を象徴する応用になりました。