ホーム / ディープラーニングの応用例 / マルチモーダル / Flamingo

427

Flamingo

ディープラーニングの応用例マルチモーダル

Flamingo とは、DeepMind が発表した、画像と言語をまとめて扱うマルチモーダルモデルです。

学習済みの画像モデルと言語モデルを橋渡しする形で組み合わせており、画像と文章が交互に並んだ入力を扱えます。

いくつか例を見せるだけで新しいタスクに対応できる点が特徴で、画像を含む対話や説明文生成を少ないデータでこなせます。