ホーム / ディープラーニングの応用例 / 深層強化学習 / アルファ碁ゼロ

391

アルファ碁ゼロ

ディープラーニングの応用例深層強化学習

アルファ碁ゼロとは、人間の棋譜をいっさい使わず、自己対戦だけで囲碁を学習した AI です。

ルールだけを与えられた状態から始め、自分と対戦しながら強くなり、わずか 3 日で人間の棋譜を学んだ初代 AlphaGo を上回りました。

人間の知識が足かせにならず、むしろ何もない状態から学んだほうが強くなり得ることを示した、象徴的な成果です。