ホーム / ディープラーニングの応用例 / 深層強化学習 / デュエリングネットワーク
382
デュエリングネットワーク
ディープラーニングの応用例深層強化学習
デュエリングネットワークとは、その状況自体の良さと、各行動がどれだけ有利かを分けて学習する DQN の改良です。
どの行動を選んでも結果が変わらない場面では、状況の良さだけを学べば十分です。両者を分けることで、無駄な学習を減らし効率を上げられます。
ネットワークの出力を 2 つに分けて最後に合成する構造で、他の改良と組み合わせやすい設計になっています。