自己学習型・ニューラルネットワーク

3目並べ

重みは完全ランダムな状態からスタートします。対局を重ねるたび、勝敗の結果を使ってネットワークの重みが 少しずつ更新され、AIは徐々に強くなっていきます。3×3と4×4は別々のネットワークとして、それぞれ独立に学習が進みます。

あなたの番です 思考中...
盤面サイズ
あなたの手番

マス内の数字はAIが着手直後に予測する勝率(%)です。セルにカーソルを合わせると、その一手を打った場合の脳内活動を右のネットワーク図で確認できます。

対局モード
学習:探索率εで手を混ぜます。本番:最善手のみを選びます。無敵:全探索で理論上負けません。学習自体はどのモードでも継続します。
ネットワークの可視化(3×3)
現在の局面(AI視点): 50.0%