須多先生

みなさんお疲れ様でした
強化学習AIとの対戦はいかがでしたか?

徳井 天

学習を重ねたはずなのに 思ったより弱かったです
50回も学習したのに 俺でも勝てちゃったし…

深田 あい

うん 私も簡単に勝っちゃって ちょっと拍子抜けしちゃったかな
何が原因なんだろう?

徳井 天

もしかしたら 相手のコンピュータが弱すぎたんじゃないか?だって ランダムに動くだけだしな

須深田 あい

それはありそうだね
ランダムに動くコンピュータ相手だと AIがあんまり学習できないんじゃないかな?

須多先生

そうですね まさにその通りです
ランダムに動く相手だと AIは効果的に学習することができません

須多先生

なぜなら 相手が適切な手を打たないので AIにとって学ぶべき状況が限られてしまうからです

徳井 天

なるほど
だから AIが思ったほど強くならなかったんだな

深田 あい

どうすればAIはもっと強くなれるのかな?

須多先生

それを解決するために 次の演習ではルールベースで動くコンピュータを学習の相手に設定できるようにします

須多先生

このコンピュータは 特定のルールに従って戦術を組み立てます
例えば 勝利できる場面では確実に勝ちに行き 相手が勝てそうな場面では阻止する といった具合です

徳井 天

それなら AIももっと賢く学習できそうだな!

深田 あい

そうだね!次はもっと手ごわい相手になりそう

須多先生

それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください

Well done!

次のステップに進みましょう!

次のステップに進む

← 前のステップにもどる