須多先生
みなさんお疲れ様でした
強化学習AIとの対戦はいかがでしたか?
須多先生
みなさんお疲れ様でした
強化学習AIとの対戦はいかがでしたか?
徳井 天
学習を重ねたはずなのに 思ったより弱かったです
50回も学習したのに 俺でも勝てちゃったし…
深田 あい
うん 私も簡単に勝っちゃって ちょっと拍子抜けしちゃったかな
何が原因なんだろう?
徳井 天
もしかしたら 相手のコンピュータが弱すぎたんじゃないか?だって ランダムに動くだけだしな
須深田 あい
それはありそうだね
ランダムに動くコンピュータ相手だと AIがあんまり学習できないんじゃないかな?
須多先生
そうですね まさにその通りです
ランダムに動く相手だと AIは効果的に学習することができません
須多先生
なぜなら 相手が適切な手を打たないので AIにとって学ぶべき状況が限られてしまうからです
徳井 天
なるほど
だから AIが思ったほど強くならなかったんだな
深田 あい
どうすればAIはもっと強くなれるのかな?
須多先生
それを解決するために 次の演習ではルールベースで動くコンピュータを学習の相手に設定できるようにします
須多先生
このコンピュータは 特定のルールに従って戦術を組み立てます
例えば 勝利できる場面では確実に勝ちに行き 相手が勝てそうな場面では阻止する といった具合です
徳井 天
それなら AIももっと賢く学習できそうだな!
深田 あい
そうだね!次はもっと手ごわい相手になりそう
須多先生
それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください