須多先生

みなさん お疲れ様でした
解説動画とクイズ形式のアクティビティで 「強化学習」の「行動」と「報酬」について理解できましたか?

深田 あい

AIが取る「行動」に対しての評価として「報酬」を与えることで AIが適切な行動を学んでいくということが分かりました

徳井 天

AIが目的を達成するために どんな報酬を与えるのかは 人間が考えなきゃいけないんだよな

深田 あい

えっと 確か「報酬設計」って言うんだよね
報酬の与え方次第で どんなAIになるかが変わるんだから とても重要な役割だよね

須多先生

みなさん しっかり理解できたようですね

須多先生

それでは実際に 「強化学習」を使用したAIを動かしてみましょう

徳井 天

楽しみにしてました!「強化学習」を使って どんなAIを動かすんですか?

須多先生

前回と同じく 「三目並べ」をプレイするAIを試してみましょう

深田 あい

前回は「ルールベース」のコンピュータを作りましたよね
「強化学習」を使ったら もっと強くなるのかな?

徳井 天

「ルールベース」はあらかじめ決められた戦略に従って動くだけだったけど 「強化学習」ではAIが自分で試行錯誤して成長していくんだよな

須多先生

「ルールベース」とは違い 「報酬」を与えることで 少しずつ強くなっていくAIを体験してみましょう

須多先生

それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください

Well done!

次のステップに進みましょう!

次のステップに進む

← 前のステップにもどる