須多先生

みなさん お疲れ様でした
アクティビティはいかがでしたか?

徳井 天

車をゴールまで運ぶだけのシンプルなゲームだったけど 中々難しかったな

深田 あい

最初はただゴールを目指すだけだから簡単だと思ったけど 信号のルールが追加されたら 少し難しく感じちゃったな

須多先生

自動運転での「プラスの報酬」と「マイナスの報酬」はどうなるかイメージはついていますか?

深田 あい

えっと さっきの演習をもとに考えると… 車がチェックポイントにたどり着くことができたら「プラスの報酬」ですかね

徳井 天

逆に 赤信号なのに進んでしまって 交通ルールを守らなかったら「マイナスの報酬」になるんじゃないかな

須多先生

はい その通りです
自動運転の報酬設計についてはバッチリですね

須多先生

それでは次は 強化学習でAIがどのように運転を学んでいくのかを見ていきましょう

深田 あい

私が操作した時は結構ミスしてしまったんですよね…
強化学習で学習した自動運転車は 本当にちゃんとルールを守ってくれるんでしょうか?

須多先生

最初はAIも失敗を繰り返しますが そのたびにマイナスの報酬を受けて 徐々に正しい行動を学んでいきます

深田 あい

私たちが体験したことをAIも同じように体験して 上達できるよう繰り返していくんですね!

徳井 天

どんな風に学んで 賢くなっていくのか楽しみだな!

須多先生

それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください

Well done!

次のステップに進みましょう!

次のステップに進む

← 前のステップにもどる