須多先生
みなさん お疲れ様でした
アクティビティはいかがでしたか?
須多先生
みなさん お疲れ様でした
アクティビティはいかがでしたか?
徳井 天
車をゴールまで運ぶだけのシンプルなゲームだったけど 中々難しかったな
深田 あい
最初はただゴールを目指すだけだから簡単だと思ったけど 信号のルールが追加されたら 少し難しく感じちゃったな
須多先生
自動運転での「プラスの報酬」と「マイナスの報酬」はどうなるかイメージはついていますか?
深田 あい
えっと さっきの演習をもとに考えると… 車がチェックポイントにたどり着くことができたら「プラスの報酬」ですかね
徳井 天
逆に 赤信号なのに進んでしまって 交通ルールを守らなかったら「マイナスの報酬」になるんじゃないかな
須多先生
はい その通りです
自動運転の報酬設計についてはバッチリですね
須多先生
それでは次は 強化学習でAIがどのように運転を学んでいくのかを見ていきましょう
深田 あい
私が操作した時は結構ミスしてしまったんですよね…
強化学習で学習した自動運転車は 本当にちゃんとルールを守ってくれるんでしょうか?
須多先生
最初はAIも失敗を繰り返しますが そのたびにマイナスの報酬を受けて 徐々に正しい行動を学んでいきます
深田 あい
私たちが体験したことをAIも同じように体験して 上達できるよう繰り返していくんですね!
徳井 天
どんな風に学んで 賢くなっていくのか楽しみだな!
須多先生
それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください