須多先生

スライドでは「『強化学習』で進化する『会話型AI』」についてまとめられていましたね
いかがでしたか?

深田 あい

「会話型AI」が どうやって文章を理解しているか おさらいできました

徳井 天

「会話型AI」への「人間による評価」が「報酬」になって より人間らしい回答を生成することができるようになるんだよな

深田 あい

そこまでは分かったんだけど 「会話型AI自身が行う強化学習の仕組み」がまだよく分からなくて…
この図の部分なんだけど

徳井 天

人間の評価の付け方を「会話型AI」が学習して その学習を基に 「会話型AI」自身が評価を付けていく…って部分だよな

深田 あい

そうそう 「会話型AI」自身が評価するってどういうことなんだろうと思って 私にはちょっと難しく感じたんだよね
(ユーザー名)さんはどう思う?

須多先生

確かに その部分は少しイメージしにくいかもしれませんね
同じように 難しく感じた人も多いかもしれません

須多先生

それでは 次のアクティビティで「会話型AI」が自分で評価しながら進化する様子を体験してみましょう

深田 あい

実際に体験できれば イメージしやすくなると思います
ありがとうございます!

徳井 天

「会話型AI」が自分で評価するには 人間の評価も必要だってスライドに書いてあったよな
この人間による評価も 体験できますか?

須多先生

はい もちろんです
先ほどのスライドで学んだ 「強化学習」で進化する「会話型AI」の仕組みを 1から体験してみましょう

須多先生

それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください

Well done!

次のステップに進みましょう!

次のステップに進む

← 前のステップにもどる