須多先生
スライドでは「『強化学習』で進化する『会話型AI』」についてまとめられていましたね
いかがでしたか?
須多先生
スライドでは「『強化学習』で進化する『会話型AI』」についてまとめられていましたね
いかがでしたか?
深田 あい
「会話型AI」が どうやって文章を理解しているか おさらいできました
徳井 天
「会話型AI」への「人間による評価」が「報酬」になって より人間らしい回答を生成することができるようになるんだよな
深田 あい
そこまでは分かったんだけど 「会話型AI自身が行う強化学習の仕組み」がまだよく分からなくて…
この図の部分なんだけど
徳井 天
人間の評価の付け方を「会話型AI」が学習して その学習を基に 「会話型AI」自身が評価を付けていく…って部分だよな
深田 あい
そうそう 「会話型AI」自身が評価するってどういうことなんだろうと思って 私にはちょっと難しく感じたんだよね
(ユーザー名)さんはどう思う?
須多先生
確かに その部分は少しイメージしにくいかもしれませんね
同じように 難しく感じた人も多いかもしれません
須多先生
それでは 次のアクティビティで「会話型AI」が自分で評価しながら進化する様子を体験してみましょう
深田 あい
実際に体験できれば イメージしやすくなると思います
ありがとうございます!
徳井 天
「会話型AI」が自分で評価するには 人間の評価も必要だってスライドに書いてあったよな
この人間による評価も 体験できますか?
須多先生
はい もちろんです
先ほどのスライドで学んだ 「強化学習」で進化する「会話型AI」の仕組みを 1から体験してみましょう
須多先生
それでは STAR Colabの演習を用意しましたので 次のアクティビティの指示に従って進めてください