須多先生
みなさん お疲れ様でした
スライドはいかがでしたか?
須多先生
みなさん お疲れ様でした
スライドはいかがでしたか?
徳井 天
「ルールベース」では予想通り 「五目並べ」になってマスが増えた分 Pythonプログラムの量がものすごく増えたよな…
深田 あい
でも 「強化学習」のPythonプログラムは 「三目並べ」と「五目並べ」で変わらなかったよね
徳井 天
if文でルールを書くのと違って 盤面の評価値をデータとして溜めて それをもとに次の手を考えるから プログラムが増えないで済むんだな
須多先生
これまでに学んできた通り 「強化学習」はAI自身が試行錯誤を重ねて 自ら学んで行きます
須多先生
そのため ルールが変わっても 基本的には「強化学習」のPythonプログラムにも大きな変化はないんですよ
深田 あい
なるほど 活用できる範囲が広いから ボードゲームだけじゃなくて 自動運転やロボットなど さまざまな場面で使われているんですね
須多先生
はい その通りです
さらに 最近注目されている LLMを使った「会話型AI」にも「強化学習」が活用されているんですよ
徳井 天
LLM…?どこかで聞いた覚えがあるな…
(ユーザー名)さんは覚えてる?
深田 あい
LLMって 確か「言語編」で学んだよね
えっとメモがあるはず…
あ そうだ!「大規模言語モデル」って言うんだったね
徳井 天
あ そうだ!思い出したぞ!その「会話型AI」は 人間と自然に会話ができるんだったよな
須多先生
はい その通りです
LLMは「チャットボット」や「生成AI」などの「会話型AI」で使われています
深田 あい
LLMには どのように「強化学習」が関わってくるんでしょうか 気になります!
須多先生
それは 次回のレッスンで説明しますので 楽しみにしていてくださいね
須多先生
最後に 現在の「第四次AIブーム」の火付け役となった「ChatGPT(チャットジーピーティー)」を開発した会社である「OpenAI(オープンエーアイ)社」の研究を紹介します
須多先生
「OpenAI社」は 「ChatGPT」により注目を集める前から 「強化学習」の研究に力を注いでいました
須多先生
特に 「OpenAI Gym(オープンエーアイジム)」というサービスでは 「強化学習」を使った 「バランスゲーム」や「迷路」などのシミュレーション環境を提供していたんですよ
徳井 天
その オープン エーアイ…ジムってサービス 詳しく知りたいです!
須多先生
それでは次のスライドで 「『OpenAI社』による『強化学習』研究」について詳しく見てみましょう