須多先生

みなさん お疲れ様でした
スライドはいかがでしたか?

徳井 天

「ルールベース」では予想通り 「五目並べ」になってマスが増えた分 Pythonプログラムの量がものすごく増えたよな…

深田 あい

でも 「強化学習」のPythonプログラムは 「三目並べ」と「五目並べ」で変わらなかったよね

徳井 天

if文でルールを書くのと違って 盤面の評価値をデータとして溜めて それをもとに次の手を考えるから プログラムが増えないで済むんだな

須多先生

これまでに学んできた通り 「強化学習」はAI自身が試行錯誤を重ねて 自ら学んで行きます

須多先生

そのため ルールが変わっても 基本的には「強化学習」のPythonプログラムにも大きな変化はないんですよ

深田 あい

なるほど 活用できる範囲が広いから ボードゲームだけじゃなくて 自動運転やロボットなど さまざまな場面で使われているんですね

須多先生

はい その通りです
さらに 最近注目されている LLMを使った「会話型AI」にも「強化学習」が活用されているんですよ

徳井 天

LLM…?どこかで聞いた覚えがあるな…
(ユーザー名)さんは覚えてる?

深田 あい

LLMって 確か「言語編」で学んだよね
えっとメモがあるはず…
あ そうだ!「大規模言語モデル」って言うんだったね

徳井 天

あ そうだ!思い出したぞ!その「会話型AI」は 人間と自然に会話ができるんだったよな

須多先生

はい その通りです
LLMは「チャットボット」や「生成AI」などの「会話型AI」で使われています

深田 あい

LLMには どのように「強化学習」が関わってくるんでしょうか 気になります!

須多先生

それは 次回のレッスンで説明しますので 楽しみにしていてくださいね

須多先生

最後に 現在の「第四次AIブーム」の火付け役となった「ChatGPT(チャットジーピーティー)」を開発した会社である「OpenAI(オープンエーアイ)社」の研究を紹介します

須多先生

「OpenAI社」は 「ChatGPT」により注目を集める前から 「強化学習」の研究に力を注いでいました

須多先生

特に 「OpenAI Gym(オープンエーアイジム)」というサービスでは 「強化学習」を使った 「バランスゲーム」や「迷路」などのシミュレーション環境を提供していたんですよ

徳井 天

その オープン エーアイ…ジムってサービス 詳しく知りたいです!

須多先生

それでは次のスライドで 「『OpenAI社』による『強化学習』研究」について詳しく見てみましょう

Well done!

次のステップに進みましょう!

次のステップに進む

← 前のステップにもどる