須多先生
みなさん お疲れ様でした
アクティビティはいかがでしたか?
須多先生
みなさん お疲れ様でした
アクティビティはいかがでしたか?
徳井 天
なんというか…
共起ネットワークって 思っていたより小さいというか シンプルな図だった気がしたな
須多先生
いいところに気づきましたね
アクティビティで作成した図がシンプルだった理由は データの数が少なかったからです
須多先生
データの数が増えることで より大きくて複雑な共起ネットワークになります
徳井 天
そうなんですね!せっかく作るなら もっとデータの数を増やして 共起ネットワークを作ってみたいな
深田 あい
WordCloudを作った時と同じように 私たちのオリジナルの共起ネットワークを作ってみたいですね
深田 あい
そういえば WordCloudのときも思いましたが 大量のテキストデータを集めるのって 意外と大変ですよね
須多先生
そうですね しかし このテキストデータを集めるというステップは これから「言語を理解するAI」を開発する上で 避けては通れないものです
皆さん AIを開発するための三つのステップについて 覚えていますか?
徳井 天
えーっと 「準備」と「学習」と…
深田 あい
「評価」ですね!
須多先生
はい その通りです
AIに言語を理解させるためには 大量のデータを「準備」し そのデータを使って「学習」と「評価」する必要があります
須多先生
大量のテキストデータを「準備」することが 「言語を理解するAI」を開発するための最も重要な最初のステップなのです
須多先生
それでは 次の解説動画で「テキストデータの収集と注意点」について詳しく見てみましょう