生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
▶ 第1話を無料視聴する
閉じる
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
生成AIによる出力の精度を飛躍的に向上させた大規模言語モデル。はたしてこれまでの言語モデルとはどのような違いがあるのか。1940年代に出た言語モデルの原型を手始めにその仕組みを解説しながら、大規模言語モデルの画期性を解き明かす。キーワードは「自己教師あり学習」だ。(全6話中第3話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:10分14秒
収録日:2024年4月16日
追加日:2024年7月23日
≪全文≫

●単語の出現確率から文章を生成した初期の言語モデル


―― そういう話になってくると、ますます、どうやってそういう能力をいわゆるAIが身につけていくのかというところを、まず知った上でないと判断が難しいと思うのですが、早速その話に入っていきたいと思います。

 まず挙げていただいた言語モデルというところですね。これはどういうことになりますでしょうか。

岡野原 大規模言語モデルの「言語モデル」という部分に関して、まず説明させていただきます。

 言語モデル(ランゲージモデル)というのは、今の大規模言語モデルがこれだけブームになるよりずっと前からある分野です。それこそ、情報理論を発明して、今のコンピュータの礎をつくったシャノンという有名な研究者が1940年代に出したいちばん最初の情報理論の論文にも、その言語モデルの原型が出ています。

 この言語モデルでは、今のような文章を丸ごと生成するのは難しいので、1単語ずつ順番に生成していきます。まず最初に、いろいろあり得る単語の候補の中で「私」というのが出る確率を出すようなモデルを用意します。

 例えば、「私」というのはありとあらゆる単語の中で0.005の確率で出現する(とする)。いちばん出やすいのは、例えば「東京」とか、もっと別の単語かもしれないですけれど、たまたまサイコロを振ったら「私」が出る確率が0.005と設定します。次に、「私」の次に何の単語が出やすいかという確率を用意します。例えば「は」が0.02(の確率で)出る(とする)。

 こういうふうに、何か文字列を生成しよう、確率を与えようという場合に、まず1単語目がどういう確率で出るか。次に、1単語目に決めたものの次の2単語目に何が出やすいかということで決める。3単語目は、1単語目と2単語目の次に何が出やすいのかということを決める。こういう形で、単語列というものに対して、これがサイコロを振ったらどれくらいの確率で出るのかということを出せるようなモデルが、言語モデルになっています。

―― そうすると、その先ほどから意味の部分の話をしていますけれど、(むしろ)意味というよりは、確率でどれが確からしいかというところで並べ替えていくということですね。

岡野原 そうです。まさに今、非常に重要なところを話してもらいました。人間ですとどうしても、こういう...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
「科学と技術」でまず見るべき講義シリーズ
断熱から考える一年中快適で健康な住環境(1)日本の住宅の実態と問題点
なぜ日本は夏暑く、冬寒いのか…断熱から考える住宅の問題
前真之
社会はAIでいかに読み解けるのか(1)経済学理論の役割
AIやディープラーニングによって社会分析の方法が変わる
柳川範之
ヒトの性差とジェンダー論(1)「性」とは何か
MLBのスーパースターも一代限り…生物学から迫る性の実態
長谷川眞理子
エネルギーと医学から考える空海が拓く未来(1)サイバー・フィジカル融合と心身一如
なぜ空海が現代社会に重要か――新しい社会の創造のために
鎌田東二
都市木造の可能性~木造ビルへの挑戦(1)木造建築の歴史と現在
伝統木造建築はいま都市で必要な建物ではない
腰原幹雄
ブラックホールとは何か(1)私たちが住む銀河系
太陽系は銀河系の中で塵のように小さな存在でしかない
岡朋治

人気の講義ランキングTOP10
内側から見たアメリカと日本(6)日本企業の敗因は二つのオウンゴール
日本企業が世界のビジネスに乗り遅れた要因はオウンゴール
島田晴雄
歴史の探り方、活かし方(1)歴史小説と史料探索の基本
日本は素晴らしい歴史史料の宝庫…よい史料の見つけ方とは
中村彰彦
エネルギーと医学から考える空海が拓く未来(5)『秘蔵宝鑰』が示す非二元論的世界
雄大で雄渾な生命の全体像…その中で点滅する個々の生命
鎌田東二
習近平―その政治の「核心」とは何か?(1)習近平政権の特徴
習近平への権力集中…習近平思想と中国の夢と強国強軍
小原雅博
熟睡できる環境・習慣とは(1)熟睡のための条件と認知行動療法
熟睡のために――認知行動療法とポジティブ・ルーティーン
西野精治
何回説明しても伝わらない問題と認知科学(1)「スキーマ」問題と認知の仕組み
なぜ「何回説明しても伝わらない」のか?鍵は認知の仕組み
今井むつみ
習近平中国の真実…米中関係・台湾問題(7)不動産暴落と企業倒産の内実
不動産暴落、大企業倒産危機…中国経済の苦境の実態とは?
垂秀夫
経験学習を促すリーダーシップ(1)経験学習の基本
成長を促す「3つの経験」とは?経験学習の基本を学ぶ
松尾睦
古代中国の「日常史」(1)日常史研究とは何か
『古代中国の24時間』英雄だけでなく無名の民に注目!
柿沼陽平
戦国武将の経済学(1)織田信長の経済政策
織田信長の経済政策…楽市楽座だけではない資金源とは?
小和田哲男