生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
▶ 第1話を無料視聴する
閉じる
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
岡野原大輔(株式会社Preferred Networks 代表取締役社長)
生成AIによる出力の精度を飛躍的に向上させた大規模言語モデル。はたしてこれまでの言語モデルとはどのような違いがあるのか。1940年代に出た言語モデルの原型を手始めにその仕組みを解説しながら、大規模言語モデルの画期性を解き明かす。キーワードは「自己教師あり学習」だ。(全6話中第3話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:10分14秒
収録日:2024年4月16日
追加日:2024年7月23日
≪全文≫

●単語の出現確率から文章を生成した初期の言語モデル


―― そういう話になってくると、ますます、どうやってそういう能力をいわゆるAIが身につけていくのかというところを、まず知った上でないと判断が難しいと思うのですが、早速その話に入っていきたいと思います。

 まず挙げていただいた言語モデルというところですね。これはどういうことになりますでしょうか。

岡野原 大規模言語モデルの「言語モデル」という部分に関して、まず説明させていただきます。

 言語モデル(ランゲージモデル)というのは、今の大規模言語モデルがこれだけブームになるよりずっと前からある分野です。それこそ、情報理論を発明して、今のコンピュータの礎をつくったシャノンという有名な研究者が1940年代に出したいちばん最初の情報理論の論文にも、その言語モデルの原型が出ています。

 この言語モデルでは、今のような文章を丸ごと生成するのは難しいので、1単語ずつ順番に生成していきます。まず最初に、いろいろあり得る単語の候補の中で「私」というのが出る確率を出すようなモデルを用意します。

 例えば、「私」というのはありとあらゆる単語の中で0.005の確率で出現する(とする)。いちばん出やすいのは、例えば「東京」とか、もっと別の単語かもしれないですけれど、たまたまサイコロを振ったら「私」が出る確率が0.005と設定します。次に、「私」の次に何の単語が出やすいかという確率を用意します。例えば「は」が0.02(の確率で)出る(とする)。

 こういうふうに、何か文字列を生成しよう、確率を与えようという場合に、まず1単語目がどういう確率で出るか。次に、1単語目に決めたものの次の2単語目に何が出やすいかということで決める。3単語目は、1単語目と2単語目の次に何が出やすいのかということを決める。こういう形で、単語列というものに対して、これがサイコロを振ったらどれくらいの確率で出るのかということを出せるようなモデルが、言語モデルになっています。

―― そうすると、その先ほどから意味の部分の話をしていますけれど、(むしろ)意味というよりは、確率でどれが確からしいかというところで並べ替えていくということですね。

岡野原 そうです。まさに今、非常に重要なところを話してもらいました。人間ですとどうしても、こういう...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
「科学と技術」でまず見るべき講義シリーズ
ChatGPT~AIと人間の未来(1)ChatGPTは何ができて、何ができないか
ChatGPTは考えてない?…「AIの回答」の本質とは
西垣通
性はなぜあるのか~進化生物学から見たLGBT(1)有性生殖と無性生殖
なぜ雄と雌の2つの性別があるのか…「性」の謎とLGBT
長谷川眞理子
五島列島沖合の海没処分潜水艦群調査(1)目的と潜水艦史
海底に突き刺さる旧日本海軍の潜水艦「伊58」を特定!
浦環
レアメタルの光と影(1)イントロ
イノベーションがレアメタルをコモンメタルにする
岡部徹
ヒトの性差とジェンダー論(1)「性」とは何か
MLBのスーパースターも一代限り…生物学から迫る性の実態
長谷川眞理子
本当によくわかる「量子コンピュータ入門」(1)量子コンピュータとは何か
「量子コンピュータ」はどういうもので、何に使えるのか
武田俊太郎

人気の講義ランキングTOP10
豊臣兄弟~秀吉と秀長の実像に迫る(序)時代考証が語る『豊臣兄弟!』の魅力
2026年大河ドラマ『豊臣兄弟!』秀吉と秀長の実像に迫る
黒田基樹
「進化」への誤解…本当は何か?(2)「進化論」対「創造論」
「進化論」対「創造論」…アリストテレスの目的論とは?
長谷川眞理子
新しい循環文明への道(2)都市鉱山のデジタルツイン
都市鉱山のデジタルツイン…金やレアアースの宝庫がわが国に
小宮山宏
「次世代地熱発電」の可能性~地熱革命が拓く未来
地熱革命が世界を変える――次世代地熱の可能性に迫る
片瀬裕文
生成AI「Round 2」への向き合い方(1)生成AI導入の現在地
生成AIの利活用に格差…世界の導入事情と日本の現状
渡辺宣彦
過激化した米国~MAGA内戦と民主党の逆襲(1)米国の過激化とそのプロセス
MAGA内戦、DSAの台頭…過激化が完了した米国の現在地
東秀敏
定年後の人生を設計する(1)定年後の不安と「黄金の15年」
不安な定年後を人生の「黄金の15年」に変えるポイント
楠木新
逆境に対峙する哲学(1)日常性が「破れ」て思考が始まる
逆境にどう対峙するか…西洋哲学×東洋哲学で問う知的ライブ
津崎良典
健診結果から考える健康管理・新5カ条(1)血管をより長く守ることが重要な時代
健康診断の結果が悪い人が絶対にやってはいけないこと
野口緑
折口信夫が語った日本文化の核心(1)「まれびと」と日本の「おもてなし」
「まれびと」とは何か?折口信夫が考えた日本文化の根源
上野誠