生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
第1話へ
▶ この講義を再生
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
(会員の方に広告は表示されません)
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
生成AIによる出力の精度を飛躍的に向上させた大規模言語モデル。はたしてこれまでの言語モデルとはどのような違いがあるのか。1940年代に出た言語モデルの原型を手始めにその仕組みを解説しながら、大規模言語モデルの画期性を解き明かす。キーワードは「自己教師あり学習」だ。(全6話中第3話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:10分14秒
収録日:2024年4月16日
追加日:2024年7月23日
≪全文≫

●単語の出現確率から文章を生成した初期の言語モデル


―― そういう話になってくると、ますます、どうやってそういう能力をいわゆるAIが身につけていくのかというところを、まず知った上でないと判断が難しいと思うのですが、早速その話に入っていきたいと思います。

 まず挙げていただいた言語モデルというところですね。これはどういうことになりますでしょうか。

岡野原 大規模言語モデルの「言語モデル」という部分に関して、まず説明させていただきます。

 言語モデル(ランゲージモデル)というのは、今の大規模言語モデルがこれだけブームになるよりずっと前からある分野です。それこそ、情報理論を発明して、今のコンピュータの礎をつくったシャノンという有名な研究者が1940年代に出したいちばん最初の情報理論の論文にも、その言語モデルの原型が出ています。

 この言語モデルでは、今のような文章を丸ごと生成するのは難しいので、1単語ずつ順番に生成していきます。まず最初に、いろいろあり得る単語の候補の中で「私」というのが出る確率を出すようなモデルを用意します。

 例えば、「私」というのはありとあらゆる単語の中で0.005の確率で出現する(とする)。いちばん出やすいのは、例えば「東京」とか、もっと別の単語かもしれないですけれど、たまたまサイコロを振ったら「私」が出る確率が0.005と設定します。次に、「私」の次に何の単語が出やすいかという確率を用意します。例えば「は」が0.02(の確率で)出る(とする)。

 こういうふうに、何か文字列を生成しよう、確率を与えようという場合に、まず1単語目がどういう確率で出るか。次に、1単語目に決めたものの次の2単語目に何が出やすいかということで決める。3単語目は、1単語目と2単語目の次に何が出やすいのかということを決める。こういう形で、単語列というものに対して、これがサイコロを振ったらどれくらいの確率で出るのかということを出せるようなモデルが、言語モデルになっています。

―― そうすると、その先ほどから意味の部分の話をしていますけれど、(むしろ)意味というよりは、確率でどれが確からしいかというところで並べ替えていくということですね。

岡野原 そうです。まさに今、非常に重要なところを話してもらいました。人間ですとどうしても、こういう...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
(会員の方に広告は表示されません)
「科学と技術」でまず見るべき講義シリーズ
「進化」への誤解…本当は何か?(1)進化の意味と生物学としての歴史
実は生物の「進化」とは「物事が良くなる」ことではない
長谷川眞理子
Beyond5G・6Gで進む情報通信の民主化(1)情報通信の民主化と「協創」
6Gの研究開発を推進する情報通信の民主化
中尾彰宏
進化的人間考~ヒトの性質と異様な現代社会(1)進化のスパンと現在の人間生活
ヒトの進化史を文明の発展の時間軸から考える
長谷川眞理子
生成AI・大規模言語モデルのしくみ(1)生成AIとは何か
10年で劇的な進歩を遂げた生成AIと日本の開発事情
岡野原大輔
ブラックホールとは何か(1)私たちが住む銀河系
太陽系は銀河系の中で塵のように小さな存在でしかない
岡朋治
水から考える「持続可能」な未来(1)気候変動の現在地
最悪10メートル以上海面上昇…将来に禍根残す温暖化の影響
沖大幹

人気の講義ランキングTOP10
中国史概説~『皇帝たちの中国』を読む(1)なぜ「中国史はつまらない」のか?
驚きの中国史~「中国史はつまらない」という通説の裏の波乱の真実
宮脇淳子
ラカンの精神分析~心の謎を解き明かす(6)オープンダイアローグと過程の重視
治さないと治る!?オープンダイアローグは逆説でできている
斎藤環
日本の財政の真実を検証する(1)膨らむ借金の知られざる実態
日本の財政の「真実」をデータで徹底検証…国際機関の分析は?
宮本弘曉
AI時代にリベラルアーツがなぜ必要か(7)自分の人生のために
AI時代こそAIでなく「生きた学び」で自分の人生を膨らませる
橋爪大三郎
編集部ラジオ2026(20)W杯に想う聖徳太子の「和」の力
【10minで考える】W杯と聖徳太子流・勝利への「和の力」の真実
テンミニッツ・アカデミー編集部
AI大格差~最新研究による仕事と給料の未来(1)最新研究から見えてくる未来像
AI大格差…なぜ日本の雇用環境では「ショックが大きい」のか?
宮本弘曉
ギリシア神話の基本を知る(1)「ゼウス以前」の神々の戦い
ギリシア神話…ゼウスの「父親殺し」とオリュンポス十二神
鎌田東二
会社人生「50代の壁」(1)“9の坂”とまさかの坂
サラリーマン人生「50代の壁」を乗り越える生き方
江上剛
老子の神髄(2)達人の境地と「無為」
無為とは「絶対なる喜びを得る」こと…その境地こそ長寿への秘訣
田口佳史
知られざる「脳」の仕組み~脳研究の最前線(1)脳科学と「ミクロのマクロの隔たり」
脳が生きている、死んでいるとは?最新研究で迫る脳の秘密
毛内拡