生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
▶ 第1話を無料視聴する
閉じる
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
(会員の方に広告は表示されません)
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
生成AIによる出力の精度を飛躍的に向上させた大規模言語モデル。はたしてこれまでの言語モデルとはどのような違いがあるのか。1940年代に出た言語モデルの原型を手始めにその仕組みを解説しながら、大規模言語モデルの画期性を解き明かす。キーワードは「自己教師あり学習」だ。(全6話中第3話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:10分14秒
収録日:2024年4月16日
追加日:2024年7月23日
≪全文≫

●単語の出現確率から文章を生成した初期の言語モデル


―― そういう話になってくると、ますます、どうやってそういう能力をいわゆるAIが身につけていくのかというところを、まず知った上でないと判断が難しいと思うのですが、早速その話に入っていきたいと思います。

 まず挙げていただいた言語モデルというところですね。これはどういうことになりますでしょうか。

岡野原 大規模言語モデルの「言語モデル」という部分に関して、まず説明させていただきます。

 言語モデル(ランゲージモデル)というのは、今の大規模言語モデルがこれだけブームになるよりずっと前からある分野です。それこそ、情報理論を発明して、今のコンピュータの礎をつくったシャノンという有名な研究者が1940年代に出したいちばん最初の情報理論の論文にも、その言語モデルの原型が出ています。

 この言語モデルでは、今のような文章を丸ごと生成するのは難しいので、1単語ずつ順番に生成していきます。まず最初に、いろいろあり得る単語の候補の中で「私」というのが出る確率を出すようなモデルを用意します。

 例えば、「私」というのはありとあらゆる単語の中で0.005の確率で出現する(とする)。いちばん出やすいのは、例えば「東京」とか、もっと別の単語かもしれないですけれど、たまたまサイコロを振ったら「私」が出る確率が0.005と設定します。次に、「私」の次に何の単語が出やすいかという確率を用意します。例えば「は」が0.02(の確率で)出る(とする)。

 こういうふうに、何か文字列を生成しよう、確率を与えようという場合に、まず1単語目がどういう確率で出るか。次に、1単語目に決めたものの次の2単語目に何が出やすいかということで決める。3単語目は、1単語目と2単語目の次に何が出やすいのかということを決める。こういう形で、単語列というものに対して、これがサイコロを振ったらどれくらいの確率で出るのかということを出せるようなモデルが、言語モデルになっています。

―― そうすると、その先ほどから意味の部分の話をしていますけれど、(むしろ)意味というよりは、確率でどれが確からしいかというところで並べ替えていくということですね。

岡野原 そうです。まさに今、非常に重要なところを話してもらいました。人間ですとどうしても、こういう...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
(会員の方に広告は表示されません)
「科学と技術」でまず見るべき講義シリーズ
社会はAIでいかに読み解けるのか(1)経済学理論の役割
AIやディープラーニングによって社会分析の方法が変わる
柳川範之
培養肉研究の現在地と未来図(1)フェイクミート市場とリアルミート研究
食肉3.0時代に突入、「培養肉」研究の今に迫る
竹内昌治
もっと知りたいイヌのこと(1)イヌの歴史を振り返る
オオカミはいつイヌになったか…犬の起源と家畜化の歴史
長谷川眞理子
性はなぜあるのか~進化生物学から見たLGBT(1)有性生殖と無性生殖
なぜ雄と雌の2つの性別があるのか…「性」の謎とLGBT
長谷川眞理子
新しい循環文明への道(1)採掘文明から循環文明へ
2026年頭所感~循環文明の「三つの柱」…いよいよ実現へ
小宮山宏
本当によくわかる「量子コンピュータ入門」(1)量子コンピュータとは何か
「量子コンピュータ」はどういうもので、何に使えるのか
武田俊太郎

人気の講義ランキングTOP10
これから必要な人材と人材教育とは?(1)人手の供給不足とマクロ経済への影響
ごく一部の人手不足が「致命的」になる…Oリング・セオリー
柳川範之
インフレの行方…歴史から将来を予測する(5)トルコ化の可能性と円安の要因
年率80%を超えるインフレ!…日本は「トルコ化」するか?
養田功一郎
「Fukushima50」の真実…その素顔と誇り(4)ベントの死闘とプロの責任感
「これからベントをやる。メンバーを決める!」…決死の現場
門田隆将
編集部ラジオ2026(3)高市政権の行方と「明治維新」
高市政権の今後は「明治維新」の歴史から見えてくる!?
テンミニッツ・アカデミー編集部
おもしろき『法華経』の世界(10)未来への智慧と希望
「未来応化=どんな未来も大丈夫」…ブレない臨機応変の力
鎌田東二
高市政権の進むべき道…可能性と課題(4)外交力と防衛力の強化へ
求められる「能動的サイバー防御」、問われる本物の外交力
島田晴雄
こどもと学ぶ戦争と平和(4)人間はなぜ戦争をするのか
人間はなぜ戦争をするのか?2つの要因から問う平和の条件
小原雅博
平和の追求~哲学者たちの構想(7)いかに平和を実現するか
国際機関やEUは、あまり欲張らないほうがいいのでは?
川出良枝
エネルギーと医学から考える空海が拓く未来(6)曼荼羅の世界と未来のネットワーク
命は光なのだ…曼荼羅を読み解いて見えてくる空海のすごさ
鎌田東二
AI時代と人間の再定義(6)道徳の起源から考えるAIと感情の問題
道徳の起源は理性か感情か?…AI時代に必要な思考の身体性
中島隆博