生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
第1話へ
▶ この講義を再生
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
(会員の方に広告は表示されません)
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
生成AIによる出力の精度を飛躍的に向上させた大規模言語モデル。はたしてこれまでの言語モデルとはどのような違いがあるのか。1940年代に出た言語モデルの原型を手始めにその仕組みを解説しながら、大規模言語モデルの画期性を解き明かす。キーワードは「自己教師あり学習」だ。(全6話中第3話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:10分14秒
収録日:2024年4月16日
追加日:2024年7月23日
≪全文≫

●単語の出現確率から文章を生成した初期の言語モデル


―― そういう話になってくると、ますます、どうやってそういう能力をいわゆるAIが身につけていくのかというところを、まず知った上でないと判断が難しいと思うのですが、早速その話に入っていきたいと思います。

 まず挙げていただいた言語モデルというところですね。これはどういうことになりますでしょうか。

岡野原 大規模言語モデルの「言語モデル」という部分に関して、まず説明させていただきます。

 言語モデル(ランゲージモデル)というのは、今の大規模言語モデルがこれだけブームになるよりずっと前からある分野です。それこそ、情報理論を発明して、今のコンピュータの礎をつくったシャノンという有名な研究者が1940年代に出したいちばん最初の情報理論の論文にも、その言語モデルの原型が出ています。

 この言語モデルでは、今のような文章を丸ごと生成するのは難しいので、1単語ずつ順番に生成していきます。まず最初に、いろいろあり得る単語の候補の中で「私」というのが出る確率を出すようなモデルを用意します。

 例えば、「私」というのはありとあらゆる単語の中で0.005の確率で出現する(とする)。いちばん出やすいのは、例えば「東京」とか、もっと別の単語かもしれないですけれど、たまたまサイコロを振ったら「私」が出る確率が0.005と設定します。次に、「私」の次に何の単語が出やすいかという確率を用意します。例えば「は」が0.02(の確率で)出る(とする)。

 こういうふうに、何か文字列を生成しよう、確率を与えようという場合に、まず1単語目がどういう確率で出るか。次に、1単語目に決めたものの次の2単語目に何が出やすいかということで決める。3単語目は、1単語目と2単語目の次に何が出やすいのかということを決める。こういう形で、単語列というものに対して、これがサイコロを振ったらどれくらいの確率で出るのかということを出せるようなモデルが、言語モデルになっています。

―― そうすると、その先ほどから意味の部分の話をしていますけれど、(むしろ)意味というよりは、確率でどれが確からしいかというところで並べ替えていくということですね。

岡野原 そうです。まさに今、非常に重要なところを話してもらいました。人間ですとどうしても、こういう...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
(会員の方に広告は表示されません)
「科学と技術」でまず見るべき講義シリーズ
本当によくわかる「量子コンピュータ入門」(1)量子コンピュータとは何か
「量子コンピュータ」はどういうもので、何に使えるのか
武田俊太郎
もっと知りたいイヌのこと(1)イヌの歴史を振り返る
オオカミはいつイヌになったか…犬の起源と家畜化の歴史
長谷川眞理子
ブラックホールとは何か(1)私たちが住む銀河系
太陽系は銀河系の中で塵のように小さな存在でしかない
岡朋治
火山の仕組みを知る(1)火山の世界的分布と噴火の仕組み
火山噴火が起こるメカニズムと日本の火山の特徴
藤井敏嗣
水から考える「持続可能」な未来(1)気候変動の現在地
最悪10メートル以上海面上昇…将来に禍根残す温暖化の影響
沖大幹
発酵はマジックだ!
色を消し、脂を溶かし、水を分解―スゴすぎる発酵の力!
小泉武夫

人気の講義ランキングTOP10
デジタル全体主義を哲学的に考える(1)デジタル全体主義とは何か
20世紀型の全体主義とは違う現代の「デジタル全体主義」
中島隆博
教養としての「ユダヤ人の歴史とユダヤ教」(8)シオニズムとユダヤ教
シオニズムは伝統的なユダヤ教とは異質…イスラエル建国の背景
鶴見太郎
編集部ラジオ2026(12)自転車の青切符と「法と自粛」
【10minで考える】自転車の青切符と「法と自粛」
テンミニッツ・アカデミー編集部
お金とは何か?…金本位制とビットコイン(5)ゴールドや暗号通貨への評価
ゴールドやビットコインへの評価は?…現代社会の写し鏡
養田功一郎
小林秀雄と吉本隆明―「断絶」を乗り越える(1)「断絶」を乗り越えるという主題
小林秀雄と吉本隆明の営為とプラグマティズムの格率
浜崎洋介
高市政権の進むべき道…可能性と課題(2)財政戦略3つの問題点
高市政権の財政政策の課題は…ポピュリズム政策をどうする?
島田晴雄
日本人とメンタルヘルス…心のあり方(6)日本人の当たり前と山本七平の違和感
日本の異様さ…フィリピンから復員した山本七平が驚いたこと
與那覇潤
新撰組と幕末日本の「真実」(5)主要隊士、そして羽織や旗の実像
沖田総司、山南敬助、永倉新八、斎藤一…彼らの実像とは?
堀口茉純
インフレの行方…歴史から将来を予測する(4)10年後の物価…5つのシナリオ
5つのシナリオ分析…10年後の日本の物価水準はどうなる?
養田功一郎
AI時代と人間の再定義(2)仏法僧の三宝と対話による道徳的進歩
考えるとは相手の頭を使って考えること…共同で思考する意義
中島隆博