生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
第1話へ
▶ この講義を再生
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
(会員の方に広告は表示されません)
生成AIの推論術、鍵となる「宝くじ仮説」と注意機構とは
生成AI・大規模言語モデルのしくみ(4)「自己教師あり学習」のしくみ
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
「自己教師あり学習」によって、出力の精度を高める生成AI。その学習の過程では、いったいどのようなプロセスが行われているのだろうか。そのことについて、わかりやすく解説していく。さらに、実はAIは、「宝くじ仮説」で大量のデータを元にした無数の仮説を削っていったり、「注意機構」と呼ばれるしくみによって必要な情報を取り出したりしているという。いったいどういうことなのか。生成AIの推論術を解説する。(全6話中第4話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:9分25秒
収録日:2024年4月16日
追加日:2024年7月30日
≪全文≫

●周辺情報を分析してふさわしい単語を推測する


―― そういうパターンが実際にどういうふうにできているのかというのは、また次のところですね。

岡野原 そうですね。ここに具体的に例文を挙げて、どれくらい理解していないと、ここは当てられないかという話をさせていただければと思います。

 ここに例文で挙げているのは、「こうしたことから、私は父と一緒に***へ行き相談した」です。この「***」の部分を当てるという話なのですけれど、この部分を当てようと思った場合に、ヒントはいっぱい周りにあるわけです。例えば、「私」と「父」という言葉が出ているので、私が何者か――たとえば私が先生だとか、父が実は病気がちだとか――、そういう情報がもし分かっていれば、「ここは病院ではないか」と当たりそうですよね。

 そういう形で、周りの文章の中でヒントになっている情報があって、それがあれば、少しでもここに入ってくる単語を当てられる可能性が上がります。

 ここで重要なのは「少しでも」ということで、間違えるたびに、大規模言語モデルはせっせと「何が悪かったのか」「どこでヒントを使えたのか」ということを、たくさんのパラメータの中で持っていて、そこのパラメータを次から使うように変えようということが起きてくるのです。

 しかも、今話した「私」とか「父」とか「こうしたことから」というのは、この場では書かれていなくて、それより前の部分に書かれています。「私」は前で登場して、その周辺の文章ではどう言っていたのかということも、情報を集めて持ってこなければいけないのです。

 例えば、こういう文章を読もうとしたときに、今のような、「どの単語がどの単語と関係していて、こういう係り受け関係だ、意味は何か」ということを、それこそ言語の専門家の方が設計してやっていたのが、今言った話を全部、人間が何も与えなくてもたくさんの単語を予測するという問題を解くだけで勝手に獲得していくというのが、大規模言語モデルが内部でやっている「自己教師あり学習」になります。

―― 岡野原さんの本を読んでいてもすごく印象深かったのですが、だから人間からすると、なぜそうなっているのかということが分からないのですよね。

岡野原 そうですね。今はもう少し技術が進んでいるので、実際に学習したモデルを解剖し...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
(会員の方に広告は表示されません)
「科学と技術」でまず見るべき講義シリーズ
もっと知りたいイヌのこと(1)イヌの歴史を振り返る
オオカミはいつイヌになったか…犬の起源と家畜化の歴史
長谷川眞理子
火山の仕組みを知る(1)火山の世界的分布と噴火の仕組み
火山噴火が起こるメカニズムと日本の火山の特徴
藤井敏嗣
Beyond5G・6Gで進む情報通信の民主化(1)情報通信の民主化と「協創」
6Gの研究開発を推進する情報通信の民主化
中尾彰宏
水から考える「持続可能」な未来(1)気候変動の現在地
最悪10メートル以上海面上昇…将来に禍根残す温暖化の影響
沖大幹
知能と進化(1)知性と身体性
AI、ディープラーニングとは…知能と身体性は不可分か?
長谷川眞理子
ChatGPT~AIと人間の未来(1)ChatGPTは何ができて、何ができないか
ChatGPTは考えてない?…「AIの回答」の本質とは
西垣通

人気の講義ランキングTOP10
編集部ラジオ2026(20)W杯に想う聖徳太子の「和」の力
【10minで考える】W杯と聖徳太子流・勝利への「和の力」の真実
テンミニッツ・アカデミー編集部
中国史概説~『皇帝たちの中国』を読む(1)なぜ「中国史はつまらない」のか?
驚きの中国史~「中国史はつまらない」という通説の裏の波乱の真実
宮脇淳子
老子の神髄(2)達人の境地と「無為」
無為とは「絶対なる喜びを得る」こと…その境地こそ長寿への秘訣
田口佳史
AI時代にリベラルアーツがなぜ必要か(7)自分の人生のために
AI時代こそAIでなく「生きた学び」で自分の人生を膨らませる
橋爪大三郎
重職心得箇条~管理職は何をなすべきか(2)一途と覚悟で道を究める
自己鍛錬を目指す人に知ってほしい数々の名言
田口佳史
日本の財政の真実を検証する(1)膨らむ借金の知られざる実態
日本の財政の「真実」をデータで徹底検証…国際機関の分析は?
宮本弘曉
ラカンの精神分析~心の謎を解き明かす(5)否定神学とラカン理論の限界
暴いてはいけない!?心を理解する上で重要な「否定神学」とは
斎藤環
キケロ『老年について』を読む(1)キケロの評価と「老年の心構え」
幸福な老年への智恵をキケロに学ぶ…惨めな老年の4つの理由とは
本村凌二
認知症とは何か(1)疾患の種類と対応
多くの認知症の原因は「脳のゴミ」の蓄積
遠藤英俊
なぜ働いていると本が読めなくなるのか問答(1)読書と教養からみた日本の近現代史
『なぜ働いていると本が読めなくなるのか』で追う近現代史
三宅香帆