生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
第1話へ
▶ この講義を再生
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
(会員の方に広告は表示されません)
生成AIの推論術、鍵となる「宝くじ仮説」と注意機構とは
生成AI・大規模言語モデルのしくみ(4)「自己教師あり学習」のしくみ
岡野原大輔(株式会社Preferred Networks 共同創業者、代表取締役 最高研究責任者)
「自己教師あり学習」によって、出力の精度を高める生成AI。その学習の過程では、いったいどのようなプロセスが行われているのだろうか。そのことについて、わかりやすく解説していく。さらに、実はAIは、「宝くじ仮説」で大量のデータを元にした無数の仮説を削っていったり、「注意機構」と呼ばれるしくみによって必要な情報を取り出したりしているという。いったいどういうことなのか。生成AIの推論術を解説する。(全6話中第4話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:9分25秒
収録日:2024年4月16日
追加日:2024年7月30日
≪全文≫

●周辺情報を分析してふさわしい単語を推測する


―― そういうパターンが実際にどういうふうにできているのかというのは、また次のところですね。

岡野原 そうですね。ここに具体的に例文を挙げて、どれくらい理解していないと、ここは当てられないかという話をさせていただければと思います。

 ここに例文で挙げているのは、「こうしたことから、私は父と一緒に***へ行き相談した」です。この「***」の部分を当てるという話なのですけれど、この部分を当てようと思った場合に、ヒントはいっぱい周りにあるわけです。例えば、「私」と「父」という言葉が出ているので、私が何者か――たとえば私が先生だとか、父が実は病気がちだとか――、そういう情報がもし分かっていれば、「ここは病院ではないか」と当たりそうですよね。

 そういう形で、周りの文章の中でヒントになっている情報があって、それがあれば、少しでもここに入ってくる単語を当てられる可能性が上がります。

 ここで重要なのは「少しでも」ということで、間違えるたびに、大規模言語モデルはせっせと「何が悪かったのか」「どこでヒントを使えたのか」ということを、たくさんのパラメータの中で持っていて、そこのパラメータを次から使うように変えようということが起きてくるのです。

 しかも、今話した「私」とか「父」とか「こうしたことから」というのは、この場では書かれていなくて、それより前の部分に書かれています。「私」は前で登場して、その周辺の文章ではどう言っていたのかということも、情報を集めて持ってこなければいけないのです。

 例えば、こういう文章を読もうとしたときに、今のような、「どの単語がどの単語と関係していて、こういう係り受け関係だ、意味は何か」ということを、それこそ言語の専門家の方が設計してやっていたのが、今言った話を全部、人間が何も与えなくてもたくさんの単語を予測するという問題を解くだけで勝手に獲得していくというのが、大規模言語モデルが内部でやっている「自己教師あり学習」になります。

―― 岡野原さんの本を読んでいてもすごく印象深かったのですが、だから人間からすると、なぜそうなっているのかということが分からないのですよね。

岡野原 そうですね。今はもう少し技術が進んでいるので、実際に学習したモデルを解剖し...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
(会員の方に広告は表示されません)
「科学と技術」でまず見るべき講義シリーズ
発酵はマジックだ!
色を消し、脂を溶かし、水を分解―スゴすぎる発酵の力!
小泉武夫
もっと知りたいイヌのこと(1)イヌの歴史を振り返る
オオカミはいつイヌになったか…犬の起源と家畜化の歴史
長谷川眞理子
レアメタルの光と影(1)イントロ
イノベーションがレアメタルをコモンメタルにする
岡部徹
進化的人間考~ヒトの性質と異様な現代社会(1)進化のスパンと現在の人間生活
ヒトの進化史を文明の発展の時間軸から考える
長谷川眞理子
火山の仕組みを知る(1)火山の世界的分布と噴火の仕組み
火山噴火が起こるメカニズムと日本の火山の特徴
藤井敏嗣
ブラックホールとは何か(1)私たちが住む銀河系
太陽系は銀河系の中で塵のように小さな存在でしかない
岡朋治

人気の講義ランキングTOP10
AI大格差~最新研究による仕事と給料の未来(1)最新研究から見えてくる未来像
AI大格差…なぜ日本の雇用環境では「ショックが大きい」のか?
宮本弘曉
イラン戦争と終末論(1)イラン戦争の戦略的背景と米国の政策
なぜイラン戦争がこのタイミングなのか?戦略的背景に迫る
東秀敏
編集部ラジオ2026(14)小宮山宏先生:知識の構造化のために
【10min名作探訪】テンミニッツ・アカデミーの意義と発想法
テンミニッツ・アカデミー編集部
ロシアのハイブリッド戦争と旧ソ連諸国(1)ロシアの勢力圏構想とNATO拡大
「ハイブリッド戦争」の実像…ロシアが考えていることとは何か?
廣瀬陽子
教養としての「ユダヤ人の歴史とユダヤ教」(1)ユダヤ人とは誰のことか
ユダヤ人とは?なぜ差別?お金持ち?…『ユダヤ人の歴史』に学ぶ
鶴見太郎
小澤開作と満洲事変・日中戦争(1)少年時代の苦労と五族協和の夢
満洲で「五族協和」に命を懸けた小澤征爾の父・小澤開作
小澤俊夫
インフレの行方…歴史から将来を予測する(1)インフレの具体像を探る
270年の物価の歴史に学べ…急激な物価上昇期の特徴と教訓
養田功一郎
本質から考えるコンプライアンスと内部統制(1)「法令遵守」でリスクは管理できない
「コンプライアンス=法令遵守」ではない…実例が示す本質
國廣正
「逆・タイムマシン経営論」で見抜く思考の罠(3)飛び道具トラップと「文脈剥離」
IT業界で次々に発動される飛び道具トラップのメカニズム
楠木建
知識の構造化のために(1)テンミニッツTVの問題意識
「知識の爆発」の時代、不可欠なのは世界の全体像の把握
小宮山宏