生成AI・大規模言語モデルのしくみ
この講義シリーズは第2話まで
登録不要無料視聴できます!
▶ 第1話を無料視聴する
閉じる
この講義の続きはもちろん、
5,000本以上の動画を好きなだけ見られる。
スキマ時間に“一流の教養”が身につく
まずは72時間¥0で体験
大規模言語モデルを成功させた要因「Transformer」とは
生成AI・大規模言語モデルのしくみ(5)言語モデルの大規模化とTransformer
岡野原大輔(株式会社Preferred Networks 代表取締役社長)
大規模言語モデルを成功させた要因の1つに“Transformer”と呼ばれる言語モデルの登場がある。Transformerは、必要な情報を取り出す「注意機構」と、長期的な記憶から情報を探索する「MLPブロック」によって構成されるのだが、この“Transformer”の場合は、大規模化することで、どこまで性能が上がるかがクリアにわかるようになった。それが「べき乗則」と呼ばれるものである。そして、さらに予想外のことも起こっているという。いったいどういうことなのか。Transformerモデルの画期性とともにその詳細を解説する。(全6話中第5話)
※インタビュアー:川上達史(テンミニッツTV編集長)
時間:8分39秒
収録日:2024年4月16日
追加日:2024年8月6日
≪全文≫

●自己注意機構とMLPブロックで構成される“Transformer”モデル


―― 次にTransformerというところですね。

岡野原 そうですね。このTransformerが、今(第5話で)説明した「注意機構」と、もう1つ、記憶の主翼を担っている「MLPブロック」と呼ばれるモデルで構成されています。ちなみにこのTransformerがある種、今の大規模言語モデルを成功させた主要因の1つだといわれています。

 このTransformerも、「注意」のしくみを元にすると簡単な話で、中身は2つからなっています。

 1つは説明した「注意」、どこから情報を持ってくるのかという部分です。では「注意」でどこから情報を持ってきますかというと、前のときの、どこかの自分の処理の途中結果を取ってくるのです。これがたくさんあって、自分の処理の途中結果を集めてくる。例えば、「彼」というところにあるブロックの周りから、この「彼」というところに情報を集めてくる。(つまり)「彼」に関する情報を集めてくるのです。

 次に、「彼」に溜まっている情報と別の場所の単語を「この情報、自分がほしいから取ってください」というように、「自己注意機構」でどんどん情報を行き来させる。これが1つです。

 もう1つ、この(スライドの)右側の「MLPブロック」というのは何を実現しているかというと、長期記憶です。今見ている文章ではない、過去に読んだ文章でも、たくさん役に立つ情報はもちろんあるわけです。例えば、「病院というのはこういう機能を持っていますよ」だとか、「こういう人が行きやすいですね」だとか、そういう情報がものすごく大量に詰まっているのです。

 Transformerは、この2つが、たくさん組み合わさってできているモデルになっている。次の単語を予測するために、「自己注意機構」で周りからどんどん必要な情報を集めてくる。さらには、今の文章ではない、昔読んだ文章からもどんどん情報を持ってこなければいけないということで、「MLPブロック」からも情報を集める。これが100層とか、何回も処理されて、ここまでやってようやく1つの単語を予測するというモデルになっています。

―― なるほど。今のお話を聞いていると、たしかに「理解」というものにだいぶ近くなっている気がしますね。

岡野原 そうですね。なので、1個1個がやっていること自体は、ものすごく単純な...

スキマ時間でも、ながら学びでも
第一人者による講義を1話10分でお届け
さっそく始めてみる
「科学と技術」でまず見るべき講義シリーズ
「進化」への誤解…本当は何か?(1)進化の意味と生物学としての歴史
実は生物の「進化」とは「物事が良くなる」ことではない
長谷川眞理子
「宇宙の創生」の仕組みと宇宙物理学の歴史(1)宇宙の階層構造
「宇宙の階層構造」誕生の謎に迫るのが宇宙物理学のテーマ
岡朋治
ChatGPT~AIと人間の未来(1)ChatGPTは何ができて、何ができないか
ChatGPTは考えてない?…「AIの回答」の本質とは
西垣通
本当によくわかる「量子コンピュータ入門」(1)量子コンピュータとは何か
「量子コンピュータ」はどういうもので、何に使えるのか
武田俊太郎
ヒトの性差とジェンダー論(1)「性」とは何か
MLBのスーパースターも一代限り…生物学から迫る性の実態
長谷川眞理子
培養肉研究の現在地と未来図(1)フェイクミート市場とリアルミート研究
食肉3.0時代に突入、「培養肉」研究の今に迫る
竹内昌治

人気の講義ランキングTOP10
新しい循環文明への道(1)採掘文明から循環文明へ
2026年頭所感~循環文明の「三つの柱」…いよいよ実現へ
小宮山宏
豊臣兄弟~秀吉と秀長の実像に迫る(5)羽柴軍団の戦い方
長期包囲戦が得意!?“軍事的天才”秀吉の戦い方の特徴
黒田基樹
逆境に対峙する哲学(6)分別からの超越
ネガティブ・ケイパビリティとは?信じて待つことの意味
津崎良典
「進化」への誤解…本当は何か?(1)進化の意味と生物学としての歴史
実は生物の「進化」とは「物事が良くなる」ことではない
長谷川眞理子
折口信夫が語った日本文化の核心(1)「まれびと」と日本の「おもてなし」
「まれびと」とは何か?折口信夫が考えた日本文化の根源
上野誠
過激化した米国~MAGA内戦と民主党の逆襲(1)米国の過激化とそのプロセス
MAGA内戦、DSAの台頭…過激化が完了した米国の現在地
東秀敏
生成AI「Round 2」への向き合い方(1)生成AI導入の現在地
生成AIの利活用に格差…世界の導入事情と日本の現状
渡辺宣彦
内側から見たアメリカと日本(1)ラストベルトをつくったのは誰か
日本でも中国でもない…ラストベルトをつくった張本人は?
島田晴雄
生成AI・大規模言語モデルのしくみ(3)言語モデルと「自己教師あり学習」
正解がタダ!?大規模言語モデルの「自己教師あり学習」とは
岡野原大輔
「アメリカの教会」でわかる米国の本質(1)アメリカはそもそも分断社会
「キリスト教は知らない」ではアメリカ市民はつとまらない
橋爪大三郎