AIを賢くしたのは、哲学者ではなく赤ちゃんだった——脳科学から生まれたディープラーニング革命の全貌

『ディープラーニング革命』(2018年)は、少数の研究者たちが人間の脳の実際の学習メカニズムを研究することで人工知能を変革した物語を語ります。ルールベースのプログラミングからデータ駆動型のニューラルネットワークへの転換を探り、この生物学的アプローチが、音声アシスタントから自動運転車に至るまで、現代のAI技術を生み出した経緯を明らかにします。

この本から得られるもの:今日のAI革命を可能にした、脳科学の意外な秘密

幼児が顔を認識できるようになる様子を見ていると、脳の中で「目の間隔」や「鼻の形」といった複雑なルールに従っているわけではないことがわかります。何千、何万もの画像を吸収し、少しずつ認識力を築いていくのです。何十年もの間、コンピュータ科学者たちは正反対のアプローチを試みてきました。顔がどういうものかを機械に教えるため、延々とルールを書き続けたのです。しかし結果は期待外れでした。そしてある時、少数の研究者グループが過激なアイデアを思いつきます。コンピュータも赤ちゃんのように学べるのではないか——と。

知能をプログラムするのではなく、データから育てることはできないだろうか?このアイデアがすべてを変えました。今では、スマートフォンが言語をリアルタイムで翻訳し、車は自動運転し、コンピュータは従来のプログラミングだけでは絶対に攻略できないほど複雑なゲームで世界チャンピオンを打ち負かします。音声アシスタントはこちらの質問を理解し、自然に応答するまでになっています。

この革命は、脳科学者と先駆的なコンピュータ技術者が肩を並べて働き、脳が実際にどう学ぶのかを研究する研究室から始まりました。その成果とは何だったのでしょうか。自然が何百万年もの歳月をかけて進化させてきたものを、人工知能はわずか数十年で達成したのです。本記事では、機械のディープラーニングの発展の物語をたどり、生物学が秘める力と、シリコンチップと生きたニューロンの間に存在する驚くべき類似性を明らかにしていきます。

1980年代の反逆者たち

1980年代のAI業界を大聖堂にたとえるなら、誰もが同じ祈りをささげていました。「もっとルールを、もっと大きなデータベースを、もっと速い論理を」と。人工知能の高位聖職者たちは、コンピュータは哲学者のように考え、記号を処理し、厳格な論理的枠組みに従うべきだと信じていました。コンピュータに猫を認識させたければ、ひげ、とがった耳、毛の模様についてのルールをプログラムするのです。このアプローチは論理的で、エレガントにさえ見えました。

何しろ人間は自分の推論を説明できるのですから、機械も同じようにすべきだ——そう思われていました。問題はひとつだけ。それがほとんど機能しなかったことです。AIの主流派が記号推論にさらに傾倒する一方で、少数の異端者たちが陰で集まっていました。彼らにはとんでもない考えがありました。コンピュータは哲学者のように考えるべきではない、赤ちゃんのように考えるべきなのだと。テリー・セノフスキーはそんな反逆者の一人でした。ジェフリー・ヒントンらとともに研究を進める中で、彼は史上最も成功した知能システムに目を向け、シンプルな問いを投げかけました。脳は実際にどう働いているのか、と。

その答えは驚くべきものでした。脳はプログラムされたルールに従うのではなく、何十億ものシンプルなニューロンがつながり、つなぎ直しながら、経験から学んでいたのです。自転車に乗ることを考えてみてください。バランスのルールをプログラムすることはできません。それでも脳は練習を通じてコツをつかんでいきます。転んで、調整して、また転んで、また調整する。やがて神経ネットワークがバランス成功のパターンを符号化します。誰も一行のルールも書いていないのに、です。

AIの反逆者たちはこのアプローチをコネクショニズム(結合主義)と呼び、AIの主流派はそれを嫌悪しました。大学の研究資金は枯渇し、学会は論文を拒否しました。批評家たちはニューラルネットワークを行き止まりだと切り捨てました。本当の知能を実現するにはあまりに単純すぎる、と。しかし反逆者たちは気づいていました。従来のAIを挫折させた問題を、自然はすでにすべて解決していたのです。鳥は視覚でナビゲーションし、赤ちゃんは音を聞いて言語を学び、動物は瞬間的に危険を認識します。

どのプログラマーも、論理のルールで彼らにこれらのスキルを教えたわけではありません。すべての人間の頭の中にある生物学的コンピュータが、発話、視覚、複雑な推論をマスターできるなら、シリコンチップにできない理由があるでしょうか?初期のAI反逆者たちは、秘密は優れたプログラミングではなく、優れた学習にあると確信していました。彼らが正しかったことはすぐに証明されます。しかしその前に、生物学的学習が実際にどう機能しているのか、その暗号を解く必要がありました。答えは、既知の宇宙で最も神秘的な約1.4キログラムの物質——人間の脳——の研究からもたらされることになります。

生物学から学ぶ

雑音の多い電話越しに祖母の声を認識できるようになる過程を想像してみてください。脳は声の高さやアクセントのパターンの記録を参照しているわけではありません。代わりに、はるかにエレガントなことが起きています。彼女の声を聞くたびに、何百万もの神経結合が強化され、別の結合は消えていきます。やがて脳は、雑音があっても機能する、彼女の声の独自の指紋を構築していくのです。セノフスキーやヒントンのようなAI反逆者たちを魅了したのは、まさにこの仕組みでした。

彼らが発見したのは、生物学的学習が巨大な民主主義のように機能しているということでした。シンプルなニューロンたちが、自分たちが経験していることについて投票するのです。単一のニューロンがすべての答えを持っているわけではありませんが、相互につながることで知能が生まれます。彼らは、こうした生物学的ネットワークを人工的にプログラムしたバージョンを作り始めました。経験に基づいて結合を強めたり弱めたりできる数学的ニューロン——本物の脳細胞と同じようにです。こうしたネットワークに何千もの例を与えると、驚くべきことが起きました。人工ニューロンが、明示的にプログラムされることなく、自ら組織化してパターンを認識し始めたのです。混雑した空港で友人を見つけられるようになるのと同じだと考えればいいでしょう。

脳は特徴のチェックリストに従っているわけではありません。全体像を一度に処理し、身長、歩き方、姿勢を組み合わせて即座に認識します。AI反逆者たちは、同じように機能するネットワークを構築しました。情報を層状に処理し、徐々に理解を積み上げていくのです。ひとつのブレイクスルーは、脳が矛盾する情報をどう処理するかの研究から生まれました。本物のニューロンは時にランダムに発火します。まるでコインを投げているかのように。これは欠陥のように思われましたが、研究者たちはそれが実は機能であることに気づいたのです。

ランダム性は、脳が悪い解から抜け出し、より良い解を見つけるのに役立ちます。びんに入ったビー玉を振って、最も効率的な配置に落ち着かせるようなものです。セノフスキーとヒントンはこの洞察をボルツマンマシンと呼ばれるものに結実させました。粒子が安定した配置を見つける過程を研究した物理学者にちなんだ名前です。これらの人工ネットワークは、さまざまな解を試し、徐々に最良のものへと落ち着いていくことで学習できました。脳がパズルを解くときにするのと同じように。しかし本当の革命は、学習メカニズムそのものを解明したときに訪れました。彼らは、人工ネットワークが間違いを犯したときに自動的に結合を調整する方法を見いだしたのです。正解につながる経路を強化し、そうでない経路を弱める仕組みです。

バックプロパゲーション(誤差逆伝播法)と呼ばれるこのプロセスは、ネットワークに自らの誤りから学ぶことを教えるようなものでした。鍵となる洞察は深遠でした。知能とはルールに従うことではなく、膨大なデータの中からパターンを見つけることなのです。生物学的脳に十分な例を与えれば、見て、聞いて、理解することを学びます。人工ネットワークに十分な例を与えれば、同じことができるようになるのです。

ブレイクスルーの瞬間

何十年もの間、AI反逆者たちは機械学習を進歩させる正しいアイデアを持っていましたが、それを証明するための圧倒的な計算能力を欠いていました。彼らのニューラルネットワークは、自転車用エンジンを搭載したF1マシンのようなものでした。設計が機能することはわかっていましたが、機械の実力を示すには、はるかに多くの燃料、より大きなエンジン、そしてずっと長いレースコースが必要だったのです。そして、三つの力が収束し、完璧な嵐が生まれました。

第一に、コンピュータチップが指数関数的に高性能化しました。特に、もともとビデオゲーム用に設計されたグラフィックスプロセッサの進歩が決定的でした。これらのチップは何千もの計算を同時に実行できます——ニューラルネットワークがまさに必要としていた能力です。第二に、インターネットの爆発的普及が膨大なデータを生み出しました。アップロードされるすべての写真、すべての検索クエリ、すべてのマウスクリックが、飢えたアルゴリズムの学習材料となったのです。第三に、研究者たちが学習技術を洗練させ、ネットワークをより深く、より高度なものにしていきました。ブレイクスルーの瞬間は、こうして強化されたネットワークに研究者たちが大規模なデータセットを与えたときに訪れました。

突然、人工知能はほんの数年前まで不可能に思えたことをできるようになりました。画像認識で起きたことを考えてみましょう。従来のプログラミングでは、エンジニアがエッジ、角、形などの特徴を手作業でコーディングする必要がありました。それは、コンピュータに実際の猫を一度も見せずに、猫を認識するあらゆる方法を記述しようとするようなものでした。結果はせいぜい凡庸なものでした。しかし、研究者たちが何百万ものラベル付き画像をディープニューラルネットワークに与えると、魔法が起きたのです。

ネットワークは猫、犬、車、顔を超人的な精度で認識できるようになりました。学習画像を単に暗記したのではなく、猫を猫たらしめている本質を抽出したのです。見たことのない猫を、どんな姿勢、どんな照明条件で見せられても、即座に認識します。Google翻訳は一夜にして、ぎこちないフレーズ集からほぼ流暢な翻訳者へと変貌を遂げました。何百万もの翻訳済み文書を分析することで、ディープネットワークは言語間の隠れたパターンを学んでいきました。愛、自由、正義といった概念は、言葉の響きがまったく異なっていても、異なる言語の数学的空間の中で類似した位置を占めていることを発見したのです。

ゲームは最も劇的な証明となりました。2016年、AlphaGoと呼ばれるディープラーニングシステムが、チェスよりも複雑な古代の戦略ゲームである囲碁で世界チャンピオンを破ったのです。囲碁の盤面の可能な状態数は、観測可能な宇宙の原子の数よりも多くなります。従来のプログラミングではそのような複雑さに取り組むことさえできませんでしたが、ディープラーニングはそれを得意としました。自動運転車は実際の道路を走行し始め、一時停止標識、歩行者、他の車両をリアルタイムで認識しました。音声アシスタントは自然な発話を理解し、適切に応答するようになりました。

金融アルゴリズムは人間の専門家が見逃す不正パターンを検出し始めました。AI反逆者たちはこの瞬間を30年間待ち続けていたのです。彼らのネットワークはついに、機械が生物学的脳のように学べることを証明するのに十分な計算力、十分なデータ、十分な洗練度を手に入れました。革命はもはや理論上のものではなく、世界を作り変えていたのです。

人間を人間たらしめるもの

AIの息をのむような進歩にもかかわらず、ひとつの深遠な要素が欠けたままです。現在のシステムは、すべての教科書を暗記したが教室の外に出たことがない、天才的な生徒のようなものです。何百万もの画像を認識し、数十の言語を翻訳し、複雑なゲームで世界チャンピオンを破ることができます。それでも、すべての幼児が持っているものが欠けています。それは、世界の直接的な感覚経験です。2歳児がどう学ぶかを考えてみましょう。

ハイハイし、触り、よじ登り、味わい、探索します。「熱い」という言葉を学ぶとき、それは語彙の中の記号ではなく、熱いコンロから手を引っ込めた記憶と結びついています。この身体化された学習が、現在のAIシステムにはとうてい太刀打ちできない、豊かで相互につながった身体的な理解を生み出すのです。人間の知能は世界との物理的な相互作用から生まれます。物を落とせば落ちることを学び、強く押せば速く動くことを学び、他人には自分とは異なる思考や感情があることを学びます。これらは単純な概念に思えるかもしれませんが、常識の基盤を形成しています。最も高度なAIモデルでさえ苦労している、その常識の基盤を。

晴れた日に誰かが傘を持っている理由を人間に尋ねれば、すぐに「後で雨が降るかもしれないから」と答えるでしょう。同じ質問をAIシステムにすると、概念を真に理解することなく、統計的に尤もらしい答えを返すかもしれません。人間がこの種の直感的な飛躍に長けているのは、私たちの学習が身体的な経験と社会的相互作用に根ざしているからです。感情もまた、人間の知能に本質的な役割を果たしています。恐怖は危険を避けるのに役立ち、好奇心は探求を駆り立て、共感は他者を理解することを可能にします。感情は知能の障害物ではなく、むしろその不可欠な一部なのです。

感情は私たちの注意を導き、記憶を形作り、論理だけでは到底及ばない方法で意思決定に影響を与えます。おそらく最も重要なのは、人間が生涯を通じて学び続けることです。歩くことを覚えた子どもは、階段やでこぼこの地面、雪や氷に遭遇しても動きの適応をやめません。絶えず調整し、過去の経験を土台にしながらも、新しい状況に対処できる柔軟性を保ち続けます。この革命を始めたAI研究者たちは、重要なことを理解していました。人間の知能を研究するのは、それをコピーするためではなく、そもそも学習を可能にしているものを理解するためなのだと。今日、その対話は双方向に流れています。

ディープラーニングの進歩は脳科学者が私たち自身の脳の働きを理解するのに役立っており、生物学的知能についての発見は新たなAIアーキテクチャを刺激し続けています。人工知能と人間の知能の間のギャップは依然として大きいものの、確実に狭まっています。問いは、機械が最終的に人間の知能に追いつくかどうかではなく、シリコンベースとカーボンベースの学習システムが協働するとき、どのような新たな知能の形態が生まれうるか、ということです。

革命は続く

脳の働きを研究する一握りの反逆者たちから始まったディープラーニング革命は、現代を定義するテクノロジーとなりました。それが人間の可能性を高めるのか、社会を混乱させるのかは、今日の私たちの選択に大きくかかっています。シリコンとカーボンの知能の対話は始まったばかりであり、この物語の次の章は、私たち全員で書いていくことになります。科学者たちはすでに、古いことを忘れずに新しい状況に適応しながら、継続的に学習するシステムを開発しています。

医療AIは人間の医師が見逃す病気をX線画像から検出し、ディープラーニングを活用した気候モデルは前例のない精度で気象パターンの予測に貢献しています。パーソナライズされた教育システムは各生徒の学習スタイルに適応し、質の高い教育を世界中のどこでも受けられるようにします。しかし、この急速な進歩は深刻な課題ももたらします。教室では、生徒が数回のキー入力で小論文全体を生成できるようになり、教育者は批判的思考と創造性をどう教えるかの再考を迫られています。学習をより身近にするテクノロジーは、カンニングをも容易にしてしまうのです。雇用市場も同様の混乱に直面しています。

AIシステムはすでにカスタマーサービスの電話対応、法律文書の分析、マーケティングコンテンツの作成を担っています。AI開発や監視の分野で新たな仕事が生まれている一方で、多くの従来型の役割は、人々が再教育を受けるよりも速いペースで消えつつあります。この課題は単なる技術的なものではなく、人間的なものでもあります。何百万人もの労働者が急速に変化する経済に適応することを、私たちはどう支援すればよいのでしょうか?おそらく最も懸念されるのは、AIが説得力のある偽コンテンツを作り出す能力です。ディープラーニングは今や、人が言ったことのないことを言っているリアルな動画を生成し、権威があるように聞こえるが捏造された事実を含むニュース記事を書き、世論を操作するために設計されたソーシャルメディアの投稿を作成できます。誰もが大規模にもっともらしい嘘を作り出せる時代において、真実と虚構を区別することは、重要なサバイバルスキルとなっています。

しかし、同じテクノロジーが解決策も提供します。AIシステムはディープフェイクを検出し、誤情報にフラグを立て、ファクトチェッカーがこれまでより速く主張を検証するのを支援できます。鍵となるのはAI開発を抑制することではなく、それが人間の繁栄を支えるようにすることです。今後を見据えると、研究者たちはディープラーニングのパターン認識と人間のような推論・常識を組み合わせたAIシステムの開発に取り組んでいます。文脈を真に理解するAIアシスタント、見て質問することで学ぶロボット、医師と患者が信頼できる形で診断を説明する医療システムを想像してみてください。最初に生物学からインスピレーションを得たAI反逆者たちは、知能そのものを作り変えるツールを私たちに与えました。今度は、それを賢く使うことが私たち全員に委ねられているのです。

まとめ

テレンス・セノフスキーによる『ディープラーニング革命』の本要約では、赤ちゃんの脳の研究からAIの創造へと至る歩みが、人類史上最も深遠な転換の一つをたどるものであることを学びました。従来の常識に挑戦する勇気を持った少数の研究者グループが、知能は論理的ルールに従うことからではなく、膨大なデータのパターンを認識することから生まれることを発見しました。今日、ディープラーニングシステムは言語を翻訳し、病気を診断し、ほんの数十年前まで不可能に思えた問題を解決しています。しかし、これらのテクノロジーが教育から雇用まであらゆるものを変革する中で、私たちは人間を唯一無二たらしめているものを守りながら、その力をどう活用するかという重要な選択に直面しています。

自然の最も成功した設計を模倣することから始まった革命は、今や知能そのものの未来を思慮深く導く機会を私たちに与えています。

Add Comment