これは、私個人の定性的なMIRIの2013年の自己評価の第3回です。今回から、2013年のMIRIの研究活動を振り返ります。「研究活動」には、主に研究者を対象とした働きかけと、MIRIが行う3種類の研究を含めています。
- 解説研究:すでに行われた戦略研究やFriendly AI研究のうち、まだ十分に明快、あるいは簡潔に説明されていないものを整理し、分かりやすくする研究です。たとえば「知能爆発:証拠とその重要性」や「頑健な協力:Friendly AI研究の事例」です。考えを明確に説明したり、関連資料を引用したりするには、多くの調査研究が必要になることが多いため、私はこれも「研究」の一形態と考えています。
- 戦略研究:未来がどう展開しそうか、よい結果へと未来を少しでも近づけるために今何ができるかを明らかにする研究です。解説研究よりも新しい考察やモデル化が多くなりますが、境界は曖昧です。たとえば「知能爆発のミクロ経済学」や「AIをどう予測しているか、あるいは予測できていないか」をご覧ください。なお、私が「MIRIの戦略研究」「超知能戦略研究」と呼ぶものは、GiveWellが「戦略的な支援分野選定の研究」、CEAが「支援分野の優先順位付けの研究」と呼ぶもののうち、超知能に焦点を絞った部分に当たります。
- Friendly AI研究:人間を大切にする価値観を持ち、安定して自己改善を続ける人工知能を設計するという課題に、最も深く関わると思われる技術的な部分問題を解く研究です。哲学的な問題を明確にして数学の問題へと変え、さらに工学の問題へと発展させることが多くあります。「自己改変AIのためのタイリング・エージェント」や「囚人のジレンマにおける頑健な協力」がその例です。
今回は、MIRIの戦略研究と解説研究を振り返ります。2013年のFriendly AI研究の振り返りは、後の記事で取り上げます。以下では、どの文章が「解説」でどれが「戦略」研究なのかは、基本的に区別しません。大半が両方の要素を持っているからです。
2013年の戦略研究と解説研究
- 2013年に外部へ公開した戦略研究・解説研究は、MIRIが直接刊行した論文4本、学術誌への掲載を目指した論文4本、査読付き書籍の4章、詳しい分析を行ったブログ記事9本、短い分析記事14本、各分野の専門家へのインタビュー16本でした。
- これらの取り組みは、おおむね狙いどおりの目的を果たしたと思います。ただ、今後、その目的をもっと効率よく達成する方法について、2013年には多くを学びました。特に、次の2点です。
- 目的の一部を達成するには、専門家へのインタビューが最も効率的な方法のようです。
- 自分たちで大規模な戦略研究を行うより、すでに分かっていることを書きまとめる「解説研究」と、ほかの人 が取り組めるように未解決の研究課題を記述することに、力を注ぐべきです。
2013年に何を行い、なぜ行ったのか
以下は、MIRIが外部に公開した 2013年の戦略研究・解説研究 に当たる文章の一覧です。例年どおり、2013年にも、少なくともまだ外部には公開していない重要な戦略研究を行いました。たとえば、ニック・ボストロムの近刊 スーパーインテリジェンス:経路・危険・戦略のさまざまな草稿への100時間以上のフィードバック、ロビン・ハンソンの全脳エミュレーションに関する近刊の初期草稿への15時間以上のフィードバック、今後刊行予定のMIRIの論文などに関する多くの作業です。
- MIRIが直接刊行した論文4本:(1)ユドカウスキーの「知能爆発のミクロ経済学」。本人はこれを「Friendly AIの未解決問題その1」と呼びましたが、私はFriendly AI研究ではなく戦略研究に分類しています。(2)ソタラとヤンポルスキーの「壊滅的なAGIリスクへの対応:概観」。(3)グレースの「6つの分野におけるアルゴリズムの進歩」。(4)ファレンシュタインとメネンの「AGIを予測する:ほとんど分かっていないとき、何が言えるか」。
- 学術誌への掲載を目指した論文4本。2本は掲載済みで、2本は投稿先の学術誌で検討中です。(1)シュルマンとボストロムの「認知能力の増強のための胚選択」。(2)アームストロングらの「崖っぷちへの競争」。(3)ヤンポルスキーとフォックスの「汎用人工知能の安全工学」。刊行時、ジョシュア・フォックスはMIRIの研究協力員でした。(4)ミュールハウザーとボストロムの「なぜFriendly AIが必要なのか」。これは学術誌 Think の2014年初めの号に掲載されましたが、オンラインでは2013年に公開されています。
- 査読付き書籍の4章。Springer刊の シンギュラリティ仮説:科学的・哲学的評価に収録されました。MIRIのスタッフが書いたのは、「知能爆発:証拠とその重要性」「知能爆発と機械倫理」「友好的な人工知能」の3章です。「友好的な人工知能」の章は、ユドカウスキーの以前の論文「地球規模のリスクにおける正負両面の要因としての人工知能」を短くしただけのものです。もう1章の「人工知能と人間のメンタルモデル」は、当時MIRIの研究協力員だったジョシュア・フォックスが共著しました。MIRIはこのほか、ほかの章に対する短い応答を2本、ユドカウスキーとマイケル・アニシモフが1本ずつ寄稿しました。これらの章は2011~2012年に書かれましたが、書籍として出版されたのは2013年です。
- 9本の 詳しい 分析ブログ記事:(1)ソタラの「倫理を気にかけた科学者たちの小史」。(2)カースの「ベイズ的調整は、人類存亡リスクへの寄付を退ける理由にはならない」。ユドカウスキーの(3)「ロボット・AI・失業に関するアンチFAQ」と(4)「パスカルのマグル」。ミュールハウザーの(5)「AGIの影響の専門家とFriendly AIの専門家」、(6)「AIはいつ生まれるのか」、(7)「安全上重要なシステムの透明性」、(8)「何十年も先の未来に向けて、どれほどうまく計画できるか(初期調査)」、(9)「政策立案者はAGIにどれほどうまく対処するか(初期調査)」。
- 14本の 短い 分析ブログ記事:ユドカウスキーの(1)「5つのテーゼ、2つの補題、そしていくつかの戦略的含意」、(2)「重要な出来事Wが起きた後も、彼らはあなたを信じない」、(3)「経済成長の遅い地球のほうが、FAIを実現しやすいか」、(4)「パスカルの賭けについて半端に合理的になると、かえって悪くなる」。ミュールハウザーの(5)「効果的利他主義としてのFriendly AI研究」、(6)「知能とは何か」、(7)「AGIとは何か」、(8)「AIリスクとセキュリティの思考様式」、(9)「数学的証明はセキュリティ・安全性・友好性を高めるが、保証はしない」、(10)「AIの危険について、リチャード・ポズナーはどう考えるか」、(11)「Friendly AIについて、ラッセルとノーヴィグはどう考えるか」、(12)「哲学から数学へ、そして工学へ」、(13)「知能増強とFriendly AI」、(14)「モデルの組み合わせと調整」。
- 各分野の専門家へのインタビュー16本:(1)ジェームズ・ミラーに、AGI企業が直面する特殊なインセンティブについて。(2)ロマン・ヤンポルスキーに、AIの安全工学について。(3)ニック・ベックステッドに、遠い未来の重要性について。(4)ベンヤ・ファレンシュタインに、自己改変システムのレーブ的障害について。(5)ホールデン・カーノフスキーに、透明性のある調査分析について。(6)スティーヴン・シューに、認知ゲノミクスについて。(7)ローラン・オルソーに、汎用人工知能について。(8)ポール・ローゼンブルームに、認知アーキテクチャについて。(9)ベン・ゲーツェルに、研究分野としてのAGIについて。(10)ハディ・エスマイルザデに、ダークシリコンについて。(11)バス・ストゥーネブリンクに、自己反映プログラミングについて。(12)マルクス・シュミットに、新しいバイオテクノロジーのリスクについて。(13)ロビン・ハンソンに、本格的な未来研究について。(14)グレッグ・モリセットに、セキュリティと信頼性を備えたシステムについて。(15)スコット・アーロンソンに、哲学の進歩について。(16)ヨゼフ・ウルバンに、機械学習と自動推論について。ほかに、エリエザー・ユドカウスキーへのごく短いインタビューも2本ありました。「論理的不確実性について、ユドカウスキーに聞く」と「『今、何ができるか』について、ユドカウスキーに聞く」です。
- 効果的利他主義の運動のほかのメンバーとの、効果的利他主義全般についての対話を、1本録音し、文字起こししました。「効果的利他主義と波及効果」です。
戦略研究・解説研究の価値と目的について、MIRIのスタッフの見解はさまざまです。私個人は、以下の目的で上の研究活動を支援し、あるいは実施しました。なお、働きかけや研究活動の一部には、認識論の難問に取り組むという追加の目的もあります。そうした問題は、たとえばビジネスや、クーンの意味での「通常科学」の実践よりも、MIRIの研究に深く関わるからです。「パスカルのマグル」はその一例です。また、人気を集めたスコット・アーロンソンへのインタビューのように、解説研究・戦略研究の一部は、一般向けの発信も兼ねています。
- 私たちの仮定を検証するとともに、私たちと意見が異なるかもしれない人の見方を理解すること。例:「何十年も先の未来に向けて、どれほどうまく計画できるか」「政策立案者はAGIにどれほどうまく対処するか」、グレッグ・モリセットへのインタビュー。
- 人類存亡リスクとFriendly AIに関する戦略的行動の判断材料となる、新たなことを学ぶこと。例:「6つの分野におけるアルゴリズムの進歩」、ハディ・エスマイルザデとヨゼフ・ウルバンへのインタビュー。
- 戦略的に重要な問いについて小規模な初期調査を行ったり、超知能戦略の未解決問題をどう掘り下げて研究できるかを説明したりして、ほかの研究者が貢献しやすくすること。例:「知能爆発のミクロ経済学」「6つの分野におけるアルゴリズムの進歩」「何十年も先の未来に向けて、どれほどうまく計画できるか」。
- 戦略研究、解説研究、Friendly AI研究に、いつか貢献するかもしれない研究者と関係を築くこと。例:インタビューの多く。
- 人類存亡リスクとFriendly AIについて、MIRIに特徴的な見解を形作る、小さな「パズルのピース」を説明すること。例:「AIはいつ生まれるのか」「数学的証明は……を高めるが、保証はしない」、ニック・ベックステッドへのインタビュー。
これらの取り組みは、どれほど目的を果たしたか
戦略研究と解説研究が、その目的をどれほど達成しているかを測る定量的な方法は、まだ導入していません。ただし、基本的なアクセス状況はお伝えできます。Google Analyticsによると、2013年の戦略研究・解説研究のうち、公開以来の「ユニークページビュー」が最も多かったのは、「AIはいつ生まれるのか」(約15,500)、スコット・アーロンソンへのインタビュー(約13,500)、ハディ・エスマイルザデへのインタビュー(約13,500)、「ロボット・AI・失業に関するアンチFAQ」(約12,000)、「知能とは何か」(約5,000)、「パスカルのマグル」(約5,000)、「倫理を気にかけた科学者たちの小史」(約4,500)、「知能爆発のミクロ経済学」(約3,500)、「哲学から数学へ、そして工学へ」(約3,500)です。当然、この一覧は早く公開された記事に有利です。また、Google AnalyticsではPDFのダウンロードを追跡していないため、その数値はありません。現時点でお伝えできるのは、私自身の考察と、私たちの研究を詳しく追っている何人かに前節のほぼ完成した草稿を見せて話し合った内容に基づく、主観的で定性的な印象だけです。
目的(1)について。私たちの仮定を低コストで強く検証する方法を見つけるのは困難です。そのため、2013年にこの目的で行った研究は、仮定の一部を弱く裏付けるものか、仮定をよく検証できるようにするための小さな一歩にとどまりました。前者の例は、グレッグ・モリセットへのインタビューです。たとえば彼は、「はい、[『数学的証明は……を高める』の記事に]完全に同意します」、「後から付け足す方法と比べて、アーキテクチャを設計し直し、コードを書き直すことは、セキュリティの面ではほぼ常に有利になると思います」と述べています。後者の例は、「何十年も先の未来に向けて、どれほどうまく計画できるか」「政策立案者はAGIにどれほどうまく対処するか」です。
目的(2)について。同様に、AIの実現時期、AIの急速な能力向上の速度、心の設計空間における「収束的な道具的価値」というアトラクターの強さなど、重要な戦略変数の値をしっかり絞り込む証拠を、安価に得ることは困難です。そのため、新たなことを学ぶための研究も、少なくとも私たちにとっては、普通は小さな信念の更新しかもたらしません。たとえば、ムーアの法則の見通しについてのハディ・エスマイルザデへのインタビューや、数学的自動推論の現状についてのヨゼフ・ウルバンへのインタビューです。
AIの長期的な未来について、尤度比の大きい証拠をさらに得ることの難しさに対する私自身の反応は、おおよそ次のようなものです。
よい知らせは、将来の機械超知能について、手を伸ばせば得られる成果の大半を、人類はすでに手に入れたようだということだ。15年前はそうではなかった。悪い知らせは、その成果だけでは、どうすれば 勝てる のかがはっきりしないことだ。しかし、非常に大きなものが懸かっている以上、長期予測は難しいと受け入れたうえで、もっと努力する しかない。研究を増やすために、もっと多くの研究者に参加してもらう必要がある。そして、戦略的に重要な変数について、オッズを2対1の比率で変えるベイズ的更新を得るまでに、博士論文10本分の研究が必要かもしれないと、覚悟しなければならない。また、具体的にどんな更新ができるかは分からなくても、関連分野に頭を「漬け込む」のも、おそらくよいことだ。関連分野の事実で頭を満たせば、それらの分野や隣接分野に関する直感全般がよくなるだろうからだ。これも、私が2013年9月以来、大量のノンフィクションのオーディオブックを聴いている理由の1つである。
目的(3)について。MIRIの2013年の戦略研究・解説研究が、ほかの研究者にどれほど役立ったかは、よく分かりません。ただ、そうした効果が形になるには、普通、何年かかかります。「知能爆発のミクロ経済学」は「6つの分野におけるアルゴリズムの進歩」を可能にしましたが、それでも後者を委託する必要があったのは MIRI でした。この研究がほかの人による研究につながることには、私は楽観的です。ほかの研究分野では普通そうなっていますし、超知能戦略だけ違うと考える理由は、あまり見当たらないからです。
目的(4)について。はい、多くのインタビューを通じて、協力的な各分野の専門家との新たな関係が築かれました。
目的(5)について。ここでも、効果をよく測る尺度はありません。ただ、コミュニティの人から「この記事でとてもよく分かった」というコメントは頻繁に届きます。また、分析記事の一部は、ほかの団体からも定期的にリンクされています。たとえばGiveWellと80,000 Hoursは、どちらも自分たちの研究戦略を説明する際、私たちのモデルの組み合わせについての記事にリンクしています。
2014年に向けて
上で述べたように、また運営面の振り返りでも述べたように、研究の影響を測る、よりよい方法がまだ必要です。最初の試みとしては、さまざまな形で影響を与えたいと考えている人の一部にアンケートを行い、私たちの研究からどんな影響を受けたか尋ねるのが、もっともらしい測定方法でしょう。
ただ、影響の測定を改善してそこから学ぶのを待たなくても、戦略研究・解説研究について学んだことと、2014年に変える予定の点について、いくつか述べられると思います。
第一に、各分野の専門家へのインタビューは、私が解説研究・戦略研究に求める目的の一部を達成するうえで、非常に効率的な方法です。1本のインタビューに必要なスタッフの時間は、わずか数時間でした。一方、典型的な「短い」分析記事には5~25人時、「詳しい」分析記事には10~60人時かかりました。
2013年は、7月1日から12月30日までに各分野の専門家へのインタビューを16本、月平均2.66本公開しました。2014年は、月平均4本以上を公開するつもりです。
第二に、新たな戦略研究よりも、解説研究のほうが、労力当たりの価値は高い傾向があります。MIRIには、FHIの協力者と合わせて、「完了」していても、まだどこにも 明快な説明がない 戦略研究が、並外れて多くたまっています。当然、すでに完了した戦略研究を説明するほうが、独自の戦略研究を行い、そのうえで 説明するより、少ない労力で済みます。
第三に、影響を与えたい集団、たとえばAI研究者や巨額の寄付を行う篤志家を代表する、知的な批判者と対話し、その懸念に最も関わる文章を用意することで、解説研究、場合によっては戦略研究の優先順位を付けられます。新たな解説を読んでもらった後で再び対話し、その異論が残っているかを確かめます。残っていればなぜか、解消していればほかにどんな異論があるかを確認します。それが次の文章の優先順位を決める材料になり、私たちのモデルの欠陥を明らかにすることもありえます。
第四に、学生たちは、超知能戦略を明らかにするため、自分にできる研究プロジェクトを知りたいと思っています。残念ながら、経験豊かな教授が、どんな論文を研究して書けば超知能戦略の理解が進むかを尋ねに押し寄せる状況には、まだなっていません。しかし、多くの 大学院生 は尋ねてきます。また、大学院生の 指導教員 とも何度か話しました。学生がよい研究課題を見つけるのを手伝うのに多くの時間がかかるため、学生と所属学科に適した研究計画案を、誰かが用意してくれれば助かるとのことでした。
さらに、超知能戦略という歴史の浅い狭い分野でも、この戦略がうまくいった先例は いくらか あります。最も明確な例はニック・ベックステッドです。彼はFHIとの対話をきっかけの1つとして、遠い未来の形成に関わることの重要性について、有益な哲学の博士論文を書きました。ジョアン・ロウレンソは、FHIとMIRIとの対話もきっかけとなって、現在、道徳的増強の見通しについて哲学の博士論文を書いています。ジェレミー・ミラーは、MIRIとの対話をきっかけの1つとして、知能の普遍的な尺度についての学位論文プロジェクトを計画し始めたところです。ほかにも例はあると思いますが、まだ確認できていません。
そこで2014年には、超知能戦略の判断材料となりうる研究プロジェクトについて、短い説明を公開する予定です。ニック・ボストロムの スーパーインテリジェンスが出版されれば、この作業はずっと容易になるので、おそらく今夏の出版まで待つことになるでしょう。
第五に、ニック・ボストロムによる、機械超知能についての刊行予定の学術的な単著は、超知能戦略の研究にもっと多くの研究者に参加してもらう、またとない機会です。そのため、2014年の「将来、戦略研究者となるかもしれない人への働きかけ」の一部は、この本の普及を手伝うことになります。また、読了して内容を役立てる人の割合を増やすため、この本の読書ガイドも公開する予定です。