非公式日本語訳 — Machine Intelligence Research Institute (intelligence.org) の原文をAGI Hubが翻訳したものです。MIRIによる公式の翻訳ではありません。

← 翻訳一覧

効果的利他主義としての友好的AI研究

原題: Friendly AI Research as Effective Altruism / Analysis

原文クレジット(WordPress投稿者表示): Luke Muehlhauser / 掲載元: Machine Intelligence Research Institute (intelligence.org) / 原文公開日: 2013-06-05

訳文状態: 校閲済み(原文対照レビュー実施)

MIRIは2000年、友好的AIを作ることが、できる限り大きな善をなす、とりわけ効率的な方法かもしれないという前提で設立されました。((この記事では、人類全体が友好的AIを作ることの価値を論じます。一方、共同創設者のエリエゼル・ユドコウスキーは通常、MIRI自身、少なくとも同じ役割を果たす組織が作ることを論じます。私には、MIRIが友好的AIの構築を目指すのが最善だという、彼ほどの確信がないからです。2013年初めに定款を更新したとき、私たちは使命の表現について折り合いました。現在はこうなっています。「[MIRIは]、人間より賢い知能の誕生がよい影響をもたらすようにするために存在する。したがって、その慈善的な目的は、(a)そのよい影響を確保するための関連研究、(b)この重要な問題への認識の向上、(c)世界の研究者、指導者、一般の人々への助言、(d)必要に応じて、人道的で安定した目標を持つ、人間より賢い知能の実装である」(強調は引用者)。私は、MIRIや同等の組織が自ら友好的AIを作る必要はなくて済むことを願っています。しかし、最初のAIの誕生が近づくにつれ、それが最も賢明な道になる可能性には、開かれていなければなりません。能力の問題もあります。非営利の研究組織が最初にAIを作れる見込みは大きい、と考える人は少ないでしょう。しかし私は、AIの誕生まで残り数十年になるまで、世界のエリートがこの問題を真剣に扱うのを時流に合うことと考えないのでは、と心配しています。その時点では、友好的AIの数学を間に合うように発展させるのは特に難しくなり、人類は、信頼する根拠の乏しい強力なAIに、自らの生存を賭けざるをえなくなるでしょう。))

その後、次のような進展がありました。

こうした進展によって、効果的利他主義としての友好的AI研究の価値を、以前よりよく評価できるようになりました。

それでも、これは難しい問いです。マラリアを防ぐ蚊帳や直接の現金給付の費用対効果を評価するだけでも、十分難しいのです。友好的AIなどを通じて遠い未来を形作ろうとする取り組みの評価は、それよりさらに難しくなります。したがって、この短い記事では、今後の議論のため、効果的利他主義としての友好的AI研究を支持する議論の概略を示します。徹底的な分析を意図したものではありません。

効果的利他主義としての友好的AI研究を支持する議論

Beckstead(2013年)は、次の主張を論じています。((博士論文に加え、「天文学的な浪費の議論への調整案」も参照。))

世界全体の観点では、期待値として最も重要なのは、今後、何百万年、何十億年、何兆年にわたって子孫が発展する大きな道筋にとって、期待値として最善のことをすることである。

なぜそう考えるのでしょうか。天文学的な事実は、ポスト人類を含む人類が何十億年、何兆年と存続でき(Adams、2008年)、したがって膨大な善を生み出せると示唆します。((ベックステッドは触れていませんが、この議論が成り立つのに道徳的実在論は必要ありません。実際、私を道徳的実在論者とは見なさない哲学者が大半でしょうが、私は彼の議論をおおむね受け入れています。もっとも、ある程度は言葉の意味の議論です(Muehlhauser、2011年、Joyce、2012年)。道徳的実在論者として、直感的な道徳判断が道徳的真理についてのデータだと考えるなら、この議論は、成功していれば、道徳的に真であることや、道徳的によく行動するには何をすべきかを教えます。道徳的反実在論者でも、直感的判断は自分が価値を置くもの、あるいは、価値とその矛盾の解消についてもっと考える時間があれば価値を置くだろうものについてのデータだ、と考えるなら、この議論は、成功していれば、自分が何を大切にし、その実現を助けるには何をすべきかを教えます。)) しかし、未来が生む価値は、私たちの発展の道筋によって変わります。21世紀に強力な技術で自滅すれば、未来の価値のほぼすべてが失われます。生き延びても、争いや不適切な判断が支配する道筋を進めば、利他性と知恵が支配する道筋より、未来はずっと悪いかもしれません。また、現在の行動の一部には、人類の発展の道筋を決める「波及効果」がありえます。((カーノフスキーはこれを「フロースルー効果」と呼んでいます。)) 多くの結果は経路依存的だからです。 したがって、存亡リスクの低減など、道筋の変化を直接・間接に引き起こす行動は、野生動物20匹の命を救うといった、身近な利益しか持たない行動に比べ、期待値としてはるかに大きな価値を持ちえます。彼はこれを、「未来を形作ることについての大まかな議論」と呼びます。

この議論の背後にある、たとえばリスク中立性などの規範的な仮定を受け入れるなら、遠い未来は、平均して少なくとも過去1世紀と同じくらいうまく進むとして、非常に価値があります。存亡リスクの低減は、世界の健康や貧困対策などの身近な利益を生むことや、発展を速めることより、ずっと重要です。発展の加速は、実際には存亡リスクを増すかもしれませんし、増さなくても、存亡リスクの低減より期待価値は小さくなります。

しかし、ベックステッドの結論は、必ずしも、世界全体で存亡リスク低減を最優先すべきだというものではありません。なぜなら、

存亡リスクを減らさずに、遠い未来へ大きく持続的な影響を与える別の方法があるかもしれない……。価値観や社会規範の持続的な変化によって、未来は[ある割合だけ]よくも悪くもなりうる……。確かに、人類の存続に関わる破局を防げれば、小さな道筋の変化を起こすよりよい。しかし、小さなよい変化を起こすほうが、ずっと容易かもしれない。

この議論が示唆するのは、むしろ「遠い未来を形作るうえで最も重要なのは、道筋によい変化を起こし、悪い変化を避けることだ」ということです。存亡リスクの低減は、よい変化の重要な一種類であり、期待価値が最も高い介入策かもしれません。

一つ、重要な補足が必要です。身近な利益や発展の加速に取り組むことが、重要な道筋の変化をもたらす大きな波及効果を持つなら、「直接」道筋を変えようとするより、大きな善をなすかもしれません。たとえば、インドのヨウ素欠乏問題を解くような「普通の利他的な取り組み」が、2世代後に世界水準の優れた思考者を何千人も「追加」で生み出し、人類が重要な21世紀を賢明に切り抜け、星々へ広がる確率を高めるかもしれません。そうなる可能性が高いとは考えていません。あくまで例示です。

議論のために、「期待値として最も重要なのは、子孫が発展する大きな道筋にとって、期待値として最善のことをすることだ」という、彼の中心的な主張に同意するとしましょう。さらに、私と同じく、機械超知能はおそらく避けられないと考えているとします。((詳しい議論はBostromの近刊を参照。機械超知能が生まれない最もありそうな理由は、人間レベルのAIができる前に、世界的な破局で科学の進歩が止まることかもしれません。))

その場合、友好的AI研究は、遠い未来を大きくよい方向に形作る、とりわけ見通しやすく効果の大きな方法だと考えるかもしれません。「遠い未来に与える影響のほぼすべては、機械超知能の発展への影響を経由しなければならない」からです。ほかのあらゆる発展の流れは、機械超知能の圧倒的な実行力、具体的には、明示的・暗黙的、直接的・間接的にそこへ組み込まれた価値によって、上書きされるかもしれません。

そうなら、私たちの状況は、遠くの恒星系に入植する星間探査機を送り出すことに少し似ています。それらの恒星系が宇宙論的地平線の向こうへ遠ざかり、宇宙の膨張によって地球から二度と届かなくなる、その前にです。地球上のことで、その探査機の中身に影響しないものは、そうした恒星系へ影響しません(こちらのコメントも参照)。

この議論を覆しうる点

友好的AI研究が効率的な効果的利他主義だ、という以上の大まかな議論は、さらに詳しく肉付けする価値があります。((ベックステッドは私信で、次のような形式化を提案しました。ただし、必ずしも支持したわけではありません。「(1) 第一近似として、重要なのは人類の未来だけである。(2) 人類の未来は、ほかの何よりも、機械知能がどう発展するかに強く左右される。(3) したがって、機械知能の発展をよくするあらゆるプロジェクトに取り組むべきだという、非常に強い推定が働く。(4) FAI研究は、機械知能の発展をよくする最も有望な道である。(5) したがって、FAI研究を行うべきだという、非常に強い推定が働く」。Beckstead(2013年)は(1)の根拠を検討しています。Bostromの近刊は、主に(2)の根拠を検討します。(3)は(1)と(2)から、結論(5)は(3)と(4)から、非形式的に導かれます。私には、前提(4)が最も疑わしく、既存の文献で最も調べられていない部分に見えます。))

この議論を覆しうる点も検討するべきです。

今後のブログ記事で、私を含む効果的利他主義コミュニティーのメンバーが、この議論をさらに展開し、覆しうる点を検討していきます。

謝辞

この記事に意見を寄せてくれた、カール・シュルマン、ニック・ベックステッド、ジョナ・シニック、エリエゼル・ユドコウスキーに感謝します。