WIKI CONCEPTスコア 7

人間未満・人間並み・超人・効率的・最適

Infrahuman, par-human, superhuman, efficient, optimal

この日本語訳は、表示本文の全体がYudkowskyまたはSoaresに帰属すると確認できたページだけを対象にしています。

「十分に高度な」機械知能におけるいくつかの閾値は、ある領域内での絶対的な能力水準ではなく、AIの人間プログラマーやオペレーターに対する相対的な能力である。この場合、領域内の相対的な能力水準を考えると有用である。相対能力における一般的で特徴的な閾値の一組は、次のようになる。

  • 厳密に人間未満:AIは、人間のオペレーター/プログラマーにできないことを何一つできない。人間の名人を基準とした1966年のコンピュータチェス。
  • 人間未満:AIは明らかにオペレーターより弱いが、驚くような手をいくつか繰り出せる。人間の名人を基準とした1986年のコンピュータチェス。
  • 人間並み(より紛らわしくは「人間レベル」):その領域で競争すれば、AIは勝つことも負けることもある。ある点では人間より優れ、別の点では劣り、辛うじて勝つか負ける。強いアマチュアの人間プレイヤーを基準とした、家庭用コンピュータ上の1991年のコンピュータチェス。
  • 人間上位:AIは並外れて有能な人間と同程度に遂行する。1996年直前のコンピュータチェス。
  • 超人的:AIが常に勝つ。2006年のコンピュータチェス。
  • 効率的:人間の助言を加えても、AIの能力は限界的にまったく改善しない。コンピュータチェスは2016年ごろにこの水準のどこかにあり、「アドバンスト」/「フリースタイル」/「ハイブリッド」/「ケンタウロス」チェスが純粋な機械プレイヤーに負け始めていた。[1]
  • 強く超人的:
    • その領域で可能な成績の上限が人間水準をはるかに上回り、AIは何桁も優れた成績を出せる。たとえば、人間とコンピュータが算術をどれほど速く実行できるかを競う場合を考えよう。原理上、この領域は単純であるが、速度について競えば、コンピュータが文字どおり何十億倍も優れた成績を出せる余地が残る。
    • 領域が十分に豊かで、人間が重要な一般化を理解できず、AIがどのように勝つかに衝撃を受ける。2017年の、人間の名人を基準としたコンピュータ囲碁は、この最初の兆候をようやく示し始めていた(「私たちは神より一、二子下だと思っていたが、AlphaGoと対局した後では、三、四子ほどだと思う」)。同様に、人間の囲碁棋士が人間の初心者と対局する場合を考えてみよう。
  • 最適:AIの成績はその領域において完全であり、神でさえこれ以上うまくできない。2007年時点のチェッカーにおけるコンピュータのプレイ。

これらの閾値の順序は、常に上記のとおりとは限らない。たとえば、極めて単純な領域である論理的三目並べでは、人間は少し訓練すれば最適にプレイできる。したがって、三目並べの最適なプレイは超人的ではない。同様に、AIが豊かな領域でプレイしていても奇妙な弱点が残っているなら、そのAIは強く超人的(プレイがはるかに優れ、人間の名人を驚かせる)ではあっても、効率的ではない(人間の名人には誤りだと分かる手を、AIがときどき指す)かもしれない。

「人間相当」という用語は非推奨である。これは、たとえば会話でも人間とほぼ同程度に優れ、算術でも人間とほぼ同程度に優れたAIというような、おおむね人間型の能力バランスを紛らわしくも含意するからである。これは実際上ありそうにない。

「もう一つのWiki」では、「最適、超人的、人間上位、人間並み、人間未満」というカテゴリを列挙している。

AIアラインメント問題に関係する閾値

これらのカテゴリを、AIアラインメント問題が初めて具体化する時点に関係する高度化の閾値として考えると、次のようになる。

  • 「厳密に人間未満」とは、AIが(ある領域内で)目標達成のために使うどの戦術にも驚かされないと予想する、という意味である。
  • 「人間未満」とは、ある戦術には驚かされうるが、全体的な成績水準には驚かされない、という意味である。
  • 「人間並み」とは、競争によって決まるどの事象でも人間が負けることを心配し始める必要がある、という意味である(ただしこれは、非敵対的原則がすでに破られていることを含意するように思える)。関連能力の競争で決まる何らかの事象において、人間が勝つことを当てにできない。あるいはこれは、通常とは異なる仕方でそのロックに接近するとしても、おおむね人間の能力水準のロックによって守られていると信じる強い理由がある資源や能力に、AIがアクセスする場合を想定しているのかもしれない。
  • 「人間上位」とは、AIがある領域で人間に見える戦略をおそらく見いだす、という意味である。人間並みの能力を持つAIなら見落とす可能性があるが、人間上位のAIではその可能性がはるかに低い。したがって、AIが特定の戦略や論点を見いだすと予想する目的では、効率性を仮定することの、やや弱い版として機能する。
  • 「超人的」は、少なくとも弱い認知的封じ込め不能性を、ヴィンジの法則により含意する。また、何かが人間には難しいか不可能だと分かっていても、原理上は実行可能に思えるなら、何らかの超人的な能力水準が与えられれば可能になることを考慮する必要があるかもしれない。
  • 「効率性」は、人間が見いだすどの機会もAIが見いだすための完全な十分条件である。たとえば、多くの道具的に収束する戦略にとって完全な十分条件である。同様に、AIがある経路を選ぶが、別の経路ならその効用関数をより多く得られる、という主張を反駁するための完全な十分条件として仮定できる。
  • 「強く超人的」とは、AIの戦略が人間の反応時間より速く展開されたり、当初の大きな不利を克服したりしうると予想する必要がある、という意味である。AIがはるかに悪い立場から始めても、なお勝つかもしれない。
  • 「最適性」は、結果についての特定の閾値に明らかに対応するわけではないが、それでもこの階層における重要な概念である。最適な成績の絶対的限界を知ることによってのみ、強く超人的な成績が可能であることを排除できるからだ。「現実世界のほぼすべての領域は豊かである」という主張も参照のこと。

「人間レベルAI」と「汎用知能」の混同

文献では「人間レベルAI」という用語が汎用人工知能を指すために使われることがある。これはおそらく避けるべきである。理由は次のとおりだ。

  • 特化型AIは、汎用知能を持たずに、多くの特定領域で人間並みまたは超人的な能力を達成してきた。
  • もし汎用知能を一つの能力、すなわち一種の超領域とみなすなら、人間未満(あるいは超人的)な水準の汎用知能を想像することは可能に思える。人間からチンパンジーへの飛躍は明らかに大きいため、私たちが目にする汎用知能は主に人間水準であり、同じ能力をより低い水準で示す生物はいない。しかし、少なくとも現在分かっている限り、AIは異なる発達経路をたどれる可能性がある。したがって、大局的認識のような、汎用知能から生じうるアラインメントの閾値は、必ずしも全体としての人間並みの成績に固定されない。

議論の余地はあるが、「人間レベル」という用語は全面的に避けるべきだろう。実際上、この用語は一部の会話を脱線させる揚げ足取りボタンとして機能することが観察されているからである。割り込みは「ほら見ろ! AIは人間のような能力バランスを持たない!」というものだ。

  1. ^︎

    出典を募集中。Google検索からは、ここ数年「アドバンスト・チェス」について何も聞かれなくなったように見える。

Wiki専用概念

このページにはLessWrong上の関連投稿一覧がありません。