WIKI CONCEPTスコア 14

箱入りAI

Boxed AI

この日本語訳は、表示本文の全体がYudkowskyまたはSoaresに帰属すると確認できたページだけを対象にしています。

AIボクシングとは、外部宇宙との因果的相互作用について、操作可能な経路がきわめて制限されているとされるため、より安全だとされる機械知能を扱う理論である。

AIボクシング理論は次を含む。

  • 精巧なサンドボックス(外部宇宙との因果的相互作用について、操作可能な経路を持たないよう設計されたコンピュータとシミュレーション環境)を構築するという直接的な問題。
  • 予見可能な難しさ 。残る限られた相互作用経路が、外部宇宙、とりわけ人間の運用者を操作するため悪用されうる。
  • 。Boxの外へ出る誘因を持たず、外部宇宙や人間の運用者を操作する誘因を持たず、質問へ正確に答える、またはBox内で実行するとされる別の活動を行う誘因を持つ 選好の枠組み を設計する試み。

AIボクシングの中心的な難しさは、人間の運用者を操作するためには使えないが、より大きな出来事に対して 決定的またはゲームを変える ほど関連性の高い情報を提供する経路を記述することである。たとえば、 あらかじめ指定した定理がZermelo–Fraenkel集合論内で証明されたという信頼できる情報を、箱入りAIの設定から安全に取り出せる可能性は考えられなくもない。しかし、指定した定理がZermelo–Fraenkel集合論内で確実に証明されたことを時々知れるだけで、世界を救う既知の方法はない。

Wiki専用概念

このページにはLessWrong上の関連投稿一覧がありません。