WIKI CONCEPTスコア 8

価値アラインメント問題

Value alignment problem

この日本語訳は、表示本文の全体がYudkowskyまたはSoaresに帰属すると確認できたページだけを対象にしています。

曖昧性の解消:良いAIを作る方法と理由の体系全体を含む研究分野は、 AIアラインメントを参照。

「価値アラインメント問題」とは、 十分に高度な機械知能 が、 したいと望む ことが 有益な 行為であり、有害な行為ではないようにする問題である。最も大きく立ちはだかる部分問題は、 「価値同定」または「価値学習(value learning)」 (価値アラインメントと同義だとみなされることもある)だが、 修正可能性(corrigibility)のような部分問題も含む。すなわち、あなたがAIのコードに誤りがあると判断して修正しようとする際に、AIがそれを 妨げようと望む ことのないようなAIの価値である。

Wiki専用概念

このページにはLessWrong上の関連投稿一覧がありません。