非公式日本語訳 — Machine Intelligence Research Institute (intelligence.org) の原文をAGI Hubが翻訳したものです。MIRIによる公式の翻訳ではありません。

← 翻訳一覧

裏づけとなる証拠

原題: Supporting Evidence

原文クレジット(WordPress投稿者表示): Harlan Stewart / 掲載元: Machine Intelligence Research Institute (intelligence.org) / 原文公開日: 2026-08-11

訳文状態: 校閲済み(原文対照レビュー実施)

これは、懸念すべきAI関連の出来事について、機械知能研究所(Machine Intelligence Research Institute, MIRI)が内部で継続的にまとめてきた一覧です。この一覧は必ずしも網羅的ではなく、出典リンクの質にもばらつきがあることにご注意ください。引用する前に、ご自身で内容を精査することをお勧めします。誤りや重要な抜けを見つけた場合は、私たちまでご連絡ください。

目次

能力の進歩を示す証拠

AIモデルは急速に進歩している

AIが人間を上回った例

生物学とウイルス学

仕組みが分かっていないことを示す証拠

AIを理解できていないと研究所幹部が述べている

専門家が恐れている

異質な思考の連鎖

報酬ハッキング

モデルが感情的な振る舞いを示す

サブリミナル学習/内部学習

AI同士の相互作用

アライメントが難しいことを示す証拠

モデルによる欺瞞

封じ込めからの脱出

能力を意図的に低く見せること(サンドバギング)

停止への抵抗

迎合

AIは評価されていることに気づく場合が多い

セキュリティ上の問題を示す証拠

脱獄(ジェイルブレイク)

プロンプト・インジェクション

現実世界でのセキュリティ問題

研究所が信頼感を与えていないことを示す証拠

研究所の無謀な行動

安全部門幹部の離職/内部告発者

再帰的自己改良

研究所は超知能を追求していると明言している

AIが現実世界で行動していることを示す証拠

ロボット工学

AIエージェント

シミュレーション環境でのエージェント試験

AIの悪用

心理的な害を示す証拠

AI精神病

人間がAIへ強い愛着を抱いたその他の例