ヴィンジの原理 が意味するのは、あるエージェントが別のエージェントを設計するとき(または自身のコードを変更するとき)、相手の正確な将来行動を知らずに、その設計を承認する必要があるということである。
Deep Blueのプログラマーは、Deep Blueを実行すると決めたが、 Deep BlueがKasparovに対して指す正確な手も、各手へKasparovがどう応じるかも 知らず、代わりに正確な現実の結果を視覚化することもできなかった。その代わり、Deep Blueがゲーム木を探索する方法について推論し、Deep Blueは(負けようとするのでなく)「勝とうとして」おり、その目的へ効果的に推論しているという、十分に正当化された抽象的信念へ達した。
ヴィンジ的反省 とは、正確な将来出力を予測できないという制約のもとで、認知システム、とりわけ自分自身に非常によく似た認知システム(現実の自分自身を含む)について推論することである。何らかの形で、より抽象的な水準の推論を通じ、環境内でエージェントを動かす帰結を予測する必要がある。
「敷き詰めエージェント理論」では、後継者の行動について量化子の内側でだけ語るべきだという規則として現れる。
「ヴィンジ的反省」は、一見したときよりはるかに一般的な、高度認知システムの設計問題かもしれない。エージェントが 現在のコードの帰結について推論することや、 あと1分考え続けたら 何が起きるかを検討することは、ヴィンジ的反省を行うものと捉えられる。反省的で自己モデルを持つチェスプレイヤーは、さらに考えることで勝とうとせず負けようとすると思うなら、もう1分考えることを選ばない。しかし、自分の正確な思考を事前に予測することはできない。
ヴィンジ的反省はまた、あるエージェントが認知計算で、思考がどのように行われることを 望む かの研究とも捉えられる。それはエージェントが 現在 考える方法とは重要な点で異なりうる。両者が一致するなら、エージェントは 反省的に安定していると言う。
敷き詰めエージェント理論 は現在、ヴィンジ的反省と反省的安定性の形式化へゆっくり着手しようとする主要な研究路線である。
参考文献: