AIの安全性向上に向け、人間が複雑な目標関数を直接記述する手法からの脱却が進んでいます。私が行った調査では、DeepMindの安全チームとの共同開発により、AIが二つの行動提案のうちどちらが優れているかを人間に判断させることで、人間の真の意図を推論するアルゴリズムが開発されました。これにより、不適切で危険なAIの挙動を防ぎ、より安全なシステム構築への一歩を踏み出します。