AI訓練における新たなアプローチとして、人間からの偶発的なフィードバックを活用するオープンソース実装「RL-Teacher」が登場しました。これは、手作業で報酬関数を設計する従来の方式に代わり、安全なAIシステムの開発や、報酬設定が困難な強化学習問題への適用を目指すものです。開発コスト削減とAIの汎用性向上に貢献すると私は見ています。