長年知られてきた最適化手法である進化戦略(ES)が、強化学習(RL)の新たな代替手段として注目を集めています。AtariやMuJoCoといった現代のRLベンチマークにおいて、標準的なRL技術と同等の性能を発揮しつつ、RLが抱える多くの不便さを克服できる可能性が示されました。スケーラビリティと効率性の面で、今後のAI開発に大きな影響を与えるかもしれません。