Evolved Policy Gradients
OpenAI introduced Evolved Policy Gradients, a new method combining evolutionary strategies with policy gradient reinforcement learning. This approach improves training efficiency and performance in complex environments. It matters because it advances AI's ability to learn effective behaviors autonomously.
