Concepts
PPO
Reference entryPPO
Proximal policy optimization is a reinforcement-learning algorithm that limits the size of policy updates to improve training stability.
Also known as Proximal policy optimization.
Where it sits
Proximal policy optimization is a reinforcement-learning algorithm that limits the size of policy updates to improve training stability.
Also known as Proximal policy optimization.