Concepts

PPO

Reference entryTraining and efficiency
Reference entryPPO

Proximal policy optimization is a reinforcement-learning algorithm that limits the size of policy updates to improve training stability.

Also known as Proximal policy optimization.

Where it sits