Tag: A3C
-
PPO and A3C for Complex Game AI Environments
Why PPO replaced DQN for game AI: actor-critic variance reduction, continuous control, and 10x faster convergence on Atari benchmarks.
Why PPO replaced DQN for game AI: actor-critic variance reduction, continuous control, and 10x faster convergence on Atari benchmarks.