a3c-mnih-2016-async-actor-critic
IN premise — entries/2026/06/21/wiki-Reinforcement_learning-chunk-5.md
Created 2026-06-21T09:55:53+00:00
A3C (Asynchronous Advantage Actor-Critic) was introduced by Mnih et al. (2016) using multiple parallel agents updating a shared model