a3c-mnih-2016-async-actor-critic

IN premiseentries/2026/06/21/wiki-Reinforcement_learning-chunk-5.md

Created 2026-06-21T09:55:53+00:00

A3C (Asynchronous Advantage Actor-Critic) was introduced by Mnih et al. (2016) using multiple parallel agents updating a shared model