rl-suboptimality-bias-overfitting-decomposition

IN premiseentries/2026/06/21/wiki-BiasE28093variance_tradeoff-chunk-3.md

Created 2026-06-21T09:55:49+00:00

In reinforcement learning, suboptimality decomposes into asymptotic bias (algorithm-dependent) and overfitting (data-dependent), analogous to the classical bias-variance tradeoff.

Dependents

These beliefs depend on this one: