SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning
SimBa injects a simplicity bias via input normalization and residual blocks, letting deep RL scale up parameters for better sample efficiency