TY - RPRT TI - SimBa: Simplicity Bias for Scaling Up Parameters in Deep Reinforcement Learning AU - Hojoon Lee AU - Dongyoon Hwang AU - Donghu Kim AU - Hyunseung Kim AU - Jun Jet Tai AU - Kaushik Subramanian AU - Peter R. Wurman AU - Jaegul Choo AU - Peter Stone AU - Takuma Seno PY - 2025 UR - https://arxiv.org/abs/2410.09754 ID - 2410.09754 ER -