TY - RPRT TI - Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning AU - Yingxiao Huo AU - Satya Prakash Dash AU - Radu Stoican AU - Samuel Kaski AU - Mingfei Sun PY - 2026 UR - https://arxiv.org/abs/2601.18626 ID - 2601.18626 ER -