TY - RPRT TI - Policy Gradient Method for LQG Control via Input-Output-History Representation: Convergence to $O(ε)$-Stationary Points AU - Tomonori Sadamoto AU - Takashi Tanaka PY - 2025 UR - https://arxiv.org/abs/2510.19141 ID - 2510.19141 ER -