TY - RPRT TI - Physical policy gradient theorem for in situ stochastic-adjoint training AU - William Tuxbury AU - Zin Lin PY - 2026 UR - https://arxiv.org/abs/2609.05808 ID - 2609.05808 ER -