TY - RPRT TI - Reusing Past Samples in Proximal Policy Optimization: When and How Does It Help? AU - Alessandro Montenegro AU - Riccardo Venturelli AU - Marco Mussi AU - Matteo Papini AU - Alberto Maria Metelli PY - 2026 UR - https://arxiv.org/abs/2610.01399 ID - 2610.01399 ER -