TY - RPRT TI - Reward-free Pretraining for Reinforcement Learning via Occupancy Coverage Maximization AU - Marco Pratticò AU - Pietro Novelli AU - Massimiliano Pontil AU - Carlo Ciliberto PY - 2026 UR - https://arxiv.org/abs/2606.21271 ID - 2606.21271 ER -