TY - RPRT TI - Scaling Learning based Policy Optimization for Temporal Logic Tasks by Controller Network Dropout AU - Navid Hashemi AU - Bardh Hoxha AU - Danil Prokhorov AU - Georgios Fainekos AU - Jyotirmoy Deshmukh PY - 2024 UR - https://arxiv.org/abs/2403.15826 ID - 2403.15826 ER -