TY - RPRT TI - Two-Layer Reinforcement Learning-Assisted Joint Beamforming and Trajectory Optimization for Multi-UAV Downlink Communications AU - Ruiqi Wang AU - Essra M. Ghoura AU - Omar Alhussein AU - Yuzhi Yang AU - Jing Ren AU - Shizhong Xu AU - Sami Muhaidat PY - 2026 UR - https://arxiv.org/abs/2601.12659 ID - 2601.12659 ER -