@misc{indiciaea5f5bbde2fca, title = {Off-Policy Learning in Large Action Spaces: Optimization Matters More Than Estimation}, author = {Imad Aouali and Otmane Sakhi}, year = {2026}, url = {https://arxiv.org/abs/2509.03456}, note = {Source identifier: 2509.03456} }