@misc{indiciae916f75e99468, title = {Sparse Additive Off-Policy Evaluation for Reinforcement Learning with Potentially Limited Number of Trajectories}, author = {Tuoyi Zhao and Chengchun Shi and Zhengling Qi and Lan Wang}, year = {2026}, url = {https://arxiv.org/abs/2608.22595}, note = {Source identifier: 2608.22595} }