TY - RPRT TI - Offline Multi-Action Policy Learning: Generalization and Optimization AU - Zhengyuan Zhou AU - Susan Athey AU - Stefan Wager PY - 2018 UR - https://arxiv.org/abs/1810.04778 ID - 1810.04778 ER -