TY - RPRT TI - Counterfactual Learning from Bandit Feedback under Deterministic Logging: A Case Study in Statistical Machine Translation AU - Carolin Lawrence AU - Artem Sokolov AU - Stefan Riezler PY - 2017 UR - https://arxiv.org/abs/1707.09118 ID - 1707.09118 ER -