TY - RPRT TI - Efficient Optimal Learning for Contextual Bandits AU - Miroslav Dudik AU - Daniel Hsu AU - Satyen Kale AU - Nikos Karampatziakis AU - John Langford AU - Lev Reyzin AU - Tong Zhang PY - 2011 UR - https://arxiv.org/abs/1106.2369 ID - 1106.2369 ER -