TY - RPRT TI - Deviation optimal learning using greedy Q-aggregation AU - Dong Dai AU - Philippe Rigollet AU - Tong Zhang PY - 2012 DO - 10.1214/12-aos1025 UR - https://arxiv.org/abs/1203.2507 ID - 1203.2507 ER -