TY - RPRT TI - Online convex optimization in the bandit setting: gradient descent without a gradient AU - Abraham D. Flaxman AU - Adam Tauman Kalai AU - H. Brendan McMahan PY - 2004 UR - https://arxiv.org/abs/cs/0408007 ID - cs/0408007 ER -