TY - RPRT TI - Hedging using reinforcement learning: Contextual $k$-Armed Bandit versus $Q$-learning AU - Loris Cannelli AU - Giuseppe Nuti AU - Marzio Sala AU - Oleg Szehr PY - 2022 DO - 10.1016/j.jfds.2023.100101 UR - https://arxiv.org/abs/2007.01623 ID - 2007.01623 ER -