@misc{indiciaeb35c4008c778, title = {Hedging using reinforcement learning: Contextual \$k\$-Armed Bandit versus \$Q\$-learning}, author = {Loris Cannelli and Giuseppe Nuti and Marzio Sala and Oleg Szehr}, year = {2022}, doi = {10.1016/j.jfds.2023.100101}, url = {https://arxiv.org/abs/2007.01623}, note = {Source identifier: 2007.01623} }