TY - RPRT TI - Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning AU - Chengshuai Shi AU - Wenzhe Li AU - Xinran Liang AU - Yizhou Lu AU - Wenjia Yang AU - Ruirong Feng AU - Seth Karten AU - Ziran Yang AU - Zihan Ding AU - Gabriel Sarch AU - Danqi Chen AU - Karthik Narasimhan AU - Chi Jin PY - 2026 UR - https://arxiv.org/abs/2605.00347 ID - 2605.00347 ER -