@misc{indiciae776d4bd99042, title = {Coordinating Ride-Pooling with Public Transit using Reward-Guided Conservative Q-Learning: An Offline Training and Online Fine-Tuning Reinforcement Learning Framework}, author = {Yulong Hu and Tingting Dong and Sen Li}, year = {2025}, url = {https://arxiv.org/abs/2501.14199}, note = {Source identifier: 2501.14199} }