TY - RPRT TI - Coordinating Ride-Pooling with Public Transit using Reward-Guided Conservative Q-Learning: An Offline Training and Online Fine-Tuning Reinforcement Learning Framework AU - Yulong Hu AU - Tingting Dong AU - Sen Li PY - 2025 UR - https://arxiv.org/abs/2501.14199 ID - 2501.14199 ER -