@misc{indiciaecc1fa08f0af7, title = {Q-Distribution guided Q-learning for offline reinforcement learning: Uncertainty penalized Q-value via consistency model}, author = {Jing Zhang and Linjiajie Fang and Kexin Shi and Wenjia Wang and Bing-Yi Jing}, year = {2025}, url = {https://arxiv.org/abs/2410.20312}, note = {Source identifier: 2410.20312} }