TY - RPRT TI - MICRO: Model-Based Offline Reinforcement Learning with a Conservative Bellman Operator AU - Xiao-Yin Liu AU - Xiao-Hu Zhou AU - Guotao Li AU - Hao Li AU - Mei-Jiang Gui AU - Tian-Yu Xiang AU - De-Xing Huang AU - Zeng-Guang Hou PY - 2024 UR - https://arxiv.org/abs/2312.03991 ID - 2312.03991 ER -