TY - RPRT TI - Deep Reinforcement Learning with Hybrid Intrinsic Reward Model AU - Mingqi Yuan AU - Bo Li AU - Xin Jin AU - Wenjun Zeng PY - 2025 UR - https://arxiv.org/abs/2501.12627 ID - 2501.12627 ER -