TY - RPRT TI - Learning Human-Like RL Agents Through Trajectory Optimization With Action Quantization AU - Jian-Ting Guo AU - Yu-Cheng Chen AU - Ping-Chun Hsieh AU - Kuo-Hao Ho AU - Po-Wei Huang AU - Ti-Rong Wu AU - I-Chen Wu PY - 2025 UR - https://arxiv.org/abs/2511.15055 ID - 2511.15055 ER -