@misc{indiciae41b86395aebe, title = {Learning Human-Like RL Agents Through Trajectory Optimization With Action Quantization}, author = {Jian-Ting Guo and Yu-Cheng Chen and Ping-Chun Hsieh and Kuo-Hao Ho and Po-Wei Huang and Ti-Rong Wu and I-Chen Wu}, year = {2025}, url = {https://arxiv.org/abs/2511.15055}, note = {Source identifier: 2511.15055} }