@misc{indiciae0e35c45b5399, title = {Reinforcement Learning Enhanced Multi-hop Reasoning for Temporal Knowledge Question Answering}, author = {Wuzhenghong Wen and Chao Xue and Su Pan and Yuwei Sun and Minlong Peng}, year = {2026}, url = {https://arxiv.org/abs/2601.01195}, note = {Source identifier: 2601.01195} }