TY - RPRT TI - Past-Discounting is Key for Learning Markovian Fairness with Long Horizons AU - Ashwin Kumar AU - William Yeoh PY - 2026 UR - https://arxiv.org/abs/2504.01154 ID - 2504.01154 ER -