TY - RPRT TI - MIRA: Towards Mitigating Reward Hacking in Inference-Time Alignment of T2I Diffusion Models AU - Kevin Zhai AU - Utsav Singh AU - Anirudh Thatipelli AU - Souradip Chakraborty AU - Anit Kumar Sahu AU - Furong Huang AU - Amrit Singh Bedi AU - Mubarak Shah PY - 2025 UR - https://arxiv.org/abs/2510.01549 ID - 2510.01549 ER -