TY - RPRT TI - Multi-Axis Max@K Reinforcement Learning for Representative Diversity in Text-to-Image Generation AU - Ku Onoda AU - Paavo Parmas AU - Hiroki Furuta AU - Soichiro Nishimori AU - Yuta Oshima AU - Shohei Taniguchi AU - Yutaka Matsuo PY - 2026 UR - https://arxiv.org/abs/2607.14962 ID - 2607.14962 ER -