TY - RPRT TI - Group-Aware Reinforcement Learning for Output Diversity in Large Language Models AU - Oron Anschel AU - Alon Shoshan AU - Adam Botach AU - Shunit Haviv Hakimi AU - Asaf Gendler AU - Emanuel Ben Baruch AU - Nadav Bhonker AU - Igor Kviatkovsky AU - Manoj Aggarwal AU - Gerard Medioni PY - 2025 UR - https://arxiv.org/abs/2511.12596 ID - 2511.12596 ER -