TY - RPRT TI - MoralReason: Generalizable Moral Decision Alignment For LLM Agents Using Reasoning-Level Reinforcement Learning AU - Zhiyu An AU - Wan Du PY - 2025 UR - https://arxiv.org/abs/2511.12271 ID - 2511.12271 ER -