@misc{indiciaee2d56a6bd76a, title = {MuPHI: Learning Implicit Multimodal Harm Reasoning via Semantically Grounded Reward Optimization}, author = {Anisha Saha and Varsha Suresh and Teodora Kamova and Sophia Wiedmann and Timothy Hospedales and Vera Demberg}, year = {2026}, url = {https://arxiv.org/abs/2605.29951}, note = {Source identifier: 2605.29951} }