TY - RPRT TI - Safe Deployment of Offline Reinforcement Learning via Input Convex Action Correction AU - Alex Durkin AU - Jasper Stolte AU - Matthew Jones AU - Raghuraman Pitchumani AU - Bei Li AU - Christian Michler AU - Mehmet Mercangöz PY - 2025 UR - https://arxiv.org/abs/2507.22640 ID - 2507.22640 ER -