TY - RPRT TI - Safe Inference-Time Alignment via Lagrangian Reward Augmentation AU - Yaswanth Chittepu AU - Ativ Joshi AU - Sohini Chintala AU - Scott Niekum PY - 2026 UR - https://arxiv.org/abs/2607.02781 ID - 2607.02781 ER -