TY - RPRT TI - Learning When to Trust via Selective Context Preference Optimization AU - Xian Sun AU - Wei Chow AU - Yingshuo Wang AU - Junhao Liu AU - Wei Gao AU - Qing Wu AU - Lingdong Kong PY - 2026 UR - https://arxiv.org/abs/2608.06377 ID - 2608.06377 ER -