TY - RPRT TI - Ask, Condition or Abstain: Reinforcement Learning for Missing-Premise Reasoning AU - Yongqi Tong AU - Zhenyu Zhang AU - Zimi Liu AU - Kewei Fu AU - Mingli Song AU - Haofei Zhang AU - Junshao Zhang AU - Hong Zhu AU - Jiang-Ming Yang AU - Xin Zhang AU - Jianshe Li PY - 2026 UR - https://arxiv.org/abs/2608.16554 ID - 2608.16554 ER -