TY - RPRT TI - Knowledge-Level Consistency Reinforcement Learning: Dual-Fact Alignment for Long-Form Factuality AU - Junliang Li AU - Yucheng Wang AU - Yan Chen AU - Yu Ran AU - Ruiqing Zhang AU - Jing Liu AU - Hua Wu AU - Haifeng Wang PY - 2026 UR - https://arxiv.org/abs/2509.23765 ID - 2509.23765 ER -