TY - RPRT TI - Optimizing Language Model's Reasoning Abilities with Weak Supervision AU - Yongqi Tong AU - Sizhe Wang AU - Dawei Li AU - Yifan Wang AU - Simeng Han AU - Zi Lin AU - Chengsong Huang AU - Jiaxin Huang AU - Jingbo Shang PY - 2024 UR - https://arxiv.org/abs/2405.04086 ID - 2405.04086 ER -