@misc{indiciae458820243947, title = {Language Models are Hidden Reasoners: Unlocking Latent Reasoning Capabilities via Self-Rewarding}, author = {Haolin Chen and Yihao Feng and Zuxin Liu and Weiran Yao and Akshara Prabhakar and Shelby Heinecke and Ricky Ho and Phil Mui and Silvio Savarese and Caiming Xiong and Huan Wang}, year = {2024}, url = {https://arxiv.org/abs/2411.04282}, note = {Source identifier: 2411.04282} }