@misc{indiciae0302a474708f, title = {Aligning Language Models Using Follow-up Likelihood as Reward Signal}, author = {Chen Zhang and Dading Chong and Feng Jiang and Chengguang Tang and Anningzhe Gao and Guohua Tang and Haizhou Li}, year = {2025}, url = {https://arxiv.org/abs/2409.13948}, note = {Source identifier: 2409.13948} }