@misc{indiciaeae488732a65b, title = {Aligning Frozen LLMs by Reinforcement Learning: An Iterative Reweight-then-Optimize Approach}, author = {Xinnan Zhang and Chenliang Li and Siliang Zeng and Jiaxiang Li and Zhongruo Wang and Kaixiang Lin and Songtao Lu and Alfredo Garcia and Mingyi Hong}, year = {2025}, url = {https://arxiv.org/abs/2506.17828}, note = {Source identifier: 2506.17828} }