TY - RPRT TI - Nearly Optimal Active Preference Learning and Its Application to LLM Alignment AU - Yao Zhao AU - Kwang-Sung Jun PY - 2026 UR - https://arxiv.org/abs/2602.01581 ID - 2602.01581 ER -