TY - RPRT TI - HiPO: Hierarchical Preference Optimization for Adaptive Reasoning in LLMs AU - Darsh Kachroo AU - Arjun Prasaath Anbazhagan AU - Adriana Caraeni AU - Brennan Lagasse AU - Kevin Zhu PY - 2026 UR - https://arxiv.org/abs/2604.20140 ID - 2604.20140 ER -