TY - RPRT TI - LLMdoctor: Token-Level Flow-Guided Preference Optimization for Efficient Test-Time Alignment of Large Language Models AU - Tiesunlong Shen AU - Rui Mao AU - Jin Wang AU - Heming Sun AU - Jian Zhang AU - Xuejie Zhang AU - Erik Cambria PY - 2026 UR - https://arxiv.org/abs/2601.10416 ID - 2601.10416 ER -