TY - RPRT TI - LR^2Bench: Evaluating Long-chain Reflective Reasoning Capabilities of Large Language Models via Constraint Satisfaction Problems AU - Jianghao Chen AU - Zhenlin Wei AU - Zhenjiang Ren AU - Ziyong Li AU - Jiajun Zhang PY - 2025 UR - https://arxiv.org/abs/2502.17848 ID - 2502.17848 ER -