TY - RPRT TI - Heuristics for Combinatorial Optimization via Value-based Reinforcement Learning: A Unified Framework and Analysis AU - Orit Davidovich AU - Shimrit Shtern AU - Segev Wasserkrug AU - Nimrod Megiddo PY - 2026 UR - https://arxiv.org/abs/2512.08601 ID - 2512.08601 ER -