TY - RPRT TI - Learning with Multiple Correct Answers -- Regret Bounds under Different Feedback Models AU - Alireza F. Pour AU - Farnam Mansouri AU - Shai Ben-David PY - 2026 UR - https://arxiv.org/abs/2602.09402 ID - 2602.09402 ER -