TY - RPRT TI - Enhancing LLMs for Physics Problem-Solving using Reinforcement Learning with Human-AI Feedback AU - Avinash Anand AU - Kritarth Prasad AU - Chhavi Kirtani AU - Ashwin R Nair AU - Mohit Gupta AU - Saloni Garg AU - Anurag Gautam AU - Snehal Buldeo AU - Rajiv Ratn Shah PY - 2024 UR - https://arxiv.org/abs/2412.06827 ID - 2412.06827 ER -