TY - RPRT TI - Verification Reward Model for Reinforcement Learning in Chip Design Verification AU - Shashank Chaurasia PY - 2026 UR - https://arxiv.org/abs/2609.22347 ID - 2609.22347 ER -