@misc{indiciaed790e1f63287, title = {DiffOP: Reinforcement Learning of Optimization-Based Control Policies via Implicit Policy Gradients}, author = {Yuexin Bian and Jie Feng and Yuanyuan Shi}, year = {2025}, url = {https://arxiv.org/abs/2411.07484}, note = {Source identifier: 2411.07484} }