TY - RPRT TI - Zeroth-Order Nonsmooth Nonconvex Optimization with Convex Liftings and Its Application to State-Feedback $H_\infty$ Policy Optimization AU - Xuhao Wang AU - Yujie Tang PY - 2026 UR - https://arxiv.org/abs/2608.23178 ID - 2608.23178 ER -