TY - RPRT TI - Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation AU - Zechu Li AU - Yufeng Jin AU - Puze Liu AU - Jan Peters AU - Georgia Chalvatzaki PY - 2026 UR - https://arxiv.org/abs/2606.22471 ID - 2606.22471 ER -