@misc{indiciaee01ba1c11539, title = {Grounding Hierarchical Vision-Language-Action Models Through Explicit Language-Action Alignment}, author = {Theodor Wulff and Federico Tavella and Rahul Singh Maharjan and Manith Adikari and Angelo Cangelosi}, year = {2026}, url = {https://arxiv.org/abs/2604.05614}, note = {Source identifier: 2604.05614} }