TY - RPRT TI - Generation-Step-Aware Framework for Cross-Modal Representation and Control in Multilingual Speech-Text Models AU - Toshiki Nakai AU - Varsha Suresh AU - Vera Demberg PY - 2026 UR - https://arxiv.org/abs/2601.17387 ID - 2601.17387 ER -