TY - RPRT TI - A Self-Supervised Reinforcement Learning Approach for Fine-Tuning Large Language Models Using Cross-Attention Signals AU - Andrew Kiruluta AU - Andreas Lemos AU - Priscilla Burity PY - 2025 UR - https://arxiv.org/abs/2502.10482 ID - 2502.10482 ER -