TY - RPRT TI - $ϕ$-DPO: Fairness Direct Preference Optimization Approach to Continual Learning in Large Multimodal Models AU - Thanh-Dat Truong AU - Huu-Thien Tran AU - Jackson Cothren AU - Bhiksha Raj AU - Khoa Luu PY - 2026 UR - https://arxiv.org/abs/2602.22601 ID - 2602.22601 ER -