TY - RPRT TI - 7B Fully Open Source Moxin-LLM/VLM -- From Pretraining to GRPO-based Reinforcement Learning Enhancement AU - Pu Zhao AU - Xuan Shen AU - Zhenglun Kong AU - Yixin Shen AU - Sung-En Chang AU - Arash Akbari AU - Timothy Rupprecht AU - Lei Lu AU - Enfu Nan AU - Changdi Yang AU - Yumei He AU - Weiyan Shi AU - Xingchen Xu AU - Yu Huang AU - Wei Jiang AU - Wei Wang AU - Yue Chen AU - Yong He AU - Yanzhi Wang PY - 2025 UR - https://arxiv.org/abs/2412.06845 ID - 2412.06845 ER -