@misc{indiciae8b6740f1b189, title = {7B Fully Open Source Moxin-LLM/VLM -- From Pretraining to GRPO-based Reinforcement Learning Enhancement}, author = {Pu Zhao and Xuan Shen and Zhenglun Kong and Yixin Shen and Sung-En Chang and Arash Akbari and Timothy Rupprecht and Lei Lu and Enfu Nan and Changdi Yang and Yumei He and Weiyan Shi and Xingchen Xu and Yu Huang and Wei Jiang and Wei Wang and Yue Chen and Yong He and Yanzhi Wang}, year = {2025}, url = {https://arxiv.org/abs/2412.06845}, note = {Source identifier: 2412.06845} }