TY - RPRT TI - PepThink-R1: LLM for Interpretable Cyclic Peptide Optimization with CoT SFT and Reinforcement Learning AU - Ruheng Wang AU - Hang Zhang AU - Trieu Nguyen AU - Shasha Feng AU - Hao-Wei Pang AU - Xiang Yu AU - Li Xiao AU - Peter Zhiping Zhang PY - 2026 UR - https://arxiv.org/abs/2508.14765 ID - 2508.14765 ER -