Tian, Fengrui. “Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning”. Exploring Science Academic Conference Series, vol. 16, Sept. 2026, pp. 14-18, https://doi.org/10.70267/aitia.20261418.