Tian, F. (2026) “Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning”, Exploring Science Academic Conference Series, 16, pp. 14–18. doi:10.70267/aitia.20261418.