Tian, F. (2026). Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning. Exploring Science Academic Conference Series, 16, 14-18. https://doi.org/10.70267/aitia.20261418