(1)
Tian, F. Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning. ESA 2026, 16, 14-18. https://doi.org/10.70267/aitia.20261418.