[1]
F. Tian, “Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning”, ESA, vol. 16, pp. 14–18, Sep. 2026, doi: 10.70267/aitia.20261418.