1.
Tian F. Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning. ESA [Internet]. 2026 Sep. 13 [cited 2026 Sep. 14];16:14-8. Available from: https://journals.zeuspress.org/index.php/conference/article/view/1284