Tian, Fengrui. “Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning”. Exploring Science Academic Conference Series 16 (September 13, 2026): 14–18. Accessed September 14, 2026. https://journals.zeuspress.org/index.php/conference/article/view/1284.