TIAN, Fengrui. Progress and Analysis of Optimization for Large Language Models Based on Reinforcement Learning. Exploring Science Academic Conference Series, [S. l.], v. 16, p. 14–18, 2026. DOI: 10.70267/aitia.20261418. Disponível em: https://journals.zeuspress.org/index.php/conference/article/view/1284. Acesso em: 14 sep. 2026.