[1]
“Adaptive Reward Modeling for Large Language Model Reasoning Using Response Quality Prediction and Explainable Machine Learning Techniques”, JAAIR, vol. 5, no. 1, Jun. 2026, Accessed: Jul. 29, 2026. [Online]. Available: https://www.jaair.org/index.php/home/article/view/40