1.
Causal Evaluation of Planning Strategies in Large Language Models Through Interpretable Quality Prediction and Counterfactual Reinforcement Learning. JAAIR [Internet]. 2026 May 29 [cited 2026 Jul. 29];5(1). Available from: https://www.jaair.org/index.php/home/article/view/32