1.
Lambert P, Eriksen M. Reward Modeling from Human Feedback Improves Controllability in Large Generative Models. IJAETR [Internet]. 2026 May 12 [cited 2026 Jul. 28];2(1):13-9. Available from: https://ijaetr.org/index.php/ojs/article/view/85