Lambert, Pierre, and Maja Eriksen. “Reward Modeling from Human Feedback Improves Controllability in Large Generative Models”. International Journal of Advanced Engineering and Technology Research, vol. 2, no. 1, May 2026, pp. 13-19, https://doi.org/10.54097/z5t42855.