Skip to content

trlX: A Framework for Large Scale Reinforcement Learning from Human Feedback.

Alexander Havrilla, Maksym Zhuravinskyi, Duy Phung, Aman Tiwari, Jonathan Tow, Stella Biderman, Quentin Anthony, Louis Castricato

VenueA*EMNLP
Year2023
ProceedingsEMNLP

Browse the full EMNLP paper archive.