Group-Aware Reinforcement Learning for Output Diversity in Large Language Models.
Oron Anschel, Alon Shoshan, Adam Botach, Shunit Haviv Hakimi, Asaf Gendler, Emanuel Ben Baruch, Nadav Bhonker, Igor Kviatkovsky, Manoj Aggarwal, Grard G. Medioni
Browse the full EMNLP paper archive.