Comparing Bad Apples to Good Oranges Aligning Large Language Models via Joint Preference Optimization.
Hritik Bansal, Ashima Suvarna, Gantavya Bhatt, Nanyun Peng, Kai-Wei Chang, Aditya Grover
Browse the full ACL paper archive.
Hritik Bansal, Ashima Suvarna, Gantavya Bhatt, Nanyun Peng, Kai-Wei Chang, Aditya Grover
Browse the full ACL paper archive.