Auto-ARGUE: LLM-Based Report Generation Evaluation.
William Gantt Walden, Marc Mason, Orion Weller, Laura Dietz, John M. Conroy, Neil P. Molino, Hannah Recknor, Bryan Li, Gabrielle K. Liu, Yu Hou, Dawn J. Lawrie, James Mayfield, Eugene Yang
Browse the full SIGIR paper archive.