Leakage-Adjusted Simulatability: Can Models Generate Non-Trivial Explanations of Their Behavior in Natural Language?
Peter Hase, Shiyue Zhang, Harry Xie, Mohit Bansal
Browse the full EMNLP paper archive.
Peter Hase, Shiyue Zhang, Harry Xie, Mohit Bansal
Browse the full EMNLP paper archive.