Self-Explore: Enhancing Mathematical Reasoning in Language Models with Fine-grained Rewards.
Hyeonbin Hwang, Doyoung Kim, Seungone Kim, Seonghyeon Ye, Minjoon Seo
Browse the full EMNLP paper archive.
Hyeonbin Hwang, Doyoung Kim, Seungone Kim, Seonghyeon Ye, Minjoon Seo
Browse the full EMNLP paper archive.