Skip to content

Exploration-Driven Reinforcement Learning for Expert Routing Improvement in Mixture-of-Experts Language Models.

Gyunyeop Kim, Sangwoo Kang

VenueA*EMNLP
Year2025
ProceedingsEMNLP (Findings)

Browse the full EMNLP paper archive.