Skip to content

Reward-Shifted Speculative Sampling Is An Efficient Test-Time Weak-to-Strong Aligner.

Bolian Li, Yanran Wu, Xinyu Luo, Ruqi Zhang

VenueA*EMNLP
Year2025
ProceedingsEMNLP

Browse the full EMNLP paper archive.