Skip to content

Transformers can optimally learn regression mixture models.

Reese Pathak, Rajat Sen, Weihao Kong, Abhimanyu Das

VenueA*ICLR
Year2024
ProceedingsICLR

Browse the full ICLR paper archive.