Skip to content

Should I try multiple optimizers when fine-tuning a pre-trained Transformer for NLP tasks? Should I tune their hyperparameters?

Nefeli Gkouti, Prodromos Malakasiotis, Stavros Toumpis, Ion Androutsopoulos

VenueAEACL
Year2024
ProceedingsEACL (1)

Browse the full EACL paper archive.