Skip to content

Linear Transformers with Learnable Kernel Functions are Better In-Context Models.

Yaroslav Aksenov, Nikita Balagansky, Sofia Maria Lo Cicero Vaina, Boris Shaposhnikov, Alexey Gorbatovski, Daniil Gavrilov

VenueA*ACL
Year2024
ProceedingsACL (1)

Browse the full ACL paper archive.