MLP-Attention: Improving Transformer Architecture with MLP Attention Weights.
Alireza Morsali, Moein Heidari, Samin Heydarian, Tohid Abedini
Browse the full ICLR paper archive.
Alireza Morsali, Moein Heidari, Samin Heydarian, Tohid Abedini
Browse the full ICLR paper archive.