Dara Bahri
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
5
Active years
2020–2024
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2024 | ICML | A Universal Class of Sharpness-Aware Minimization Algorithms. | Behrooz Tahmasebi, Ashkan Soleymani, Dara Bahri, Stefanie Jegelka, Patrick Jaillet |
| 2023 | ICLR | UL2: Unifying Language Learning Paradigms. | Yi Tay, Mostafa Dehghani, Vinh Q. Tran, Xavier Garcia, Jason Wei, Xuezhi Wang, Hyung Won Chung, Dara Bahri, Tal Schuster, Huaixiu Steven Zheng, Denny Zhou, Neil Houlsby, Donald Metzler |
| 2023 | SIGIR | Surprise: Result List Truncation via Extreme Value Theory. | Dara Bahri, Che Zheng, Yi Tay, Donald Metzler, Andrew Tomkins |
| 2022 | ACL | ED2LM: Encoder-Decoder to Language Model for Faster Document Re-ranking Inference. | Kai Hui, Honglei Zhuang, Tao Chen, Zhen Qin, Jing Lu, Dara Bahri, Ji Ma, Jai Prakash Gupta, Ccero Nogueira dos Santos, Yi Tay, Donald Metzler |
| 2022 | ACL | Sharpness-Aware Minimization Improves Language Model Generalization. | Dara Bahri, Hossein Mobahi, Yi Tay |
| 2022 | ICLR | ExT5: Towards Extreme Multi-Task Scaling for Transfer Learning. | Vamsi Aribandi, Yi Tay, Tal Schuster, Jinfeng Rao, Huaixiu Steven Zheng, Sanket Vaibhav Mehta, Honglei Zhuang, Vinh Q. Tran, Dara Bahri, Jianmo Ni, Jai Prakash Gupta, Kai Hui, Sebastian Ruder, Donald Metzler |
| 2022 | ICLR | Scarf: Self-Supervised Contrastive Learning using Random Feature Corruption. | Dara Bahri, Heinrich Jiang, Yi Tay, Donald Metzler |
| 2022 | ICLR | Churn Reduction via Distillation. | Heinrich Jiang, Harikrishna Narasimhan, Dara Bahri, Andrew Cotter, Afshin Rostamizadeh |
| 2022 | ICLR | Charformer: Fast Character Transformers via Gradient-based Subword Tokenization. | Yi Tay, Vinh Q. Tran, Sebastian Ruder, Jai Prakash Gupta, Hyung Won Chung, Dara Bahri, Zhen Qin, Simon Baumgartner, Cong Yu, Donald Metzler |
| 2021 | ACL | StructFormer: Joint Unsupervised Induction of Dependency and Constituency Structure from Masked Language Modeling. | Yikang Shen, Yi Tay, Che Zheng, Dara Bahri, Donald Metzler, Aaron C. Courville |
| 2021 | ACL | Are Pretrained Convolutions Better than Pretrained Transformers? | Yi Tay, Mostafa Dehghani, Jai Prakash Gupta, Vamsi Aribandi, Dara Bahri, Zhen Qin, Donald Metzler |
| 2021 | ICLR | Long Range Arena : A Benchmark for Efficient Transformers. | Yi Tay, Mostafa Dehghani, Samira Abnar, Yikang Shen, Dara Bahri, Philip Pham, Jinfeng Rao, Liu Yang, Sebastian Ruder, Donald Metzler |
| 2021 | ICLR | HyperGrid Transformers: Towards A Single Model for Multiple Tasks. | Yi Tay, Zhe Zhao, Dara Bahri, Donald Metzler, Da-Cheng Juan |
| 2021 | ICML | Locally Adaptive Label Smoothing Improves Predictive Churn. | Dara Bahri, Heinrich Jiang |
| 2021 | ICML | OmniNet: Omnidirectional Representations from Transformers. | Yi Tay, Mostafa Dehghani, Vamsi Aribandi, Jai Prakash Gupta, Philip Pham, Zhen Qin, Dara Bahri, Da-Cheng Juan, Donald Metzler |
| 2021 | ICML | Synthesizer: Rethinking Self-Attention for Transformer Models. | Yi Tay, Dara Bahri, Donald Metzler, Da-Cheng Juan, Zhe Zhao, Che Zheng |
| 2021 | WSDM | Generative Models are Unsupervised Predictors of Page Quality: A Colossal-Scale Study. | Dara Bahri, Yi Tay, Che Zheng, Cliff Brunk, Donald Metzler, Andrew Tomkins |
| 2020 | ACL | Reverse Engineering Configurations of Neural Text Generation Models. | Yi Tay, Dara Bahri, Che Zheng, Clifford Brunk, Donald Metzler, Andrew Tomkins |
| 2020 | ICML | Deep k-NN for Noisy Labels. | Dara Bahri, Heinrich Jiang, Maya R. Gupta |
| 2020 | ICML | Sparse Sinkhorn Attention. | Yi Tay, Dara Bahri, Liu Yang, Donald Metzler, Da-Cheng Juan |
| 2020 | SIGIR | Choppy: Cut Transformer for Ranked List Truncation. | Dara Bahri, Yi Tay, Che Zheng, Donald Metzler, Andrew Tomkins |