Skip to content

Dara Bahri

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

5

Active years

2020–2024

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2024ICMLA Universal Class of Sharpness-Aware Minimization Algorithms.Behrooz Tahmasebi, Ashkan Soleymani, Dara Bahri, Stefanie Jegelka, Patrick Jaillet
2023ICLRUL2: Unifying Language Learning Paradigms.Yi Tay, Mostafa Dehghani, Vinh Q. Tran, Xavier Garcia, Jason Wei, Xuezhi Wang, Hyung Won Chung, Dara Bahri, Tal Schuster, Huaixiu Steven Zheng, Denny Zhou, Neil Houlsby, Donald Metzler
2023SIGIRSurprise: Result List Truncation via Extreme Value Theory.Dara Bahri, Che Zheng, Yi Tay, Donald Metzler, Andrew Tomkins
2022ACLED2LM: Encoder-Decoder to Language Model for Faster Document Re-ranking Inference.Kai Hui, Honglei Zhuang, Tao Chen, Zhen Qin, Jing Lu, Dara Bahri, Ji Ma, Jai Prakash Gupta, Ccero Nogueira dos Santos, Yi Tay, Donald Metzler
2022ACLSharpness-Aware Minimization Improves Language Model Generalization.Dara Bahri, Hossein Mobahi, Yi Tay
2022ICLRExT5: Towards Extreme Multi-Task Scaling for Transfer Learning.Vamsi Aribandi, Yi Tay, Tal Schuster, Jinfeng Rao, Huaixiu Steven Zheng, Sanket Vaibhav Mehta, Honglei Zhuang, Vinh Q. Tran, Dara Bahri, Jianmo Ni, Jai Prakash Gupta, Kai Hui, Sebastian Ruder, Donald Metzler
2022ICLRScarf: Self-Supervised Contrastive Learning using Random Feature Corruption.Dara Bahri, Heinrich Jiang, Yi Tay, Donald Metzler
2022ICLRChurn Reduction via Distillation.Heinrich Jiang, Harikrishna Narasimhan, Dara Bahri, Andrew Cotter, Afshin Rostamizadeh
2022ICLRCharformer: Fast Character Transformers via Gradient-based Subword Tokenization.Yi Tay, Vinh Q. Tran, Sebastian Ruder, Jai Prakash Gupta, Hyung Won Chung, Dara Bahri, Zhen Qin, Simon Baumgartner, Cong Yu, Donald Metzler
2021ACLStructFormer: Joint Unsupervised Induction of Dependency and Constituency Structure from Masked Language Modeling.Yikang Shen, Yi Tay, Che Zheng, Dara Bahri, Donald Metzler, Aaron C. Courville
2021ACLAre Pretrained Convolutions Better than Pretrained Transformers?Yi Tay, Mostafa Dehghani, Jai Prakash Gupta, Vamsi Aribandi, Dara Bahri, Zhen Qin, Donald Metzler
2021ICLRLong Range Arena : A Benchmark for Efficient Transformers.Yi Tay, Mostafa Dehghani, Samira Abnar, Yikang Shen, Dara Bahri, Philip Pham, Jinfeng Rao, Liu Yang, Sebastian Ruder, Donald Metzler
2021ICLRHyperGrid Transformers: Towards A Single Model for Multiple Tasks.Yi Tay, Zhe Zhao, Dara Bahri, Donald Metzler, Da-Cheng Juan
2021ICMLLocally Adaptive Label Smoothing Improves Predictive Churn.Dara Bahri, Heinrich Jiang
2021ICMLOmniNet: Omnidirectional Representations from Transformers.Yi Tay, Mostafa Dehghani, Vamsi Aribandi, Jai Prakash Gupta, Philip Pham, Zhen Qin, Dara Bahri, Da-Cheng Juan, Donald Metzler
2021ICMLSynthesizer: Rethinking Self-Attention for Transformer Models.Yi Tay, Dara Bahri, Donald Metzler, Da-Cheng Juan, Zhe Zhao, Che Zheng
2021WSDMGenerative Models are Unsupervised Predictors of Page Quality: A Colossal-Scale Study.Dara Bahri, Yi Tay, Che Zheng, Cliff Brunk, Donald Metzler, Andrew Tomkins
2020ACLReverse Engineering Configurations of Neural Text Generation Models.Yi Tay, Dara Bahri, Che Zheng, Clifford Brunk, Donald Metzler, Andrew Tomkins
2020ICMLDeep k-NN for Noisy Labels.Dara Bahri, Heinrich Jiang, Maya R. Gupta
2020ICMLSparse Sinkhorn Attention.Yi Tay, Dara Bahri, Liu Yang, Donald Metzler, Da-Cheng Juan
2020SIGIRChoppy: Cut Transformer for Ranked List Truncation.Dara Bahri, Yi Tay, Che Zheng, Donald Metzler, Andrew Tomkins