Yinfei Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
64
Venues
18
Active years
2012–2025
Best venue rank
A*
Where they publish
Papers
64 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | Improve Vision Language Model Chain-of-thought Reasoning. | Ruohong Zhang, Bowen Zhang, Yanghao Li, Haotian Zhang, Zhiqing Sun, Zhe Gan, Yinfei Yang, Ruoming Pang, Yiming Yang |
| 2025 | CVPR | Multimodal Autoregressive Pre-training of Large Vision Encoders. | Enrico Fini, Mustafa Shukor, Xiujun Li, Philipp Dufter, Michal Klein, David Haldimann, Sai Aitharaju, Victor G. Turrisi da Costa, Louis Bthune, Zhe Gan, Alexander Toshev, Marcin Eichner, Moin Nabi, Yinfei Yang, Joshua M. Susskind, Alaaeldin El-Nouby |
| 2025 | EMNLP | CLIP-UP: A Simple and Efficient Mixture-of-Experts CLIP Training Recipe with Sparse Upcycling. | Xinze Wang, Chen Chen, Yinfei Yang, Hong-You Chen, Bowen Zhang, Aditya Pal, Xiangxin Zhu, Xianzhi Du |
| 2025 | ICCV | MM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs. | Erik A. Daxberger, Nina Wenzel, David Griffiths, Haiming Gang, Justin Lazarow, Gefen Kohavi, Kai Kang, Marcin Eichner, Yinfei Yang, Afshin Dehghan, Peter Grasch |
| 2025 | ICCV | UniVG: A Generalist Diffusion Model for Unified Image Generation and Editing. | Tsu-Jui Fu, Yusu Qian, Chen Chen, Wenze Hu, Zhe Gan, Yinfei Yang |
| 2025 | ICCV | STIV: Scalable Text and Image Conditioned Video Generation. | Zongyu Lin, Wei Liu, Chen Chen, Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Lezhi Li, Yinfei Yang, Yizhou Sun, Kai-Wei Chang |
| 2025 | ICLR | Revisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models. | Zhengfeng Lai, Vasileios Saveris, Chen Chen, Hong-You Chen, Haotian Zhang, Bowen Zhang, Wenze Hu, Juan Lao Tebar, Zhe Gan, Peter Grasch, Meng Cao, Yinfei Yang |
| 2025 | ICLR | Ferret-UI 2: Mastering Universal User Interface Understanding Across Platforms. | Zhangheng Li, Keen You, Haotian Zhang, Di Feng, Harsh Agrawal, Xiujun Li, Mohana Prasad Sathya Moorthy, Jeffrey Nichols, Yinfei Yang, Zhe Gan |
| 2025 | ICLR | MIA-Bench: Towards Better Instruction Following Evaluation of Multimodal LLMs. | Yusu Qian, Hanrong Ye, Jean-Philippe Fauconnier, Peter Grasch, Yinfei Yang, Zhe Gan |
| 2025 | ICLR | MMEgo: Towards Building Egocentric Multimodal LLMs for Video QA. | Hanrong Ye, Haotian Zhang, Erik A. Daxberger, Lin Chen, Zongyu Lin, Yanghao Li, Bowen Zhang, Haoxuan You, Dan Xu, Zhe Gan, Jiasen Lu, Yinfei Yang |
| 2025 | ICML | Contrastive Localized Language-Image Pre-Training. | Hong-You Chen, Zhengfeng Lai, Haotian Zhang, Xinze Wang, Marcin Eichner, Keen You, Meng Cao, Bowen Zhang, Yinfei Yang, Zhe Gan |
| 2025 | ICONIP | SDSP: Scalable and Diverse Synthetic Pairwise Text Generation from Web Corpus Using Large Language Model. | Xiaoxu Wu, Xi Li, Wentao Wu, Aleksei Timofeev, Yinfei Yang, Meng Cao, Ping Huang, Si Liu, Jiulong Shan |
| 2024 | EACL | On the Intractability to Synthesize Factual Inconsistencies in Summarization. | Ge Luo, Weisi Fan, Miaoran Li, Youbiao He, Yinfei Yang, Forrest Sheng Bao |
| 2024 | ECCV | VeCLIP: Improving CLIP Training via Visual-Enriched Captions. | Zhengfeng Lai, Haotian Zhang, Bowen Zhang, Wentao Wu, Haoping Bai, Aleksei Timofeev, Xianzhi Du, Zhe Gan, Jiulong Shan, Chen-Nee Chuah, Yinfei Yang, Meng Cao |
| 2024 | ECCV | MM1: Methods, Analysis and Insights from Multimodal LLM Pre-training. | Brandon McKinzie, Zhe Gan, Jean-Philippe Fauconnier, Sam Dodge, Bowen Zhang, Philipp Dufter, Dhruti Shah, Xianzhi Du, Futang Peng, Anton Belyi, Haotian Zhang, Karanjeet Singh, Doug Kang, Hongyu H, Max Schwarzer, Tom Gunter, Xiang Kong, Aonan Zhang, Jianyu Wang, Chong Wang, Nan Du, Tao Lei, Sam Wiseman, Mark Lee, Zirui Wang, Ruoming Pang, Peter Grasch, Alexander Toshev, Yinfei Yang |
| 2024 | ECCV | Ferret-UI: Grounded Mobile UI Understanding with Multimodal LLMs. | Keen You, Haotian Zhang, Eldon Schoop, Floris Weers, Amanda Swearngin, Jeffrey Nichols, Yinfei Yang, Zhe Gan |
| 2024 | ICLR | Guiding Instruction-based Image Editing via Multimodal Large Language Models. | Tsu-Jui Fu, Wenze Hu, Xianzhi Du, William Yang Wang, Yinfei Yang, Zhe Gan |
| 2024 | ICLR | Compressing LLMs: The Truth is Rarely Pure and Never Simple. | Ajay Kumar Jaiswal, Zhe Gan, Xianzhi Du, Bowen Zhang, Zhangyang Wang, Yinfei Yang |
| 2024 | ICLR | MOFI: Learning Image Representations from Noisy Entity Annotated Images. | Wentao Wu, Aleksei Timofeev, Chen Chen, Bowen Zhang, Kun Duan, Shuangning Liu, Yantao Zheng, Jonathon Shlens, Xianzhi Du, Yinfei Yang |
| 2024 | ICLR | Ferret: Refer and Ground Anything Anywhere at Any Granularity. | Haoxuan You, Haotian Zhang, Zhe Gan, Xianzhi Du, Bowen Zhang, Zirui Wang, Liangliang Cao, Shih-Fu Chang, Yinfei Yang |
| 2024 | WACV | Empowering Unsupervised Domain Adaptation with Large-scale Pre-trained Vision-Language Models. | Zhengfeng Lai, Haoping Bai, Haotian Zhang, Xianzhi Du, Jiulong Shan, Yinfei Yang, Chen-Nee Chuah, Meng Cao |
| 2023 | AAAI | Simple and Effective Synthesis of Indoor 3D Scenes. | Jing Yu Koh, Harsh Agrawal, Dhruv Batra, Richard Tucker, Austin Waters, Honglak Lee, Yinfei Yang, Jason Baldridge, Peter Anderson |
| 2023 | CVPR | A New Path: Scaling Vision-and-Language Navigation with Synthetic Instructions and Imitation Learning. | Aishwarya Kamath, Peter Anderson, Su Wang, Jing Yu Koh, Alexander Ku, Austin Waters, Yinfei Yang, Jason Baldridge, Zarana Parekh |
| 2023 | CVPR | Masked Autoencoding Does Not Help Natural Language Supervision at Scale. | Floris Weers, Vaishaal Shankar, Angelos Katharopoulos, Yinfei Yang, Tom Gunter |
| 2023 | EMNLP | DocAsRef: An Empirical Study on Repurposing Reference-based Summary Quality Metrics as Reference-free Metrics. | Forrest Sheng Bao, Ruixuan Tu, Ge Luo, Yinfei Yang, Hebi Li, Minghui Qiu, Youbiao He, Cen Chen |
| 2023 | EMNLP | STAIR: Learning Sparse Text and Image Representation in Grounded Tokens. | Chen Chen, Bowen Zhang, Liangliang Cao, Jiguang Shen, Tom Gunter, Albin Madappally Jose, Alexander Toshev, Yantao Zheng, Jonathon Shlens, Ruoming Pang, Yinfei Yang |
| 2023 | ICCV | Perceptual Grouping in Contrastive Vision-Language Models. | Kanchana Ranasinghe, Brandon McKinzie, Sachin Ravi, Yinfei Yang, Alexander Toshev, Jonathon Shlens |
| 2023 | ICML | Robustness in Multimodal Learning under Train-Test Modality Mismatch. | Brandon McKinzie, Vaishaal Shankar, Joseph Yitan Cheng, Yinfei Yang, Jonathon Shlens, Alexander T. Toshev |
| 2022 | ACL | Language-agnostic BERT Sentence Embedding. | Fangxiaoyu Feng, Yinfei Yang, Daniel Cer, Naveen Arivazhagan, Wei Wang |
| 2022 | ACL | Sentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models. | Jianmo Ni, Gustavo Hernndez brego, Noah Constant, Ji Ma, Keith B. Hall, Daniel Cer, Yinfei Yang |
| 2022 | EMNLP | Large Dual Encoders Are Generalizable Retrievers. | Jianmo Ni, Chen Qu, Jing Lu, Zhuyun Dai, Gustavo Hernndez brego, Ji Ma, Vincent Y. Zhao, Yi Luan, Keith B. Hall, Ming-Wei Chang, Yinfei Yang |
| 2022 | NAACL | SueNes: A Weakly Supervised Approach to Evaluating Single-Document Summarization via Negative Sampling. | Forrest Sheng Bao, Ge Luo, Hebi Li, Minghui Qiu, Yinfei Yang, Youbiao He, Cen Chen |
| 2022 | NAACL | LongT5: Efficient Text-To-Text Transformer for Long Sequences. | Mandy Guo, Joshua Ainslie, David C. Uthus, Santiago Ontan, Jianmo Ni, Yun-Hsuan Sung, Yinfei Yang |
| 2021 | ACL | Neural Retrieval for Question Answering with Cross-Attention Supervised Data Augmentation. | Yinfei Yang, Ning Jin, Kuo Lin, Mandy Guo, Daniel Cer |
| 2021 | CVPR | Cross-Modal Contrastive Learning for Text-to-Image Generation. | Han Zhang, Jing Yu Koh, Jason Baldridge, Honglak Lee, Yinfei Yang |
| 2021 | EACL | Zero-shot Neural Passage Retrieval via Domain-targeted Synthetic Question Generation. | Ji Ma, Ivan Korotkov, Yinfei Yang, Keith B. Hall, Ryan T. McDonald |
| 2021 | EACL | Crisscrossed Captions: Extended Intramodal and Intermodal Semantic Similarity Judgments for MS-COCO. | Zarana Parekh, Jason Baldridge, Daniel Cer, Austin Waters, Yinfei Yang |
| 2021 | EMNLP | MURAL: Multimodal, Multitask Representations Across Languages. | Aashi Jain, Mandy Guo, Krishna Srinivasan, Ting Chen, Sneha Kudugunta, Chao Jia, Yinfei Yang, Jason Baldridge |
| 2021 | EMNLP | Multi-stage Training with Improved Negative Contrast for Neural Passage Retrieval. | Jing Lu, Gustavo Hernndez brego, Ji Ma, Jianmo Ni, Yinfei Yang |
| 2021 | EMNLP | A Simple and Effective Method To Eliminate the Self Language Bias in Multilingual Representations. | Ziyi Yang, Yinfei Yang, Daniel Cer, Eric Darve |
| 2021 | EMNLP | Universal Sentence Representation Learning with Conditional Masked Language Model. | Ziyi Yang, Yinfei Yang, Daniel Cer, Jax Law, Eric Darve |
| 2021 | ICCV | Pathdreamer: A World Model for Indoor Navigation. | Jing Yu Koh, Honglak Lee, Yinfei Yang, Jason Baldridge, Peter Anderson |
| 2021 | ICML | Scaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision. | Chao Jia, Yinfei Yang, Ye Xia, Yi-Ting Chen, Zarana Parekh, Hieu Pham, Quoc V. Le, Yun-Hsuan Sung, Zhen Li, Tom Duerig |
| 2021 | WACV | Text-to-Image Generation Grounded by Fine-Grained User Attention. | Jing Yu Koh, Jason Baldridge, Honglak Lee, Yinfei Yang |
| 2020 | ACL | Learning a Multi-Domain Curriculum for Neural Machine Translation. | Wei Wang, Ye Tian, Jiquan Ngiam, Yinfei Yang, Isaac Caswell, Zarana Parekh |
| 2020 | ACL | Multilingual Universal Sentence Encoder for Semantic Retrieval. | Yinfei Yang, Daniel Cer, Amin Ahmad, Mandy Guo, Jax Law, Noah Constant, Gustavo Hernndez brego, Steve Yuan, Chris Tar, Yun-Hsuan Sung, Brian Strope, Ray Kurzweil |
| 2020 | EMNLP | LAReQA: Language-Agnostic Answer Retrieval from a Multilingual Pool. | Uma Roy, Noah Constant, Rami Al-Rfou, Aditya Barua, Aaron Phillips, Yinfei Yang |
| 2020 | IJCNLP | Self-Supervised Learning for Pairwise Data Refinement. | Gustavo Hernndez brego, Bowen Liang, Wei Wang, Zarana Parekh, Yinfei Yang, Yun-Hsuan Sung |
| 2019 | EMNLP | PAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification. | Yinfei Yang, Yuan Zhang, Chris Tar, Jason Baldridge |
| 2019 | IJCAI | Improving Multilingual Sentence Embedding using Bi-directional Dual Encoder with Additive Margin Softmax. | Yinfei Yang, Gustavo Hernndez brego, Steve Yuan, Mandy Guo, Qinlan Shen, Daniel Cer, Yun-Hsuan Sung, Brian Strope, Ray Kurzweil |
| 2019 | NAACL | Predicting Annotation Difficulty to Improve Task Routing and Model Performance for Biomedical Information Extraction. | Yinfei Yang, Oshin Agarwal, Chris Tar, Byron C. Wallace, Ani Nenkova |
| 2019 | WWW | Multi-Domain Gated CNN for Review Helpfulness Prediction. | Cen Chen, Minghui Qiu, Yinfei Yang, Jun Zhou, Jun Huang, Xiaolong Li, Forrest Sheng Bao |
| 2018 | ACL | A Corpus with Multi-Level Annotations of Patients, Interventions and Outcomes to Support Language Processing for Medical Literature. | Benjamin E. Nye, Junyi Jessy Li, Roma Patel, Yinfei Yang, Iain James Marshall, Ani Nenkova, Byron C. Wallace |
| 2018 | EMNLP | Universal Sentence Encoder for English. | Daniel Cer, Yinfei Yang, Sheng-yi Kong, Nan Hua, Nicole Limtiaco, Rhomni St. John, Noah Constant, Mario Guajardo-Cespedes, Steve Yuan, Chris Tar, Brian Strope, Ray Kurzweil |
| 2018 | NAACL | Cross-Domain Review Helpfulness Prediction Based on Convolutional Neural Networks with Auxiliary Domain Discriminators. | Cen Chen, Yinfei Yang, Jun Zhou, Xiaolong Li, Forrest Sheng Bao |
| 2018 | NAACL | Syntactic Patterns Improve Information Extraction for Medical Search. | Roma Patel, Yinfei Yang, Iain James Marshall, Ani Nenkova, Byron C. Wallace |
| 2017 | EACL | Detecting (Un)Important Content for Single-Document News Summarization. | Yinfei Yang, Forrest Sheng Bao, Ani Nenkova |
| 2017 | EACL | Aspect Extraction from Product Reviews Using Category Hierarchy Information. | Yinfei Yang, Cen Chen, Minghui Qiu, Forrest Sheng Bao |
| 2016 | ICTAI | Aspect-Based Helpfulness Prediction for Online Product Reviews. | Yinfei Yang, Cen Chen, Forrest Sheng Bao |
| 2015 | ACL | Semantic Analysis and Helpfulness Prediction of Text for Online Product Reviews. | Yinfei Yang, Yaowei Yan, Minghui Qiu, Forrest Sheng Bao |
| 2014 | AAAI | Detecting Information-Dense Texts in Multiple News Domains. | Yinfei Yang, Ani Nenkova |
| 2014 | ICRA | Single image 3D object detection and pose estimation for grasping. | Menglong Zhu, Konstantinos G. Derpanis, Yinfei Yang, Samarth Brahmbhatt, Mabel M. Zhang, Cody J. Phillips, Matthieu Lecce, Kostas Daniilidis |
| 2012 | ACCV | Navigation toward Non-static Target Object Using Footprint Detection Based Tracking. | Meng Yi, Yinfei Yang, Wenjing Qi, Yu Zhou, Yunfeng Li, Zygmunt Pizlo, Longin Jan Latecki |
| 2012 | EMNLP | Linking Named Entities to Any Database. | Avirup Sil, Ernest Cronin, Penghai Nie, Yinfei Yang, Ana-Maria Popescu, Alexander Yates |