Skip to content

Yinfei Yang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

64

Venues

18

Active years

2012–2025

Best venue rank

A*

Where they publish

Papers

64 indexed papers, newest first.

YearVenueTitleAuthors
2025ACLImprove Vision Language Model Chain-of-thought Reasoning.Ruohong Zhang, Bowen Zhang, Yanghao Li, Haotian Zhang, Zhiqing Sun, Zhe Gan, Yinfei Yang, Ruoming Pang, Yiming Yang
2025CVPRMultimodal Autoregressive Pre-training of Large Vision Encoders.Enrico Fini, Mustafa Shukor, Xiujun Li, Philipp Dufter, Michal Klein, David Haldimann, Sai Aitharaju, Victor G. Turrisi da Costa, Louis Bthune, Zhe Gan, Alexander Toshev, Marcin Eichner, Moin Nabi, Yinfei Yang, Joshua M. Susskind, Alaaeldin El-Nouby
2025EMNLPCLIP-UP: A Simple and Efficient Mixture-of-Experts CLIP Training Recipe with Sparse Upcycling.Xinze Wang, Chen Chen, Yinfei Yang, Hong-You Chen, Bowen Zhang, Aditya Pal, Xiangxin Zhu, Xianzhi Du
2025ICCVMM-Spatial: Exploring 3D Spatial Understanding in Multimodal LLMs.Erik A. Daxberger, Nina Wenzel, David Griffiths, Haiming Gang, Justin Lazarow, Gefen Kohavi, Kai Kang, Marcin Eichner, Yinfei Yang, Afshin Dehghan, Peter Grasch
2025ICCVUniVG: A Generalist Diffusion Model for Unified Image Generation and Editing.Tsu-Jui Fu, Yusu Qian, Chen Chen, Wenze Hu, Zhe Gan, Yinfei Yang
2025ICCVSTIV: Scalable Text and Image Conditioned Video Generation.Zongyu Lin, Wei Liu, Chen Chen, Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Lezhi Li, Yinfei Yang, Yizhou Sun, Kai-Wei Chang
2025ICLRRevisit Large-Scale Image-Caption Data in Pre-training Multimodal Foundation Models.Zhengfeng Lai, Vasileios Saveris, Chen Chen, Hong-You Chen, Haotian Zhang, Bowen Zhang, Wenze Hu, Juan Lao Tebar, Zhe Gan, Peter Grasch, Meng Cao, Yinfei Yang
2025ICLRFerret-UI 2: Mastering Universal User Interface Understanding Across Platforms.Zhangheng Li, Keen You, Haotian Zhang, Di Feng, Harsh Agrawal, Xiujun Li, Mohana Prasad Sathya Moorthy, Jeffrey Nichols, Yinfei Yang, Zhe Gan
2025ICLRMIA-Bench: Towards Better Instruction Following Evaluation of Multimodal LLMs.Yusu Qian, Hanrong Ye, Jean-Philippe Fauconnier, Peter Grasch, Yinfei Yang, Zhe Gan
2025ICLRMMEgo: Towards Building Egocentric Multimodal LLMs for Video QA.Hanrong Ye, Haotian Zhang, Erik A. Daxberger, Lin Chen, Zongyu Lin, Yanghao Li, Bowen Zhang, Haoxuan You, Dan Xu, Zhe Gan, Jiasen Lu, Yinfei Yang
2025ICMLContrastive Localized Language-Image Pre-Training.Hong-You Chen, Zhengfeng Lai, Haotian Zhang, Xinze Wang, Marcin Eichner, Keen You, Meng Cao, Bowen Zhang, Yinfei Yang, Zhe Gan
2025ICONIPSDSP: Scalable and Diverse Synthetic Pairwise Text Generation from Web Corpus Using Large Language Model.Xiaoxu Wu, Xi Li, Wentao Wu, Aleksei Timofeev, Yinfei Yang, Meng Cao, Ping Huang, Si Liu, Jiulong Shan
2024EACLOn the Intractability to Synthesize Factual Inconsistencies in Summarization.Ge Luo, Weisi Fan, Miaoran Li, Youbiao He, Yinfei Yang, Forrest Sheng Bao
2024ECCVVeCLIP: Improving CLIP Training via Visual-Enriched Captions.Zhengfeng Lai, Haotian Zhang, Bowen Zhang, Wentao Wu, Haoping Bai, Aleksei Timofeev, Xianzhi Du, Zhe Gan, Jiulong Shan, Chen-Nee Chuah, Yinfei Yang, Meng Cao
2024ECCVMM1: Methods, Analysis and Insights from Multimodal LLM Pre-training.Brandon McKinzie, Zhe Gan, Jean-Philippe Fauconnier, Sam Dodge, Bowen Zhang, Philipp Dufter, Dhruti Shah, Xianzhi Du, Futang Peng, Anton Belyi, Haotian Zhang, Karanjeet Singh, Doug Kang, Hongyu H, Max Schwarzer, Tom Gunter, Xiang Kong, Aonan Zhang, Jianyu Wang, Chong Wang, Nan Du, Tao Lei, Sam Wiseman, Mark Lee, Zirui Wang, Ruoming Pang, Peter Grasch, Alexander Toshev, Yinfei Yang
2024ECCVFerret-UI: Grounded Mobile UI Understanding with Multimodal LLMs.Keen You, Haotian Zhang, Eldon Schoop, Floris Weers, Amanda Swearngin, Jeffrey Nichols, Yinfei Yang, Zhe Gan
2024ICLRGuiding Instruction-based Image Editing via Multimodal Large Language Models.Tsu-Jui Fu, Wenze Hu, Xianzhi Du, William Yang Wang, Yinfei Yang, Zhe Gan
2024ICLRCompressing LLMs: The Truth is Rarely Pure and Never Simple.Ajay Kumar Jaiswal, Zhe Gan, Xianzhi Du, Bowen Zhang, Zhangyang Wang, Yinfei Yang
2024ICLRMOFI: Learning Image Representations from Noisy Entity Annotated Images.Wentao Wu, Aleksei Timofeev, Chen Chen, Bowen Zhang, Kun Duan, Shuangning Liu, Yantao Zheng, Jonathon Shlens, Xianzhi Du, Yinfei Yang
2024ICLRFerret: Refer and Ground Anything Anywhere at Any Granularity.Haoxuan You, Haotian Zhang, Zhe Gan, Xianzhi Du, Bowen Zhang, Zirui Wang, Liangliang Cao, Shih-Fu Chang, Yinfei Yang
2024WACVEmpowering Unsupervised Domain Adaptation with Large-scale Pre-trained Vision-Language Models.Zhengfeng Lai, Haoping Bai, Haotian Zhang, Xianzhi Du, Jiulong Shan, Yinfei Yang, Chen-Nee Chuah, Meng Cao
2023AAAISimple and Effective Synthesis of Indoor 3D Scenes.Jing Yu Koh, Harsh Agrawal, Dhruv Batra, Richard Tucker, Austin Waters, Honglak Lee, Yinfei Yang, Jason Baldridge, Peter Anderson
2023CVPRA New Path: Scaling Vision-and-Language Navigation with Synthetic Instructions and Imitation Learning.Aishwarya Kamath, Peter Anderson, Su Wang, Jing Yu Koh, Alexander Ku, Austin Waters, Yinfei Yang, Jason Baldridge, Zarana Parekh
2023CVPRMasked Autoencoding Does Not Help Natural Language Supervision at Scale.Floris Weers, Vaishaal Shankar, Angelos Katharopoulos, Yinfei Yang, Tom Gunter
2023EMNLPDocAsRef: An Empirical Study on Repurposing Reference-based Summary Quality Metrics as Reference-free Metrics.Forrest Sheng Bao, Ruixuan Tu, Ge Luo, Yinfei Yang, Hebi Li, Minghui Qiu, Youbiao He, Cen Chen
2023EMNLPSTAIR: Learning Sparse Text and Image Representation in Grounded Tokens.Chen Chen, Bowen Zhang, Liangliang Cao, Jiguang Shen, Tom Gunter, Albin Madappally Jose, Alexander Toshev, Yantao Zheng, Jonathon Shlens, Ruoming Pang, Yinfei Yang
2023ICCVPerceptual Grouping in Contrastive Vision-Language Models.Kanchana Ranasinghe, Brandon McKinzie, Sachin Ravi, Yinfei Yang, Alexander Toshev, Jonathon Shlens
2023ICMLRobustness in Multimodal Learning under Train-Test Modality Mismatch.Brandon McKinzie, Vaishaal Shankar, Joseph Yitan Cheng, Yinfei Yang, Jonathon Shlens, Alexander T. Toshev
2022ACLLanguage-agnostic BERT Sentence Embedding.Fangxiaoyu Feng, Yinfei Yang, Daniel Cer, Naveen Arivazhagan, Wei Wang
2022ACLSentence-T5: Scalable Sentence Encoders from Pre-trained Text-to-Text Models.Jianmo Ni, Gustavo Hernndez brego, Noah Constant, Ji Ma, Keith B. Hall, Daniel Cer, Yinfei Yang
2022EMNLPLarge Dual Encoders Are Generalizable Retrievers.Jianmo Ni, Chen Qu, Jing Lu, Zhuyun Dai, Gustavo Hernndez brego, Ji Ma, Vincent Y. Zhao, Yi Luan, Keith B. Hall, Ming-Wei Chang, Yinfei Yang
2022NAACLSueNes: A Weakly Supervised Approach to Evaluating Single-Document Summarization via Negative Sampling.Forrest Sheng Bao, Ge Luo, Hebi Li, Minghui Qiu, Yinfei Yang, Youbiao He, Cen Chen
2022NAACLLongT5: Efficient Text-To-Text Transformer for Long Sequences.Mandy Guo, Joshua Ainslie, David C. Uthus, Santiago Ontan, Jianmo Ni, Yun-Hsuan Sung, Yinfei Yang
2021ACLNeural Retrieval for Question Answering with Cross-Attention Supervised Data Augmentation.Yinfei Yang, Ning Jin, Kuo Lin, Mandy Guo, Daniel Cer
2021CVPRCross-Modal Contrastive Learning for Text-to-Image Generation.Han Zhang, Jing Yu Koh, Jason Baldridge, Honglak Lee, Yinfei Yang
2021EACLZero-shot Neural Passage Retrieval via Domain-targeted Synthetic Question Generation.Ji Ma, Ivan Korotkov, Yinfei Yang, Keith B. Hall, Ryan T. McDonald
2021EACLCrisscrossed Captions: Extended Intramodal and Intermodal Semantic Similarity Judgments for MS-COCO.Zarana Parekh, Jason Baldridge, Daniel Cer, Austin Waters, Yinfei Yang
2021EMNLPMURAL: Multimodal, Multitask Representations Across Languages.Aashi Jain, Mandy Guo, Krishna Srinivasan, Ting Chen, Sneha Kudugunta, Chao Jia, Yinfei Yang, Jason Baldridge
2021EMNLPMulti-stage Training with Improved Negative Contrast for Neural Passage Retrieval.Jing Lu, Gustavo Hernndez brego, Ji Ma, Jianmo Ni, Yinfei Yang
2021EMNLPA Simple and Effective Method To Eliminate the Self Language Bias in Multilingual Representations.Ziyi Yang, Yinfei Yang, Daniel Cer, Eric Darve
2021EMNLPUniversal Sentence Representation Learning with Conditional Masked Language Model.Ziyi Yang, Yinfei Yang, Daniel Cer, Jax Law, Eric Darve
2021ICCVPathdreamer: A World Model for Indoor Navigation.Jing Yu Koh, Honglak Lee, Yinfei Yang, Jason Baldridge, Peter Anderson
2021ICMLScaling Up Visual and Vision-Language Representation Learning With Noisy Text Supervision.Chao Jia, Yinfei Yang, Ye Xia, Yi-Ting Chen, Zarana Parekh, Hieu Pham, Quoc V. Le, Yun-Hsuan Sung, Zhen Li, Tom Duerig
2021WACVText-to-Image Generation Grounded by Fine-Grained User Attention.Jing Yu Koh, Jason Baldridge, Honglak Lee, Yinfei Yang
2020ACLLearning a Multi-Domain Curriculum for Neural Machine Translation.Wei Wang, Ye Tian, Jiquan Ngiam, Yinfei Yang, Isaac Caswell, Zarana Parekh
2020ACLMultilingual Universal Sentence Encoder for Semantic Retrieval.Yinfei Yang, Daniel Cer, Amin Ahmad, Mandy Guo, Jax Law, Noah Constant, Gustavo Hernndez brego, Steve Yuan, Chris Tar, Yun-Hsuan Sung, Brian Strope, Ray Kurzweil
2020EMNLPLAReQA: Language-Agnostic Answer Retrieval from a Multilingual Pool.Uma Roy, Noah Constant, Rami Al-Rfou, Aditya Barua, Aaron Phillips, Yinfei Yang
2020IJCNLPSelf-Supervised Learning for Pairwise Data Refinement.Gustavo Hernndez brego, Bowen Liang, Wei Wang, Zarana Parekh, Yinfei Yang, Yun-Hsuan Sung
2019EMNLPPAWS-X: A Cross-lingual Adversarial Dataset for Paraphrase Identification.Yinfei Yang, Yuan Zhang, Chris Tar, Jason Baldridge
2019IJCAIImproving Multilingual Sentence Embedding using Bi-directional Dual Encoder with Additive Margin Softmax.Yinfei Yang, Gustavo Hernndez brego, Steve Yuan, Mandy Guo, Qinlan Shen, Daniel Cer, Yun-Hsuan Sung, Brian Strope, Ray Kurzweil
2019NAACLPredicting Annotation Difficulty to Improve Task Routing and Model Performance for Biomedical Information Extraction.Yinfei Yang, Oshin Agarwal, Chris Tar, Byron C. Wallace, Ani Nenkova
2019WWWMulti-Domain Gated CNN for Review Helpfulness Prediction.Cen Chen, Minghui Qiu, Yinfei Yang, Jun Zhou, Jun Huang, Xiaolong Li, Forrest Sheng Bao
2018ACLA Corpus with Multi-Level Annotations of Patients, Interventions and Outcomes to Support Language Processing for Medical Literature.Benjamin E. Nye, Junyi Jessy Li, Roma Patel, Yinfei Yang, Iain James Marshall, Ani Nenkova, Byron C. Wallace
2018EMNLPUniversal Sentence Encoder for English.Daniel Cer, Yinfei Yang, Sheng-yi Kong, Nan Hua, Nicole Limtiaco, Rhomni St. John, Noah Constant, Mario Guajardo-Cespedes, Steve Yuan, Chris Tar, Brian Strope, Ray Kurzweil
2018NAACLCross-Domain Review Helpfulness Prediction Based on Convolutional Neural Networks with Auxiliary Domain Discriminators.Cen Chen, Yinfei Yang, Jun Zhou, Xiaolong Li, Forrest Sheng Bao
2018NAACLSyntactic Patterns Improve Information Extraction for Medical Search.Roma Patel, Yinfei Yang, Iain James Marshall, Ani Nenkova, Byron C. Wallace
2017EACLDetecting (Un)Important Content for Single-Document News Summarization.Yinfei Yang, Forrest Sheng Bao, Ani Nenkova
2017EACLAspect Extraction from Product Reviews Using Category Hierarchy Information.Yinfei Yang, Cen Chen, Minghui Qiu, Forrest Sheng Bao
2016ICTAIAspect-Based Helpfulness Prediction for Online Product Reviews.Yinfei Yang, Cen Chen, Forrest Sheng Bao
2015ACLSemantic Analysis and Helpfulness Prediction of Text for Online Product Reviews.Yinfei Yang, Yaowei Yan, Minghui Qiu, Forrest Sheng Bao
2014AAAIDetecting Information-Dense Texts in Multiple News Domains.Yinfei Yang, Ani Nenkova
2014ICRASingle image 3D object detection and pose estimation for grasping.Menglong Zhu, Konstantinos G. Derpanis, Yinfei Yang, Samarth Brahmbhatt, Mabel M. Zhang, Cody J. Phillips, Matthieu Lecce, Kostas Daniilidis
2012ACCVNavigation toward Non-static Target Object Using Footprint Detection Based Tracking.Meng Yi, Yinfei Yang, Wenjing Qi, Yu Zhou, Yunfeng Li, Zygmunt Pizlo, Longin Jan Latecki
2012EMNLPLinking Named Entities to Any Database.Avirup Sil, Ernest Cronin, Penghai Nie, Yinfei Yang, Ana-Maria Popescu, Alexander Yates