Skip to content

Kevin Qinghong Lin

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

15

Venues

6

Active years

2023–2025

Best venue rank

A*

Where they publish

Papers

15 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIVG-TVP: Multimodal Procedural Planning via Visually Grounded Text-Video Prompting.Muhammet Furkan Ilaslan, Ali Kksal, Kevin Qinghong Lin, Burak Satar, Mike Zheng Shou, Qianli Xu
2025CVPRMovieBench: A Hierarchical Movie Level Dataset for Long Video Generation.Weijia Wu, Mingyu Liu, Zeyu Zhu, Xi Xia, Haoen Feng, Wen Wang, Kevin Qinghong Lin, Chunhua Shen, Mike Zheng Shou
2025CVPRROICtrl: Boosting Instance Control for Visual Generation.Yuchao Gu, Yipin Zhou, Yunfan Ye, Yixin Nie, Licheng Yu, Pingchuan Ma, Kevin Qinghong Lin, Mike Zheng Shou
2025CVPRShowUI: One Vision-Language-Action Model for GUI Visual Agent.Kevin Qinghong Lin, Linjie Li, Difei Gao, Zhengyuan Yang, Shiwei Wu, Zechen Bai, Stan Weixian Lei, Lijuan Wang, Mike Zheng Shou
2025CVPRVLog: Video-Language Models by Generative Retrieval of Narration Vocabulary.Kevin Qinghong Lin, Mike Zheng Shou
2025ICLRShow-o: One Single Transformer to Unify Multimodal Understanding and Generation.Jinheng Xie, Weijia Mao, Zechen Bai, David Junhao Zhang, Weihao Wang, Kevin Qinghong Lin, Yuchao Gu, Zhijie Chen, Zhenheng Yang, Mike Zheng Shou
2025ICMLUI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction.Shravan Nayak, Xiangru Jian, Kevin Qinghong Lin, Juan A. Rodrguez, Montek Kalsi, Nicolas Chapados, M. Tamer zsu, Aishwarya Agrawal, David Vzquez, Christopher Pal, Perouz Taslakian, Spandana Gella, Sai Rajeswar
2024CVPRVideoLLM-online: Online Video Large Language Model for Streaming Video.Joya Chen, Zhaoyang Lv, Shiwei Wu, Kevin Qinghong Lin, Chenan Song, Difei Gao, Jia-Wei Liu, Ziteng Gao, Dongxing Mao, Mike Zheng Shou
2024CVPRBootstrapping SparseFormers from Vision Foundation Models.Ziteng Gao, Zhan Tong, Kevin Qinghong Lin, Joya Chen, Mike Zheng Shou
2024ECCVLearning Video Context as Interleaved Multimodal Sequences.Kevin Qinghong Lin, Pengchuan Zhang, Difei Gao, Xide Xia, Joya Chen, Ziteng Gao, Jinheng Xie, Xuhong Xiao, Mike Zheng Shou
2023CVPRAffordance Grounding from Demonstration Video to Target Image.Joya Chen, Difei Gao, Kevin Qinghong Lin, Mike Zheng Shou
2023CVPRAll in One: Exploring Unified Video-Language Pre-Training.Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Kevin Qinghong Lin, Satoshi Tsutsui, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou
2023ICCVUniVTG: Towards Unified Video-Language Temporal Grounding.Kevin Qinghong Lin, Pengchuan Zhang, Joya Chen, Shraman Pramanick, Difei Gao, Alex Jinpeng Wang, Rui Yan, Mike Zheng Shou
2023ICCVEgoVLPv2: Egocentric Video-Language Pre-training with Fusion in the Backbone.Shraman Pramanick, Yale Song, Sayan Nag, Kevin Qinghong Lin, Hardik Shah, Mike Zheng Shou, Rama Chellappa, Pengchuan Zhang
2023ICCVToo Large; Data Reduction for Vision-Language Pre-Training.Alex Jinpeng Wang, Kevin Qinghong Lin, David Junhao Zhang, Stan Weixian Lei, Mike Zheng Shou