Kevin Qinghong Lin
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
15
Venues
6
Active years
2023–2025
Best venue rank
A*
Where they publish
Papers
15 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | VG-TVP: Multimodal Procedural Planning via Visually Grounded Text-Video Prompting. | Muhammet Furkan Ilaslan, Ali Kksal, Kevin Qinghong Lin, Burak Satar, Mike Zheng Shou, Qianli Xu |
| 2025 | CVPR | MovieBench: A Hierarchical Movie Level Dataset for Long Video Generation. | Weijia Wu, Mingyu Liu, Zeyu Zhu, Xi Xia, Haoen Feng, Wen Wang, Kevin Qinghong Lin, Chunhua Shen, Mike Zheng Shou |
| 2025 | CVPR | ROICtrl: Boosting Instance Control for Visual Generation. | Yuchao Gu, Yipin Zhou, Yunfan Ye, Yixin Nie, Licheng Yu, Pingchuan Ma, Kevin Qinghong Lin, Mike Zheng Shou |
| 2025 | CVPR | ShowUI: One Vision-Language-Action Model for GUI Visual Agent. | Kevin Qinghong Lin, Linjie Li, Difei Gao, Zhengyuan Yang, Shiwei Wu, Zechen Bai, Stan Weixian Lei, Lijuan Wang, Mike Zheng Shou |
| 2025 | CVPR | VLog: Video-Language Models by Generative Retrieval of Narration Vocabulary. | Kevin Qinghong Lin, Mike Zheng Shou |
| 2025 | ICLR | Show-o: One Single Transformer to Unify Multimodal Understanding and Generation. | Jinheng Xie, Weijia Mao, Zechen Bai, David Junhao Zhang, Weihao Wang, Kevin Qinghong Lin, Yuchao Gu, Zhijie Chen, Zhenheng Yang, Mike Zheng Shou |
| 2025 | ICML | UI-Vision: A Desktop-centric GUI Benchmark for Visual Perception and Interaction. | Shravan Nayak, Xiangru Jian, Kevin Qinghong Lin, Juan A. Rodrguez, Montek Kalsi, Nicolas Chapados, M. Tamer zsu, Aishwarya Agrawal, David Vzquez, Christopher Pal, Perouz Taslakian, Spandana Gella, Sai Rajeswar |
| 2024 | CVPR | VideoLLM-online: Online Video Large Language Model for Streaming Video. | Joya Chen, Zhaoyang Lv, Shiwei Wu, Kevin Qinghong Lin, Chenan Song, Difei Gao, Jia-Wei Liu, Ziteng Gao, Dongxing Mao, Mike Zheng Shou |
| 2024 | CVPR | Bootstrapping SparseFormers from Vision Foundation Models. | Ziteng Gao, Zhan Tong, Kevin Qinghong Lin, Joya Chen, Mike Zheng Shou |
| 2024 | ECCV | Learning Video Context as Interleaved Multimodal Sequences. | Kevin Qinghong Lin, Pengchuan Zhang, Difei Gao, Xide Xia, Joya Chen, Ziteng Gao, Jinheng Xie, Xuhong Xiao, Mike Zheng Shou |
| 2023 | CVPR | Affordance Grounding from Demonstration Video to Target Image. | Joya Chen, Difei Gao, Kevin Qinghong Lin, Mike Zheng Shou |
| 2023 | CVPR | All in One: Exploring Unified Video-Language Pre-Training. | Jinpeng Wang, Yixiao Ge, Rui Yan, Yuying Ge, Kevin Qinghong Lin, Satoshi Tsutsui, Xudong Lin, Guanyu Cai, Jianping Wu, Ying Shan, Xiaohu Qie, Mike Zheng Shou |
| 2023 | ICCV | UniVTG: Towards Unified Video-Language Temporal Grounding. | Kevin Qinghong Lin, Pengchuan Zhang, Joya Chen, Shraman Pramanick, Difei Gao, Alex Jinpeng Wang, Rui Yan, Mike Zheng Shou |
| 2023 | ICCV | EgoVLPv2: Egocentric Video-Language Pre-training with Fusion in the Backbone. | Shraman Pramanick, Yale Song, Sayan Nag, Kevin Qinghong Lin, Hardik Shah, Mike Zheng Shou, Rama Chellappa, Pengchuan Zhang |
| 2023 | ICCV | Too Large; Data Reduction for Vision-Language Pre-Training. | Alex Jinpeng Wang, Kevin Qinghong Lin, David Junhao Zhang, Stan Weixian Lei, Mike Zheng Shou |