Jiasen Lu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
8
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Reducing Token Redundancy in LVLMs: A Systematic Review of Token Pruning Methods. | Hanzhang Yuan, Mengxuan Hu, Wenhao Zhang, Tianlong Wang, Zhongliang Zhou, Jiasen Lu, Sheng Li |
| 2025 | CVPR | One Diffusion to Generate Them All. | Duong H. Le, Tuan Pham, Sangho Lee, Christopher Clark, Aniruddha Kembhavi, Stephan Mandt, Ranjay Krishna, Jiasen Lu |
| 2025 | CVPR | Molmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models. | Matt Deitke, Christopher Clark, Sangho Lee, Rohun Tripathi, Yue Yang, Jae Sung Park, Mohammadreza Salehi, Niklas Muennighoff, Kyle Lo, Luca Soldaini, Jiasen Lu, Taira Anderson, Erin Bransom, Kiana Ehsani, Huong Ngo, Yen-Sung Chen, Ajay Patel, Mark Yatskar, Chris Callison-Burch, Andrew Head, Rose Hendrix, Favyen Bastani, Eli VanderBilt, Nathan Lambert, Yvonne Chou, Arnavi Chheda, Jenna Sparks, Sam Skjonsberg, Michael Schmitz, Aaron Sarnat, Byron Bischoff, Pete Walsh, Chris Newell, Piper Wolters, Tanmay Gupta, Kuo-Hao Zeng, Jon Borchardt, Dirk Groeneveld, Crystal Nam, Sophie Lebrecht, Caitlin Wittlif, Carissa Schoenick, Oscar Michel, Ranjay Krishna, Luca Weihs, Noah A. Smith, Hannaneh Hajishirzi, Ross B. Girshick, Ali Farhadi, Aniruddha Kembhavi |
| 2025 | ICCV | STIV: Scalable Text and Image Conditioned Video Generation. | Zongyu Lin, Wei Liu, Chen Chen, Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Lezhi Li, Yinfei Yang, Yizhou Sun, Kai-Wei Chang |
| 2025 | ICLR | The Semantic Hub Hypothesis: Language Models Share Semantic Representations Across Languages and Modalities. | Zhaofeng Wu, Xinyan Velocity Yu, Dani Yogatama, Jiasen Lu, Yoon Kim |
| 2025 | ICLR | MMEgo: Towards Building Egocentric Multimodal LLMs for Video QA. | Hanrong Ye, Haotian Zhang, Erik A. Daxberger, Lin Chen, Zongyu Lin, Yanghao Li, Bowen Zhang, Haoxuan You, Dan Xu, Zhe Gan, Jiasen Lu, Yinfei Yang |
| 2024 | CVPR | Unified-IO 2: Scaling Autoregressive Multimodal Models with Vision, Language, Audio, and Action. | Jiasen Lu, Christopher Clark, Sangho Lee, Zichen Zhang, Savya Khosla, Ryan Marten, Derek Hoiem, Aniruddha Kembhavi |
| 2023 | ICLR | UNIFIED-IO: A Unified Model for Vision, Language, and Multi-modal Tasks. | Jiasen Lu, Christopher Clark, Rowan Zellers, Roozbeh Mottaghi, Aniruddha Kembhavi |
| 2022 | AAAI | Multi-Modal Answer Validation for Knowledge-Based VQA. | Jialin Wu, Jiasen Lu, Ashish Sabharwal, Roozbeh Mottaghi |
| 2022 | CVPR | MERLOT RESERVE: Neural Script Knowledge through Vision and Language and Sound. | Rowan Zellers, Jiasen Lu, Ximing Lu, Youngjae Yu, Yanpeng Zhao, Mohammadreza Salehi, Aditya Kusupati, Jack Hessel, Ali Farhadi, Yejin Choi |
| 2020 | CVPR | 12-in-1: Multi-Task Vision and Language Representation Learning. | Jiasen Lu, Vedanuj Goswami, Marcus Rohrbach, Devi Parikh, Stefan Lee |
| 2020 | ECCV | Spatially Aware Multimodal Transformers for TextVQA. | Yash Kant, Dhruv Batra, Peter Anderson, Alexander G. Schwing, Devi Parikh, Jiasen Lu, Harsh Agrawal |
| 2020 | EMNLP | X-LXMERT: Paint, Caption and Answer Questions with Multi-Modal Transformers. | Jaemin Cho, Jiasen Lu, Dustin Schwenk, Hannaneh Hajishirzi, Aniruddha Kembhavi |
| 2019 | ICLR | Self-Monitoring Navigation Agent via Auxiliary Progress Estimation. | Chih-Yao Ma, Jiasen Lu, Zuxuan Wu, Ghassan AlRegib, Zsolt Kira, Richard Socher, Caiming Xiong |
| 2018 | CoRL | Visual Curiosity: Learning to Ask Questions to Learn Visual Recognition. | Jianwei Yang, Jiasen Lu, Stefan Lee, Dhruv Batra, Devi Parikh |
| 2018 | CVPR | Neural Baby Talk. | Jiasen Lu, Jianwei Yang, Dhruv Batra, Devi Parikh |
| 2018 | ECCV | Graph R-CNN for Scene Graph Generation. | Jianwei Yang, Jiasen Lu, Stefan Lee, Dhruv Batra, Devi Parikh |
| 2017 | CVPR | Knowing When to Look: Adaptive Attention via a Visual Sentinel for Image Captioning. | Jiasen Lu, Caiming Xiong, Devi Parikh, Richard Socher |
| 2017 | EMNLP | ParlAI: A Dialog Research Software Platform. | Alexander H. Miller, Will Feng, Dhruv Batra, Antoine Bordes, Adam Fisch, Jiasen Lu, Devi Parikh, Jason Weston |
| 2015 | CVPR | Human action segmentation with hierarchical supervoxel consistency. | Jiasen Lu, Ran Xu, Jason J. Corso |
| 2015 | ICCV | VQA: Visual Question Answering. | Stanislaw Antol, Aishwarya Agrawal, Jiasen Lu, Margaret Mitchell, Dhruv Batra, C. Lawrence Zitnick, Devi Parikh |