Skip to content

Jiasen Lu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

8

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLReducing Token Redundancy in LVLMs: A Systematic Review of Token Pruning Methods.Hanzhang Yuan, Mengxuan Hu, Wenhao Zhang, Tianlong Wang, Zhongliang Zhou, Jiasen Lu, Sheng Li
2025CVPROne Diffusion to Generate Them All.Duong H. Le, Tuan Pham, Sangho Lee, Christopher Clark, Aniruddha Kembhavi, Stephan Mandt, Ranjay Krishna, Jiasen Lu
2025CVPRMolmo and PixMo: Open Weights and Open Data for State-of-the-Art Vision-Language Models.Matt Deitke, Christopher Clark, Sangho Lee, Rohun Tripathi, Yue Yang, Jae Sung Park, Mohammadreza Salehi, Niklas Muennighoff, Kyle Lo, Luca Soldaini, Jiasen Lu, Taira Anderson, Erin Bransom, Kiana Ehsani, Huong Ngo, Yen-Sung Chen, Ajay Patel, Mark Yatskar, Chris Callison-Burch, Andrew Head, Rose Hendrix, Favyen Bastani, Eli VanderBilt, Nathan Lambert, Yvonne Chou, Arnavi Chheda, Jenna Sparks, Sam Skjonsberg, Michael Schmitz, Aaron Sarnat, Byron Bischoff, Pete Walsh, Chris Newell, Piper Wolters, Tanmay Gupta, Kuo-Hao Zeng, Jon Borchardt, Dirk Groeneveld, Crystal Nam, Sophie Lebrecht, Caitlin Wittlif, Carissa Schoenick, Oscar Michel, Ranjay Krishna, Luca Weihs, Noah A. Smith, Hannaneh Hajishirzi, Ross B. Girshick, Ali Farhadi, Aniruddha Kembhavi
2025ICCVSTIV: Scalable Text and Image Conditioned Video Generation.Zongyu Lin, Wei Liu, Chen Chen, Jiasen Lu, Wenze Hu, Tsu-Jui Fu, Jesse Allardice, Zhengfeng Lai, Liangchen Song, Bowen Zhang, Cha Chen, Yiran Fei, Lezhi Li, Yinfei Yang, Yizhou Sun, Kai-Wei Chang
2025ICLRThe Semantic Hub Hypothesis: Language Models Share Semantic Representations Across Languages and Modalities.Zhaofeng Wu, Xinyan Velocity Yu, Dani Yogatama, Jiasen Lu, Yoon Kim
2025ICLRMMEgo: Towards Building Egocentric Multimodal LLMs for Video QA.Hanrong Ye, Haotian Zhang, Erik A. Daxberger, Lin Chen, Zongyu Lin, Yanghao Li, Bowen Zhang, Haoxuan You, Dan Xu, Zhe Gan, Jiasen Lu, Yinfei Yang
2024CVPRUnified-IO 2: Scaling Autoregressive Multimodal Models with Vision, Language, Audio, and Action.Jiasen Lu, Christopher Clark, Sangho Lee, Zichen Zhang, Savya Khosla, Ryan Marten, Derek Hoiem, Aniruddha Kembhavi
2023ICLRUNIFIED-IO: A Unified Model for Vision, Language, and Multi-modal Tasks.Jiasen Lu, Christopher Clark, Rowan Zellers, Roozbeh Mottaghi, Aniruddha Kembhavi
2022AAAIMulti-Modal Answer Validation for Knowledge-Based VQA.Jialin Wu, Jiasen Lu, Ashish Sabharwal, Roozbeh Mottaghi
2022CVPRMERLOT RESERVE: Neural Script Knowledge through Vision and Language and Sound.Rowan Zellers, Jiasen Lu, Ximing Lu, Youngjae Yu, Yanpeng Zhao, Mohammadreza Salehi, Aditya Kusupati, Jack Hessel, Ali Farhadi, Yejin Choi
2020CVPR12-in-1: Multi-Task Vision and Language Representation Learning.Jiasen Lu, Vedanuj Goswami, Marcus Rohrbach, Devi Parikh, Stefan Lee
2020ECCVSpatially Aware Multimodal Transformers for TextVQA.Yash Kant, Dhruv Batra, Peter Anderson, Alexander G. Schwing, Devi Parikh, Jiasen Lu, Harsh Agrawal
2020EMNLPX-LXMERT: Paint, Caption and Answer Questions with Multi-Modal Transformers.Jaemin Cho, Jiasen Lu, Dustin Schwenk, Hannaneh Hajishirzi, Aniruddha Kembhavi
2019ICLRSelf-Monitoring Navigation Agent via Auxiliary Progress Estimation.Chih-Yao Ma, Jiasen Lu, Zuxuan Wu, Ghassan AlRegib, Zsolt Kira, Richard Socher, Caiming Xiong
2018CoRLVisual Curiosity: Learning to Ask Questions to Learn Visual Recognition.Jianwei Yang, Jiasen Lu, Stefan Lee, Dhruv Batra, Devi Parikh
2018CVPRNeural Baby Talk.Jiasen Lu, Jianwei Yang, Dhruv Batra, Devi Parikh
2018ECCVGraph R-CNN for Scene Graph Generation.Jianwei Yang, Jiasen Lu, Stefan Lee, Dhruv Batra, Devi Parikh
2017CVPRKnowing When to Look: Adaptive Attention via a Visual Sentinel for Image Captioning.Jiasen Lu, Caiming Xiong, Devi Parikh, Richard Socher
2017EMNLPParlAI: A Dialog Research Software Platform.Alexander H. Miller, Will Feng, Dhruv Batra, Antoine Bordes, Adam Fisch, Jiasen Lu, Devi Parikh, Jason Weston
2015CVPRHuman action segmentation with hierarchical supervoxel consistency.Jiasen Lu, Ran Xu, Jason J. Corso
2015ICCVVQA: Visual Question Answering.Stanislaw Antol, Aishwarya Agrawal, Jiasen Lu, Margaret Mitchell, Dhruv Batra, C. Lawrence Zitnick, Devi Parikh