| 2025 | CVPR | Scaling Down Text Encoders of Text-to-Image Diffusion Models. | Lifu Wang, Daqing Liu, Xinchen Liu, Xiaodong He |
| 2024 | AAAI | Decomposing Semantic Shifts for Composed Image Retrieval. | Xingyu Yang, Daqing Liu, Heng Zhang, Yong Luo, Chaoyue Wang, Jing Zhang |
| 2023 | CVPR | Modeling Video as Stochastic Processes for Fine-Grained Video Representation Learning. | Heng Zhang, Daqing Liu, Qi Zheng, Bing Su |
| 2023 | ICCV | Exploring Temporal Concurrency for Video-Language Representation Learning. | Heng Zhang, Daqing Liu, Zezhong Lv, Bing Su, Dacheng Tao |
| 2022 | CVPR | Modeling Image Composition for Complex Scene Generation. | Zuopeng Yang, Daqing Liu, Chaoyue Wang, Jie Yang, Dacheng Tao |
| 2020 | CVPR | More Grounded Image Captioning by Distilling Image-Text Matching Model. | Yuanen Zhou, Meng Wang, Daqing Liu, Zhenzhen Hu, Hanwang Zhang |
| 2020 | IJCAI | Learning to Discretely Compose Reasoning Module Networks for Video Captioning. | Ganchao Tan, Daqing Liu, Meng Wang, Zheng-Jun Zha |
| 2019 | ICCV | Learning to Assemble Neural Module Tree Networks for Visual Grounding. | Daqing Liu, Hanwang Zhang, Feng Wu, Zheng-Jun Zha |