Qi Dai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
52
Venues
15
Active years
2012–2026
Best venue rank
A*
Where they publish
Papers
52 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | LLM2CLIP: Powerful Language Model Unlocks Richer Cross-Modality Representation. | Weiquan Huang, Aoqi Wu, Yifan Yang, Xufang Luo, Yuqing Yang, Usman Naseem, Chunyu Wang, Qi Dai, Xiyang Dai, Dongdong Chen, Chong Luo, Lili Qiu, Liang Hu |
| 2026 | AAAI | HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models. | Ziqin Zhou, Yifan Yang, Yuqing Yang, Tianyu He, Houwen Peng, Kai Qiu, Qi Dai, Lili Qiu, Chong Luo, Lingqiao Liu |
| 2026 | ACL | SimRPD: Optimizing Recruitment Proactive Dialogue Agents through Simulator-Based Data Evaluation and Selection. | Zhiyong Cao, Dunqiang Liu, Qi Dai, Haojun Xu, Huai Yuen Khor, Hao Wang, Huan He, Yafei Liu, Ke Ma, Ruqian Shi, Sicheng Zhou, Sijia Yao |
| 2026 | ACL | GoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning. | Fengyi Wu, Yifei Dong, Yilong Dai, Guangyu Chen, Qifeng Wu, Huiting Huang, Hang Wang, Qi Dai, Alexander G. Hauptmann, Zhi-Qi Cheng |
| 2026 | WACV | MageBench: Bridging Large Multimodal Models to Agents. | Miaosen Zhang, Qi Dai, Yifan Yang, Jianmin Bao, Dongdong Chen, Kai Qiu, Chong Luo, Xin Geng, Baining Guo |
| 2025 | AAAI | FaceA-Net: Facial Attribute-Driven ID Preserving Image Generation Network. | Jiayu Wang, Yue Yu, Jingjing Chen, Qi Dai, Yu-Gang Jiang |
| 2025 | CVPR | HomoGen: Enhanced Video Inpainting via Homography Propagation and Diffusion. | Ding Ding, Yueming Pan, Ruoyu Feng, Qi Dai, Kai Qiu, Jianmin Bao, Chong Luo, Zhenzhong Chen |
| 2025 | CVPR | Securing the Skies: A Comprehensive Survey on Anti-UAV Methods, Benchmarking, and Future Directions. | Yifei Dong, Fengyi Wu, Sanjian Zhang, Guangyu Chen, Yuzhi Hu, Masumi Yano, Jingdong Sun, Siyu Huang, Feng Liu, Qi Dai, Zhi-Qi Cheng |
| 2025 | CVPR | FloVD: Optical Flow Meets Video Diffusion Model for Enhanced Camera-Controlled Video Synthesis. | Wonjoon Jin, Qi Dai, Chong Luo, Seung-Hwan Baek, Sunghyun Cho |
| 2025 | CVPR | StableAnimator: High-Quality Identity-Preserving Human Image Animation. | Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu |
| 2025 | ICASSP | Fast and Robust High Resolution Frequency Estimation of Damped Signals. | Qi Dai, Ruiming Guo, Thierry Blu |
| 2025 | ICCV | JointDiT: Enhancing RGB-Depth Joint Modeling with Diffusion Transformers. | Byung-Ki Kwon, Qi Dai, Lee Hyoseok, Chong Luo, Tae-Hyun Oh |
| 2025 | ICCV | MagicMotion: Controllable Video Generation with Dense-to-Sparse Trajectory Guidance. | Quanhao Li, Zhen Xing, Rui Wang, Hui Zhang, Qi Dai, Zuxuan Wu |
| 2025 | ICCV | REDUCIO! Generating 1K Video Within 16 Seconds Using Extremely Compressed Motion Latents. | Rui Tian, Qi Dai, Jianmin Bao, Kai Qiu, Yifan Yang, Chong Luo, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | MotionFollower: Editing Video Motion via Score-Guided Diffusion. | Shuyuan Tu, Qi Dai, Zihao Zhang, Sicheng Xie, Zhi-Qi Cheng, Chong Luo, Xintong Han, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | ICCV | Aid: Adapting Image2video Diffusion Models for Instruction-Guided Video Prediction. | Zhen Xing, Qi Dai, Zejia Weng, Zuxuan Wu, Yu-Gang Jiang |
| 2025 | WACV | UCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval. | Haoyu Jiang, Zhi-Qi Cheng, Gabriel Moreira, Jiawen Zhu, Jingdong Sun, Bukun Ren, Jun-Yan He, Qi Dai, Xian-Sheng Hua |
| 2024 | CVPR | BlockGCN: Redefine Topology Awareness for Skeleton-Based Action Recognition. | Yuxuan Zhou, Xudong Yan, Zhi-Qi Cheng, Yan Yan, Qi Dai, Xian-Sheng Hua |
| 2024 | CVPR | MotionEditor: Editing Video Motion via Content-Aware Diffusion. | Shuyuan Tu, Qi Dai, Zhi-Qi Cheng, Han Hu, Xintong Han, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | CVPR | MicroCinema: A Divide-and-Conquer Approach for Text-to-Video Generation. | Yanhui Wang, Jianmin Bao, Wenming Weng, Ruoyu Feng, Dacheng Yin, Tao Yang, Jingxu Zhang, Qi Dai, Zhiyuan Zhao, Chunyu Wang, Kai Qiu, Yuhui Yuan, Xiaoyan Sun, Chong Luo, Baining Guo |
| 2024 | CVPR | ART•V: Auto-Regressive Text-to-Video Generation with Diffusion Models. | Wenming Weng, Ruoyu Feng, Yanhui Wang, Qi Dai, Chunyu Wang, Dacheng Yin, Zhiyuan Zhao, Kai Qiu, Jianmin Bao, Yuhui Yuan, Chong Luo, Yueyi Zhang, Zhiwei Xiong |
| 2024 | CVPR | SimDA: Simple Diffusion Adapter for Efficient Video Generation. | Zhen Xing, Qi Dai, Han Hu, Zuxuan Wu, Yu-Gang Jiang |
| 2024 | DASFAA | Diffusion Model-Enhanced Contrastive Learning for Graph Representation. | Qi Dai, Yumeng Song, Yu Gu, Fangfang Li, Xiaohua Li |
| 2024 | ETRA | Saliency3D: A 3D Saliency Dataset Collected on Screen. | Yao Wang, Qi Dai, Mihai Bce, Karsten Klein, Andreas Bulling |
| 2023 | CVPR | ResFormer: Scaling ViTs with Multi-Resolution Training. | Rui Tian, Zuxuan Wu, Qi Dai, Han Hu, Yu Qiao, Yu-Gang Jiang |
| 2023 | CVPR | On Data Scaling in Masked Image Modeling. | Zhenda Xie, Zheng Zhang, Yue Cao, Yutong Lin, Yixuan Wei, Qi Dai, Han Hu |
| 2023 | CVPR | SVFormer: Semi-supervised Video Transformer for Action Recognition. | Zhen Xing, Qi Dai, Han Hu, Jingjing Chen, Zuxuan Wu, Yu-Gang Jiang |
| 2023 | ICASSP | Parallel Sentence-Level Explanation Generation for Real-World Low-Resource Scenarios. | Yan Liu, Xiaokang Chen, Qi Dai |
| 2023 | ICCV | ChartReader: A Unified Framework for Chart Derendering and Comprehension without Heuristic Rules. | Zhi-Qi Cheng, Qi Dai, Alexander G. Hauptmann |
| 2023 | ICCV | All in Tokens: Unifying Output Space of Visual Tasks via Soft Token. | Jia Ning, Chen Li, Zheng Zhang, Chunyu Wang, Zigang Geng, Qi Dai, Kun He, Han Hu |
| 2023 | ICCV | Implicit Temporal Modeling with Learnable Alignment for Video Recognition. | Shuyuan Tu, Qi Dai, Zuxuan Wu, Zhi-Qi Cheng, Han Hu, Yu-Gang Jiang |
| 2023 | ICLR | HiViT: A Simpler and More Efficient Design of Hierarchical Vision Transformer. | Xiaosong Zhang, Yunjie Tian, Lingxi Xie, Wei Huang, Qi Dai, Qixiang Ye, Qi Tian |
| 2022 | ACL | MPII: Multi-Level Mutual Promotion for Inference and Interpretation. | Yan Liu, Sanyuan Chen, Yazheng Yang, Qi Dai |
| 2022 | CVPR | Rethinking Spatial Invariance of Convolutional Networks for Object Counting. | Zhi-Qi Cheng, Qi Dai, Hong Li, Jingkuan Song, Xiao Wu, Alexander G. Hauptmann |
| 2022 | CVPR | SimMIM: a Simple Framework for Masked Image Modeling. | Zhenda Xie, Zheng Zhang, Yue Cao, Yutong Lin, Jianmin Bao, Zhuliang Yao, Qi Dai, Han Hu |
| 2022 | ICASSP | Extreme-Point Pursuit for Unit-Modulus Optimization. | Mingjie Shao, Qi Dai, Wing-Kin Ma |
| 2022 | ICLR | On the Connection between Local Attention and Dynamic Depth-wise Convolution. | Qi Han, Zejia Fan, Qi Dai, Lei Sun, Ming-Ming Cheng, Jiaying Liu, Jingdong Wang |
| 2022 | ICONIP | Sequential Three-Way Rules Class-Overlap Under-Sampling Based on Fuzzy Hierarchical Subspace for Imbalanced Data. | Qi Dai, Jian-wei Liu, Jia-Peng Yang |
| 2021 | ICASSP | Learning to Estimate Kernel Scale and Orientation of Defocus Blur with Asymmetric Coded Aperture. | Jisheng Li, Qi Dai, Jiangtao Wen |
| 2021 | ICCV | Temporal Action Detection with Multi-level Supervision. | Baifeng Shi, Qi Dai, Judy Hoffman, Kate Saenko, Trevor Darrell, Huijuan Xu |
| 2020 | CVPR | Self-supervised Object Motion and Depth Estimation from Video. | Qi Dai, Vaishakh Patil, Simon Hecker, Dengxin Dai, Luc Van Gool, Konrad Schindler |
| 2020 | CVPR | Weakly-Supervised Action Localization by Generative Attention Modeling. | Baifeng Shi, Qi Dai, Yadong Mu, Jingdong Wang |
| 2020 | ICML | Informative Dropout for Robust Representation Learning: A Shape-bias Perspective. | Baifeng Shi, Dinghuai Zhang, Qi Dai, Zhanxing Zhu, Yadong Mu, Jingdong Wang |
| 2019 | CVPR | Deep Incremental Hashing Network for Efficient Image Retrieval. | Dayan Wu, Qi Dai, Jing Liu, Bo Li, Weiping Wang |
| 2019 | ICCV | Learning Spatial Awareness to Improve Crowd Counting. | Zhi-Qi Cheng, Jun-Xiu Li, Qi Dai, Xiao Wu, Alexander G. Hauptmann |
| 2018 | ECCV | Recurrent Tubelet Proposal and Recognition Networks for Action Detection. | Dong Li, Zhaofan Qiu, Qi Dai, Ting Yao, Tao Mei |
| 2018 | SIGIR | Deep Domain Adaptation Hashing with Adversarial Learning. | Fuchen Long, Ting Yao, Qi Dai, Xinmei Tian, Jiebo Luo, Tao Mei |
| 2015 | IJCAI | Optimal Bayesian Hashing for Efficient Face Recognition. | Qi Dai, Jianguo Li, Jun Wang, Yurong Chen, Yu-Gang Jiang |
| 2014 | AMIA | Mining electronic health record data to detect drug-repurposing signals for cancers. | Hua Xu, Qingxia Chen, Jeremy L. Warner, Han Xue, Min Jiang, Anushi Shah, Melinda Aldrich, Qi Dai, Joshua C. Denny |
| 2012 | AMIA | A Study of Transportability of an Existing Smoking Status Detection Module across Institutions. | Mei Liu, Anushi Shah, Min Jiang, Neeraja B. Peterson, Qi Dai, Melinda Aldrich, Qingxia Chen, Erica A. Bowton, Hongfang Liu, Joshua C. Denny, Hua Xu |
| 2012 | AMIA | Electronic health record data suggests metformin improves cancer survival: A new model for drug repurposing studies. | Hua Xu, Melinda Aldrich, Qingxia Chen, Neeraja B. Peterson, Qi Dai, Mia A. Levy, Anushi Shah, Han Xue, Ying Li, Carol Friedman, Hongfang Liu, Joshua C. Denny |
| 2012 | ECCV | Trajectory-Based Modeling of Human Actions with Motion Reference Points. | Yu-Gang Jiang, Qi Dai, Xiangyang Xue, Wei Liu, Chong-Wah Ngo |