| 2026 | AAAI | Q Cache: Visual Attention Is Valuable in Less than Half of Decode Layers for Multimodal Large Language Model. | Jiedong Zhuang, Lu Lu, Ming Dai, Rui Hu, Jian Chen, Qiang Liu, Haoji Hu |
| 2025 | AAAI | Multi-task Visual Grounding with Coarse-to-Fine Consistency Constraints. | Ming Dai, Jian Li, Jiedong Zhuang, Xian Zhang, Wankou Yang |
| 2025 | AAAI | ST3: Accelerating Multimodal Large Language Model by Spatial-Temporal Visual Token Trimming. | Jiedong Zhuang, Lu Lu, Ming Dai, Rui Hu, Jian Chen, Qiang Liu, Haoji Hu |
| 2025 | ICCV | DeRIS: Decoupling Perception and Cognition for Enhanced Referring Image Segmentation Through Loopback Synergy. | Ming Dai, Wenxuan Cheng, Jiang-Jiang Liu, Sen Yang, Wenxiao Cai, Yanpeng Sun, Wankou Yang |
| 2025 | ICCV | PropVG: End-To-End Proposal-Driven Visual Grounding with Multi-Granularity Discrimination. | Ming Dai, Wenxuan Cheng, Jiedong Zhuang, Jiang-jiang Liu, Hongshen Zhao, Zhenhua Feng, Wankou Yang |
| 2020 | IWCMC | Research on Networking Technology of Digital Terrestrial Television Single Frequency Network. | Ming Dai |
| 2015 | FIE | Design and practice from the micromouse competition to the undergraduate curriculum. | Shenghua Dai, Bingxian Zhao, Zhengjiao Li, Ming Dai |
| 2012 | ICNC | Chlorophyll-a predicting based on artificial neural network for marine cage fish farming area in dapeng cove in Daya Bay, South China Sea. | Xiuli Liao, Honghui Huang, Ming Dai, Zhanhui Qi |