| 2026 | AAAI | T-Rex-Omni: Integrating Negative Visual Prompt in Generic Object Detection. | Jiazhou Zhou, Qing Jiang, Kanghao Chen, Lutao Jiang, Yuanhuiyi Lyu, Ying-Cong Chen, Lei Zhang |
| 2026 | ACL | Are We Using the Right Benchmark: An Evaluation Framework for Visual Token Compression Methods. | Chenfei Liao, Wensong Wang, Zichen Wen, Xu Zheng, Yiyu Wang, Haocong He, Yuanhuiyi Lyu, Lutao Jiang, Xin Zou, Yuqian Fu, Bin Ren, Linfeng Zhang, Xuming Hu |
| 2025 | ACL | MMUnlearner: Reformulating Multimodal Machine Unlearning in the Era of Multimodal Large Language Models. | Jiahao Huo, Yibo Yan, Xu Zheng, Yuanhuiyi Lyu, Xin Zou, Zhihua Wei, Xuming Hu |
| 2025 | ACL | A Survey of Mathematical Reasoning in the Era of Multimodal Large Language Model: Benchmark, Method & Challenges. | Yibo Yan, Jiamin Su, Jianxiang He, Fangteng Fu, Xu Zheng, Yuanhuiyi Lyu, Kun Wang, Shen Wang, Qingsong Wen, Xuming Hu |
| 2025 | ICCV | From Reusing to Forecasting: Accelerating Diffusion Models With Taylorseers. | Jiacheng Liu, Chang Zou, Yuanhuiyi Lyu, Junjie Chen, Linfeng Zhang |
| 2025 | ICCV | Reducing Unimodal Bias in Multi-Modal Semantic Segmentation With Multi-Scale Functional Entropy Regularization. | Xu Zheng, Yuanhuiyi Lyu, Lutao Jiang, Danda Pani Paudel, Luc Van Gool, Xuming Hu |
| 2025 | ICCV | OmniSAM: Omnidirectional Segment Anything Model for UDA in Panoramic Semantic Segmentation. | Ding Zhong, Xu Zheng, Chenfei Liao, Yuanhuiyi Lyu, Jialei Chen, Shengyang Wu, Linfeng Zhang, Xuming Hu |
| 2025 | ICML | Look Twice Before You Answer: Memory-Space Visual Retracing for Hallucination Mitigation in Multimodal Large Language Models. | Xin Zou, Yizhou Wang, Yibo Yan, Yuanhuiyi Lyu, Kening Zheng, Sirui Huang, Junkai Chen, Peijie Jiang, Jia Liu, Chang Tang, Xuming Hu |
| 2025 | ICML | RealRAG: Retrieval-augmented Realistic Image Generation via Self-reflective Contrastive Learning. | Yuanhuiyi Lyu, Xu Zheng, Lutao Jiang, Yibo Yan, Xin Zou, Huiyu Zhou, Linfeng Zhang, Xuming Hu |
| 2024 | CVPR | UniBind: LLM-Augmented Unified and Balanced Representation Space to Bind Them All. | Yuanhuiyi Lyu, Xu Zheng, Jiazhou Zhou, Lin Wang |
| 2024 | CVPR | ExACT: Language-Guided Conceptual Reasoning and Uncertainty Estimation for Event-Based Action Recognition and More. | Jiazhou Zhou, Xu Zheng, Yuanhuiyi Lyu, Lin Wang |
| 2024 | ECCV | Learning Modality-Agnostic Representation for Semantic Segmentation from Any Modalities. | Xu Zheng, Yuanhuiyi Lyu, Lin Wang |
| 2024 | ECCV | Centering the Value of Every Modality: Towards Efficient and Resilient Modality-Agnostic Semantic Segmentation. | Xu Zheng, Yuanhuiyi Lyu, Jiazhou Zhou, Lin Wang |
| 2024 | ECCV | EventBind: Learning a Unified Representation to Bind Them All for Event-Based Open-World Understanding. | Jiazhou Zhou, Xu Zheng, Yuanhuiyi Lyu, Lin Wang |
| 2024 | ICRA | Chasing Day and Night: Towards Robust and Efficient All-Day Object Detection Guided by an Event Camera. | Jiahang Cao, Xu Zheng, Yuanhuiyi Lyu, Jiaxu Wang, Renjing Xu, Lin Wang |