| 2026 | AAAI | HumanSense: From Multimodal Perception to Empathetic Context-Aware Responses Through Reasoning MLLMs. | Zheng Qin, Ruobing Zheng, Yabing Wang, Tianqi Li, Yi Yuan, Jingdong Chen, Le Wang |
| 2025 | AAAI | Diversifying Query: Region-Guided Transformer for Temporal Sentence Grounding. | Xiaolong Sun, Liushuai Shi, Le Wang, Sanping Zhou, Kun Xia, Yabing Wang, Gang Hua |
| 2025 | AAAI | RefDetector: A Simple Yet Effective Matching-based Method for Referring Expression Comprehension. | Yabing Wang, Zhuotao Tian, Zheng Qin, Sanping Zhou, Le Wang |
| 2025 | CVPR | Towards Precise Embodied Dialogue Localization via Causality Guided Diffusion. | Haoyu Wang, Le Wang, Sanping Zhou, Jingyi Tian, Zheng Qin, Yabing Wang, Gang Hua, Wei Tang |
| 2025 | CVPR | AVF-MAE++: Scaling Affective Video Facial Masked Autoencoders via Efficient Audio-Visual Self-Supervised Learning. | Xuecheng Wu, Heli Sun, Yifan Wang, Jiayu Nie, Jie Zhang, Yabing Wang, Junxiao Xue, Liang He |
| 2025 | ICCV | Moment Quantization for Video Temporal Grounding. | Xiaolong Sun, Le Wang, Sanping Zhou, Liushuai Shi, Kun Xia, Mengnan Liu, Yabing Wang, Gang Hua |
| 2024 | AAAI | CL2CM: Improving Cross-Lingual Cross-Modal Retrieval via Cross-Lingual Knowledge Transfer. | Yabing Wang, Fan Wang, Jianfeng Dong, Hao Luo |
| 2022 | DAC | MC-CIM: a reconfigurable computation-in-memory for efficient stereo matching cost computation. | Zhiheng Yue, Yabing Wang, Leibo Liu, Shaojun Wei, Shouyi Yin |