| 2026 | ACL | EMTIR-GRPO: Efficient Multi-Tool Augmented Large Language Models via Reinforcement Learning. | Shixin Jiang, Zhihao Zhu, Jiafeng Liang, Yang Wu, Ming Liu, Bing Qin |
| 2026 | ACL | LCR-RAG: Enhancing Logical Consistency in Retrieval-Augmented Generation via Neuro-symbolic Reinforcement Learning. | Wenxiang Zheng, Guo Tang, Shixin Jiang, Liangyu Huo, Xiyuan Zhang, Jian Xie, Ming Liu |
| 2025 | ACL | From Specific-MLLMs to Omni-MLLMs: A Survey on MLLMs Aligned with Multi-modalities. | Shixin Jiang, Jiafeng Liang, Jiyuan Wang, Xuan Dong, Heng Chang, Weijiang Yu, Jinhua Du, Ming Liu, Bing Qin |
| 2025 | ACL | Investigating and Enhancing the Robustness of Large Multimodal Models Against Temporal Inconsistency. | Jiafeng Liang, Shixin Jiang, Xuan Dong, Ning Wang, Zheng Chu, Hui Su, Jinlan Fu, Ming Liu, See-Kiong Ng, Bing Qin |
| 2024 | EMNLP | Infrared-LLaVA: Enhancing Understanding of Infrared Images in Multi-Modal Large Language Models. | Shixin Jiang, Zerui Chen, Jiafeng Liang, Yanyan Zhao, Ming Liu, Bing Qin |
| 2024 | IJCAI | GUIDE: A Guideline-Guided Dataset for Instructional Video Comprehension. | Jiafeng Liang, Shixin Jiang, Zekun Wang, Haojie Pan, Zerui Chen, Zheng Chu, Ming Liu, Ruiji Fu, Zhongyuan Wang, Bing Qin |
| 2020 | VRST | Mediated-Timescale Learning: Manipulating Timescales in Virtual Reality to Improve Real-World Tennis Forehand Volley. | Shixin Jiang, Jun Rekimoto |