Skip to content

Xingjian Diao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

8

Active years

2023–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLAddressing Overthinking in Large Vision-Language Models via Gated Perception-Reasoning Optimization.Xingjian Diao, Zheyuan Liu, Chunhui Zhang, Weiyi Wu, Keyi Kong, Lin Shi, Kaize Ding, Soroush Vosoughi, Jiang Gui
2026ACLWhat Makes a Good Curriculum? Disentangling the Effects of Data Ordering on LLM Mathematical Reasoning.Yaning Jia, Chunhui Zhang, Xingjian Diao, Xiangchi Yuan, Zhongyu Ouyang, Chiyu Ma, Soroush Vosoughi
2026ACLMusic Audio-Visual Question Answering Requires Specialized Multimodal Designs.Wenhao You, Xingjian Diao, Wenjun Huang, Chunhui Zhang, Keyi Kong, Weiyi Wu, Chiyu Ma, Zhongyu Ouyang, Tingxuan Wu, Ming Cheng, Soroush Vosoughi, Jiang Gui
2026EACLTailoring Memory Granularity for Multi-Hop Reasoning over Long Contexts.Peijun Qing, Xingjian Diao, Chiyu Ma, Saeed Hassanpour, Soroush Vosoughi
2026WACVExploiting Label-Independent Regularization from Spatial Patterns for Whole Slide Image Analysis.Weiyi Wu, Xinwen Xu, Chongyang Gao, Xingjian Diao, Siting Li, Jiang Gui
2025ACLLearning Sparsity for Effective and Efficient Music Performance Question Answering.Xingjian Diao, Tianzhen Yang, Chunhui Zhang, Weiyi Wu, Ming Cheng, Jiang Gui
2025EMNLPProtoVQA: An Adaptable Prototypical Framework for Explainable Fine-Grained Visual Question Answering.Xingjian Diao, Weiyi Wu, Keyi Kong, Peijun Qing, Xinwen Xu, Ming Cheng, Soroush Vosoughi, Jiang Gui
2025EMNLPSoundMind: RL-Incentivized Logic Reasoning for Audio-Language Models.Xingjian Diao, Chunhui Zhang, Keyi Kong, Weiyi Wu, Chiyu Ma, Zhongyu Ouyang, Peijun Qing, Soroush Vosoughi, Jiang Gui
2025EMNLPAssessing and Mitigating Medical Knowledge Drift and Conflicts in Large Language Models.Weiyi Wu, Xinwen Xu, Chongyang Gao, Xingjian Diao, Siting Li, Lucas A. Salas, Jiang Gui
2025EMNLPKnowing More, Acting Better: Hierarchical Representation for Embodied Decision-Making.Chunhui Zhang, Zhongyu Ouyang, Xingjian Diao, Zheyuan Liu, Soroush Vosoughi
2025IJCNLPJudging the Judges: A Systematic Study of Position Bias in LLM-as-a-Judge.Lin Shi, Chiyu Ma, Wenhua Liang, Xingjian Diao, Weicheng Ma, Soroush Vosoughi
2025NAACLTemporal Working Memory: Query-Guided Segment Refinement for Enhanced Multimodal Understanding.Xingjian Diao, Chunhui Zhang, Weiyi Wu, Zhongyu Ouyang, Peijun Qing, Ming Cheng, Soroush Vosoughi, Jiang Gui
2025WACVFT2TF: First-Person Statement Text-to-Talking Face Generation.Xingjian Diao, Ming Cheng, Wayner Barrios, SouYoung Jin
2024CVPREfflex: Efficient and Flexible Pipeline for Spatio-Temporal Trajectory Graph Modeling and Representation Learning.Ming Cheng, Ziyi Zhou, Bowen Zhang, Ziyu Wang, Jiaqi Gan, Ziang Ren, Weiqi Feng, Yi Lyu, Hefan Zhang, Xingjian Diao
2024EMNLPLearning Musical Representations for Music Performance Question Answering.Xingjian Diao, Chunhui Zhang, Tingxuan Wu, Ming Cheng, Zhongyu Ouyang, Weiyi Wu, Jiang Gui
2024EMNLPAlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality.Peijun Qing, Chongyang Gao, Yefan Zhou, Xingjian Diao, Yaoqing Yang, Soroush Vosoughi
2023ICTAIAV-MaskEnhancer: Enhancing Video Representations through Audio-Visual Masked Autoencoder.Xingjian Diao, Ming Cheng, Shitong Cheng