| 2026 | AAAI | AV-Edit: Multimodal Generative Sound Effect Editing via Audio-Visual Semantic Joint Control. | Xinyue Guo, Xiaoran Yang, Lipan Zhang, Jianxuan Yang, Zhao Wang, Jian Luan |
| 2026 | ACL | STEP: Success-Rate-Aware Trajectory-Efficient Policy Optimization. | Yuhan Chen, Yuxuan Liu, Long Zhang, Pengzhi Gao, Jian Luan, Wei Liu |
| 2026 | ACL | End-to-End Optimization of LLM-Driven Multi-Agent Search Systems via Heterogeneous-Group-Based Reinforcement Learning. | Guanzhong Chen, Shaoxiong Yang, Chao Li, Wei Liu, Jian Luan, Zenglin Xu |
| 2026 | ACL | Revisiting Entropy in Reinforcement Learning for Large Reasoning Models. | Renren Jin, Pengzhi Gao, Yuqi Ren, Zhuowen Han, Tongxuan Zhang, Wuwei Huang, Wei Liu, Jian Luan, Deyi Xiong |
| 2026 | ACL | MobileBench-OL: A Comprehensive Chinese Benchmark for Evaluating Mobile GUI Agents in Real-World Environment. | Qinzhuo Wu, Zhizhuo Yang, Hanhao Li, Pengzhi Gao, Wei Liu, Jian Luan |
| 2026 | ACL | VecInfer: Efficient LLM Inference with Low-Bit KV Cache via Outlier-Suppressed Vector Quantization. | Dingyu Yao, Chenxu Yang, Zhengyang Tong, Zheng Lin, Wei Liu, Jian Luan, Weiping Wang |
| 2026 | ACL | Attention Basin: Why Contextual Position Matters in Large Language Models. | Zihao Yi, Zhenqing Ling, Delong Zeng, Haohao Luo, Zhe Xu, Wei Liu, Jian Luan, Wanxia Cao, Ying Shen |
| 2026 | ACL | Doc-V^*: Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA. | Yuanlei Zheng, Pei Fu, Hang Li, Ziyang Wang, Yuyi Zhang, Wenyu Ruan, Xiaojin Zhang, Zhongyu Wei, Zhenbo Luo, Jian Luan, Wei Chen, Xiang Bai |
| 2026 | IWQoS | It Takes Two: Embracing Sparsity and Speculative Decoding for Efficient LLM Inference. | Haolin Chu, Changyu Chen, Wei Liu, Jian Luan, Jiabin Deng, Liang Liu, Huadong Ma, Xiaolong Zheng |
| 2026 | Mobisys | Mobile GUI Agents under Real-world Threats: Are We There Yet? | Guohong Liu, Jialei Ye, Jiacheng Liu, Wei Liu, Pengzhi Gao, Jian Luan, Yuanchun Li, Yunxin Liu |
| 2026 | WSDM | C | Yue Yu, Ting Bai, Hengzhi Lan, Li Qian, Li Peng, Jie Wu, Wei Liu, Jian Luan, Chuan Shi |
| 2025 | AAAI | Stability and Generalization of Zeroth-Order Decentralized Stochastic Gradient Descent with Changing Topology. | Xiaolin Hu, Zixuan Gong, Gengze Xu, Wei Liu, Jian Luan, Bin Wang, Yong Liu |
| 2025 | ACL | HoPE: A Novel Positional Encoding Without Long-Term Decay for Enhanced Context Awareness and Extrapolation. | Yuhan Chen, Ang Lv, Jian Luan, Bin Wang, Wei Liu |
| 2025 | ACL | Demystifying Small Language Models for Edge Deployment. | Zhenyan Lu, Xiang Li, Dongqi Cai, Rongjie Yi, Fangming Liu, Wei Liu, Jian Luan, Xiwen Zhang, Nicholas D. Lane, Mengwei Xu |
| 2025 | ACL | Global Eye: Breaking the "Fixed Thinking Pattern" during the Instruction Expansion Process. | Wenxuan Lu, Wei Liu, Jian Luan, Bin Wang, Songhao Jiang, Tianning Zang |
| 2025 | ACL | Browsing Like Human: A Multimodal Web Agent with Experiential Fast-and-Slow Thinking. | Haohao Luo, Jiayi Kuang, Wei Liu, Ying Shen, Jian Luan, Yang Deng |
| 2025 | ACL | TailorKV: A Hybrid Framework for Long-Context Inference via Tailored KV Cache Optimization. | Dingyu Yao, Bowen Shen, Zheng Lin, Wei Liu, Jian Luan, Bin Wang, Weiping Wang |
| 2025 | ACL | Weaving Context Across Images: Improving Vision-Language Models through Focus-Centric Visual Chains. | Juntian Zhang, Chuanqi Cheng, Yuhan Liu, Wei Liu, Jian Luan, Rui Yan |
| 2025 | ACL | More is not always better? Enhancing Many-Shot In-Context Learning with Differentiated and Reweighting Objectives. | Xiaoqing Zhang, Ang Lv, Yuhan Liu, Flood Sung, Wei Liu, Jian Luan, Shuo Shang, Xiuying Chen, Rui Yan |
| 2025 | ASRU | DiffRhythm+: Controllable and Flexible Full-Length Song Generation with Preference Optimization. | Huakang Chen, Yuepeng Jiang, Guobin Ma, Chunbo Hao, Shuai Wang, Jixun Yao, Ziqian Ning, Meng Meng, Jian Luan, Lei Xie |
| 2025 | COLING | PMSS: Pretrained Matrices Skeleton Selection for LLM Fine-tuning. | Qibin Wang, Xiaolin Hu, Weikai Xu, Wei Liu, Jian Luan, Bin Wang |
| 2025 | EMNLP | MAKAR: a Multi-Agent framework based Knowledge-Augmented Reasoning for Grounded Multimodal Named Entity Recognition. | Xinkui Lin, Yuhui Zhang, Yongxiu Xu, Kun Huang, Hongzhang Mu, Yubin Wang, Gaopeng Gou, Li Qian, Li Peng, Wei Liu, Jian Luan, Hongbo Xu |
| 2025 | EMNLP | SPO: Self Preference Optimization with Self Regularization. | Yuhao Sun, Yifan Zhang, Quandong Wang, Qinzhuo Wu, Wei Liu, Jian Luan |
| 2025 | EMNLP | BacktrackAgent: Enhancing GUI Agent with Error Detection and Backtracking Mechanism. | Qinzhuo Wu, Pengzhi Gao, Wei Liu, Jian Luan |
| 2025 | ICASSP | LLaVA-SG: Leveraging Scene Graphs as Visual Semantic Expression in Vision-Language Models. | Jingyi Wang, Jianzhong Ju, Jian Luan, Zhidong Deng |
| 2025 | ICCV | Q-Frame: Query-Aware Frame Selection and Multi-Resolution Adaptation for Video-LLMs. | Shaojie Zhang, Jiahui Yang, Jianqin Yin, Zhenbo Luo, Jian Luan |
| 2025 | IJCAI | Theoretical Insights into Fine-Tuning Attention Mechanism: Generalization and Optimization. | Xinhao Yao, Hongjin Qian, Xiaolin Hu, Gengze Xu, Wei Liu, Jian Luan, Bin Wang, Yong Liu |
| 2025 | Interspeech | GLCLAP: A Novel Contrastive Learning Pre-trained Model for Contextual Biasing in ASR. | Yuxiang Kong, Fan Cui, Liyong Guo, Heinrich Dinkel, Lichun Fan, Junbo Zhang, Jian Luan |
| 2025 | Interspeech | StarVC: A Unified Auto-Regressive Framework for Joint Text and Speech Generation in Voice Conversion. | Fengjin Li, Jie Wang, Yadong Niu, Yongqing Wang, Meng Meng, Jian Luan, Zhiyong Wu |
| 2025 | Interspeech | Text-Enhanced Audio Encoder for Large Language Model based Speech Recognition via Cross-Modality Pre-training with Unpaired Audio-Text Data. | Hang Su, Yuxiang Kong, Lichun Fan, Jian Luan |
| 2025 | Interspeech | Efficient Speech Enhancement via Embeddings from Pre-trained Generative Audioencoders. | Xingwei Sun, Heinrich Dinkel, Yadong Niu, Linzhang Wang, Junbo Zhang, Jian Luan |
| 2025 | Interspeech | X-ARES: A Comprehensive Framework for Assessing Audio Encoder Performance. | Junbo Zhang, Heinrich Dinkel, Yadong Niu, Chenyu Liu, Si Cheng, Anbei Zhao, Jian Luan |
| 2025 | KDD | MobileSteward: Integrating Multiple App-Oriented Agents with Self-Evolution to Automate Cross-App Instructions. | Yuxuan Liu, Hongda Sun, Wei Liu, Jian Luan, Bo Du, Rui Yan |
| 2025 | NAACL | Multilingual Machine Translation with Open Large Language Models at Practical Scale: An Empirical Study. | Menglong Cui, Pengzhi Gao, Wei Liu, Jian Luan, Bin Wang |
| 2025 | NAACL | ReachAgent: Enhancing Mobile Agent via Page Reaching and Operation. | Qinzhuo Wu, Wei Liu, Jian Luan, Bin Wang |
| 2025 | PAKDD | DoTA: Weight-Decomposed Tensor Adaptation for Large Language Models. | Xiaolin Hu, Xiang Cheng, Peiyu Liu, Wei Liu, Jian Luan, Bin Wang, Yong Liu |
| 2025 | WWW | Optimize Quantization for Large Language Models via Progressive Training. | Jiangcun Du, Renren Jin, Wuwei Huang, Wei Liu, Jian Luan, Deyi Xiong |
| 2024 | ACL | Mobile-Bench: An Evaluation Benchmark for LLM-based Mobile Agents. | Shihan Deng, Weikai Xu, Hongda Sun, Wei Liu, Tao Tan, Jianfeng Liu, Ang Li, Jian Luan, Bin Wang, Rui Yan, Shuo Shang |
| 2024 | ACL | A Comprehensive Evaluation of Quantization Strategies for Large Language Models. | Renren Jin, Jiangcun Du, Wuwei Huang, Wei Liu, Jian Luan, Bin Wang, Deyi Xiong |
| 2024 | ACL | Pruning Large Language Models to Intra-module Low-rank Architecture with Transitional Activations. | Bowen Shen, Zheng Lin, Daren Zha, Wei Liu, Jian Luan, Bin Wang, Weiping Wang |
| 2024 | ACL | DetermLR: Augmenting LLM-based Logical Reasoning from Indeterminacy to Determinacy. | Hongda Sun, Weikai Xu, Wei Liu, Jian Luan, Bin Wang, Shuo Shang, Ji-Rong Wen, Rui Yan |
| 2024 | COLING | ToolRerank: Adaptive and Hierarchy-Aware Reranking for Tool Retrieval. | Yuanhang Zheng, Peng Li, Wei Liu, Yang Liu, Jian Luan, Bin Wang |
| 2024 | ECAI | SUBLLM: A Novel Efficient Architecture with Token Sequence Subsampling for LLM. | Quandong Wang, Yuxuan Yuan, Xiaoyu Yang, Ruike Zhang, Kang Zhao, Wei Liu, Jian Luan, Daniel Povey, Bin Wang |
| 2024 | EMNLP | Mixture of Diverse Size Experts. | Manxi Sun, Wei Liu, Jian Luan, Pengzhi Gao, Bin Wang |
| 2024 | EMNLP | ToolPlanner: A Tool Augmented LLM for Multi Granularity Instructions with Path Planning and Feedback. | Qinzhuo Wu, Wei Liu, Jian Luan, Bin Wang |
| 2024 | EMNLP | MobileVLM: A Vision-Language Model for Better Intra- and Inter-UI Understanding. | Qinzhuo Wu, Weikai Xu, Wei Liu, Tao Tan, Jianfeng Liu, Ang Li, Jian Luan, Bin Wang, Shuo Shang |
| 2023 | AAAI | BERT-ERC: Fine-Tuning BERT Is Enough for Emotion Recognition in Conversation. | Xiangyu Qin, Zhiyu Wu, Tingting Zhang, Yanran Li, Jian Luan, Bin Wang, Li Wang, Jinshi Cui |
| 2023 | ACL | Exploring Better Text Image Translation with Multimodal Codebook. | Zhibin Lan, Jiawei Yu, Xiang Li, Wen Zhang, Jian Luan, Bin Wang, Degen Huang, Jinsong Su |
| 2023 | EMNLP | Exploring All-In-One Knowledge Distillation Framework for Neural Machine Translation. | Zhongjian Miao, Wen Zhang, Jinsong Su, Xiang Li, Jian Luan, Yidong Chen, Bin Wang, Min Zhang |
| 2023 | ICASSP | Joint Training and Decoding for Multilingual End-to-End Simultaneous Speech Translation. | Wuwei Huang, Renren Jin, Wen Zhang, Jian Luan, Bin Wang, Deyi Xiong |
| 2023 | ICASSP | Rethinking the Reasonability of the Test Set for Simultaneous Machine Translation. | Mengge Liu, Wen Zhang, Xiang Li, Jian Luan, Bin Wang, Yuhang Guo, Shuoying Chen |
| 2023 | Interspeech | LightClone: Speaker-guided Parallel Subnet Selection for Few-shot Voice Cloning. | Jie Wu, Jian Luan, Yujun Wang |
| 2023 | Interspeech | Improving Bilingual TTS Using Language And Phonology Embedding With Embedding Strength Modulator. | Fengyu Yang, Jian Luan, Meng Meng, Yujun Wang |
| 2022 | ICASSP | PAMA-TTS: Progression-Aware Monotonic Attention for Stable SEQ2SEQ TTS with Accurate Phoneme Duration Control. | Yunchao He, Jian Luan, Yujun Wang |
| 2022 | ICASSP | MSDTRON: A High-Capability Multi-Speaker Speech Synthesis System for Diverse Data Using Characteristic Information. | Qinghua Wu, Quanbo Shen, Jian Luan, Yujun Wang |
| 2022 | ICASSP | Improving Emotional Speech Synthesis by Using SUS-Constrained VAE and Text Encoder Aggregation. | Fengyu Yang, Jian Luan, Yujun Wang |
| 2021 | ICMI | Noise Robust Singing Voice Synthesis Using Gaussian Mixture Variational Autoencoder. | Heyang Xue, Xiao Zhang, Jie Wu, Jian Luan, Yujun Wang, Lei Xie |
| 2020 | Interspeech | Transfer Learning for Improving Singing-Voice Detection in Polyphonic Instrumental Music. | Yuanbo Hou, Frank K. Soong, Jian Luan, Shengchen Li |
| 2020 | Interspeech | XiaoiceSing: A High-Quality and Integrated Singing Voice Synthesis System. | Peiling Lu, Jie Wu, Jian Luan, Xu Tan, Li Zhou |
| 2020 | Interspeech | Adversarially Trained Multi-Singer Sequence-to-Sequence Singing Synthesizer. | Jie Wu, Jian Luan |
| 2020 | Interspeech | Re-Weighted Interval Loss for Handling Data Imbalance Problem of End-to-End Keyword Spotting. | Kun Zhang, Zhiyong Wu, Daode Yuan, Jian Luan, Jia Jia, Helen Meng, Binheng Song |
| 2020 | KDD | DeepSinger: Singing Voice Synthesis with Data Mined From the Web. | Yi Ren, Xu Tan, Tao Qin, Jian Luan, Zhou Zhao, Tie-Yan Liu |
| 2019 | Interspeech | Vocal Pitch Extraction in Polyphonic Music Using Convolutional Residual Network. | Mingye Dong, Jie Wu, Jian Luan |
| 2019 | ISCAS | A 10-GS/s 8-bit SiGe ADC with Isolated 44 Analog Input Multiplexer. | DanYu Wu, Lei Zhou, Huasen Liu, Yinkun Huang, Jian Luan, Xuan Guo, Jin Wu, Xinyu Liu |
| 2012 | Interspeech | Expand CRF to Model Long Distance Dependencies in Prosodic Break Prediction. | Jian Luan |
| 2010 | Interspeech | Improvement on plural unit selection and fusion. | Jian Luan, Jian Li |
| 1993 | ISCAS | Cross-coupled filtered-X LMS algorithm and lattice structure for active noise control systems. | Sen M. Kuo, Jian Luan |