Skip to content

Chenliang Xu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

81

Venues

19

Active years

2012–2026

Best venue rank

A*

Where they publish

Papers

81 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAICaption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting.Yolo Yunlong Tang, Jing Bi, Chao Huang, Susan Liang, Daiki Shimada, Hang Hua, Yunzhong Xiao, Yizhi Song, Pinxin Liu, Mingqian Feng, Junjia Guo, Zhuo Liu, Luchuan Song, Ali Vosoughi, Jinxi He, Liu He, Zeliang Zhang, Jiebo Luo, Chenliang Xu
2026ACLDRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning.Chao Huang, Zeliang Zhang, Jiang Liu, Ximeng Sun, Jialian Wu, Xiaodong Yu, Ze Wang, Chenliang Xu, Emad Barsoum, Zicheng Liu
2025AAAIEmpowering LLMs with Pseudo-Untrimmed Videos for Audio-Visual Temporal Understanding.Yunlong Tang, Daiki Shimada, Jing Bi, Mingqian Feng, Hang Hua, Chenliang Xu
2025AAAIV2Xum-LLM: Cross-Modal Video Summarization with Temporal Prompt Instruction Tuning.Hang Hua, Yunlong Tang, Chenliang Xu, Jiebo Luo
2025AAAICaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with Diffusion.Yunlong Tang, Gen Zhan, Li Yang, Yiting Liao, Chenliang Xu
2025ACLDiversifying the Expert Knowledge for Task-Agnostic Pruning in Sparse Mixture-of-Experts.Zeliang Zhang, Xiaodong Liu, Hao Cheng, Chenliang Xu, Jianfeng Gao
2025CVPRUnveiling Visual Perception in Language Models: An Attention Head Analysis Approach.Jing Bi, Junjia Guo, Yunlong Tang, Lianggong Bruce Wen, Zhang Liu, Bingjie Wang, Chenliang Xu
2025CVPRVidComposition: Can MLLMs Analyze Compositions in Compiled Videos?Yunlong Tang, Junjia Guo, Hang Hua, Susan Liang, Mingqian Feng, Xinyang Li, Rui Mao, Chao Huang, Jing Bi, Zeliang Zhang, Pooyan Fazli, Chenliang Xu
2025CVPRLearning to Highlight Audio by Watching Movies.Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh
2025CVPRTargeted Forgetting of Image Subgroups in CLIP Models.Zeliang Zhang, Gaowen Liu, Charles Fleming, Ramana Rao Kompella, Chenliang Xu
2025ICCV$\pi$-AVAS: Can Physics-Integrated Audio-Visual Modeling Boost Neural Acoustic Synthesis?Susan Liang, Chao Huang, Yunlong Tang, Zeliang Zhang, Chenliang Xu
2025ICCVGestureLSM: Latent Shortcut Based Co-Speech Gesture Generation with Spatial-Temporal Modeling.Pinxin Liu, Luchuan Song, Junhua Huang, Haiyang Liu, Chenliang Xu
2025ICCVGenerative AI for Cel-Animation: A Survey.Yunlong Tang, Junjia Guo, Pinxin Liu, Zhiyuan Wang, Hang Hua, Jia-Xing Zhong, Yunzhong Xiao, Chao Huang, Luchuan Song, Susan Liang, Yizhi Song, Liu He, Jing Bi, Mingqian Feng, Xinyang Li, Zeliang Zhang, Chenliang Xu
2025ICLRRethinking Audio-Visual Adversarial Vulnerability from Temporal and Modality Perspectives.Zeliang Zhang, Susan Liang, Daiki Shimada, Chenliang Xu
2025ICMLBinauralFlow: A Causal and Streamable Approach for High-Quality Binaural Speech Synthesis with Flow Matching Models.Susan Liang, Dejan Markovic, Israel D. Gebru, Steven Krenn, Todd Keebler, Jacob Sandakly, Frank Yu, Samuel Hassel, Chenliang Xu, Alexander Richard
2025SIGGRAPHStreamME: Simplify 3D Gaussian Avatar within Live Stream.Luchuan Song, Yang Zhou, Zhan Xu, Yi Zhou, Deepali Aneja, Chenliang Xu
2024ACCVHigh-Quality Visually-Guided Sound Separation from Diverse Categories.Chao Huang, Susan Liang, Yapeng Tian, Anurag Kumar, Chenliang Xu
2024ACCVLanguage-Guided Joint Audio-Visual Editing via One-Shot Adaptation.Susan Liang, Chao Huang, Yapeng Tian, Anurag Kumar, Chenliang Xu
2024CVPRDiscover and Mitigate Multiple Biased Subgroups in Image Classifiers.Zeliang Zhang, Mingqian Feng, Zhiheng Li, Chenliang Xu
2024CVPRLearning to Transform Dynamically for Better Adversarial Transferability.Rongyi Zhu, Zeliang Zhang, Zhuo Liu, Chenliang Xu, Susan Liang
2024EACLRandom Smooth-based Certified Defense against Text Adversarial Attack.Zeliang Zhang, Wei Yao, Susan Liang, Chenliang Xu
2024ECCVModeling and Driving Human Body Soundfields Through Acoustic Primitives.Chao Huang, Dejan Markovic, Chenliang Xu, Alexander Richard
2024ECCVTriLuchuan Song, Pinxin Liu, Lele Chen, Guojun Yin, Chenliang Xu
2024EMNLPCan CLIP Count Stars? An Empirical Study on Quantity Bias in CLIP.Zeliang Zhang, Zhuo Liu, Mingqian Feng, Chenliang Xu
2024ICASSPAdaptive Super Resolution for One-Shot Talking-Head Generation.Luchuan Song, Pinxin Liu, Guojun Yin, Chenliang Xu
2024ICASSPLearning Audio Concepts from Counterfactual Natural Language.Ali Vosoughi, Luca Bondi, Ho-Hsiang Wu, Chenliang Xu
2024ICLROne Forward is Enough for Neural Network Training via Likelihood Ratio Method.Jinyang Jiang, Zeliang Zhang, Chenliang Xu, Zhaofei Yu, Yijie Peng
2024NAACLOSCaR: Object State Captioning and State Change Representation.Nguyen Nguyen, Jing Bi, Ali Vosoughi, Yapeng Tian, Pooyan Fazli, Chenliang Xu
2024SiggraphATextToon: Real-Time Text Toonify Head Avatar from Single Video.Luchuan Song, Lele Chen, Celong Liu, Pinxin Liu, Chenliang Xu
2023CVPREgocentric Audio-Visual Object Localization.Chao Huang, Yapeng Tian, Anurag Kumar, Chenliang Xu
2023CVPRA Whac-A-Mole Dilemma: Shortcuts Come in Multiples Where Mitigating One Amplifies Others.Zhiheng Li, Ivan Evtimov, Albert Gordo, Caner Hazirbas, Tal Hassner, Cristian Canton-Ferrer, Chenliang Xu, Mark Ibrahim
2023ICCVEmotional Listener Portrait: Realistic Listener Motion Simulation in Conversation.Luchuan Song, Guojun Yin, Zhenchao Jin, Xiaoyi Dong, Chenliang Xu
2023UISTPEANUT: A Human-AI Collaborative Tool for Annotating Audio-Visual Data.Zheng Zhang, Zheng Ning, Chenliang Xu, Yapeng Tian, Toby Jia-Jun Li
2022CVPRSpaceEdit: Learning a Unified Editing Space for Open-Domain Image Color Editing.Jing Shi, Ning Xu, Haitian Zheng, Alex Smith, Jiebo Luo, Chenliang Xu
2022CVPRTransformer-empowered Multi-scale Contextual Matching and Aggregation for Multi-contrast MRI Super-resolution.Guangyuan Li, Jun Lv, Yapeng Tian, Qi Dou, Chengyan Wang, Chenliang Xu, Jing Qin
2022CVPRStyleT2I: Toward Compositional and High-Fidelity Text-to-Image Synthesis.Zhiheng Li, Martin Renqiang Min, Kai Li, Chenliang Xu
2022CVPRLearning to Answer Questions in Dynamic Audio-Visual Scenarios.Guangyao Li, Yake Wei, Yapeng Tian, Chenliang Xu, Ji-Rong Wen, Di Hu
2022ECCVDiscover and Mitigate Unknown Biases with Debiasing Alternate Networks.Zhiheng Li, Anthony Hoogs, Chenliang Xu
2022ICPRCross-modal Contrastive Distillation for Instructional Activity Anticipation.Zhengyuan Yang, Jingen Liu, Jing Huang, Xiaodong He, Tao Mei, Chenliang Xu, Jiebo Luo
2021BMVCSpace-Time Memory Network for Sounding Object Localization in Videos.Sizhe Li, Yapeng Tian, Chenliang Xu
2021CVPRLearning by Planning: Language-Guided Global Image Editing.Jing Shi, Ning Xu, Yihang Xu, Trung Bui, Franck Dernoncourt, Chenliang Xu
2021CVPRHigh-Fidelity Face Tracking for AR/VR via Deep Lighting Adaptation.Lele Chen, Chen Cao, Fernando De la Torre, Jason M. Saragih, Chenliang Xu, Yaser Sheikh
2021CVPRCyclic Co-Learning of Sounding Object Visual Grounding and Sound Separation.Yapeng Tian, Di Hu, Chenliang Xu
2021CVPRCan Audio-Visual Integration Strengthen Robustness Under Multimodal Attacks?Yapeng Tian, Chenliang Xu
2021ICCVA Simple Baseline for Weakly-Supervised Scene Graph Generation.Jing Shi, Yiwu Zhong, Ning Xu, Yin Li, Chenliang Xu
2021ICCVProcedure Planning in Instructional Videos via Contextual Modeling and Model-based Policy Learning.Jing Bi, Jiebo Luo, Chenliang Xu
2021ICCVExplaining Local, Global, And Higher-Order Interactions In Deep Learning.Samuel Lerman, Charles Venuto, Henry A. Kautz, Chenliang Xu
2021ICCVDiscover the Unknown Biased Attribute of an Image Classifier.Zhiheng Li, Chenliang Xu
2021ICCVLearning to Generate Scene Graph from Natural Language Supervision.Yiwu Zhong, Jing Shi, Jianwei Yang, Chenliang Xu, Yin Li
2021WACVImprove CAM with Auto-adapted Segmentation and Co-supervised Augmentation.Ziyi Kou, Guofeng Cui, Shaojie Wang, Wentian Zhao, Chenliang Xu
2021WACVHow to Make a BLT Sandwich? Learning VQA towards Understanding Web Instructional Videos.Shaojie Wang, Wentian Zhao, Ziyi Kou, Jing Shi, Chenliang Xu
2020AAAILearning from Interventions Using Hierarchical Policies for Safe Learning.Jing Bi, Vikas Dhiman, Tianyou Xiao, Chenliang Xu
2020ACCVA Benchmark and Baseline for Language-Driven Image Editing.Jing Shi, Ning Xu, Trung Bui, Franck Dernoncourt, Zheng Wen, Chenliang Xu
2020CVPRLearning a Weakly-Supervised Video Actor-Action Segmentation Model With a Wise Selection.Jie Chen, Zhiheng Li, Jiebo Luo, Chenliang Xu
2020CVPRDeep Grouping Model for Unified Perceptual Parsing.Zhiheng Li, Wenxuan Bao, Jiayang Zheng, Chenliang Xu
2020CVPRTDAN: Temporally-Deformable Alignment Network for Video Super-Resolution.Yapeng Tian, Yulun Zhang, Yun Fu, Chenliang Xu
2020CVPRZooming Slow-Mo: Fast and Accurate One-Stage Space-Time Video Super-Resolution.Xiaoyu Xiang, Yapeng Tian, Yulun Zhang, Yun Fu, Jan P. Allebach, Chenliang Xu
2020ECCVTalking-Head Generation with Rhythmic Head Motion.Lele Chen, Guofeng Cui, Celong Liu, Zhong Li, Ziyi Kou, Yi Xu, Chenliang Xu
2020ECCVUnified Multisensory Perception: Weakly-Supervised Audio-Visual Video Parsing.Yapeng Tian, Dingzeyu Li, Chenliang Xu
2020ICASSPEnd-To-End Generation of Talking Faces from Noisy Speech.Sefik Emre Eskimez, Ross K. Maddox, Chenliang Xu, Zhiyao Duan
2020WACVTailorGAN: Making User-Defined Fashion Designs.Lele Chen, Justin Tian, Guo Li, Cheng-Haw Wu, Erh-Kan King, Kuan-Ting Chen, Shao-Hang Hsieh, Chenliang Xu
2019BMVCDynamic Graph Modules for Modeling Object-Object Interactions in Activity Recognition.Hao Huang, Luowei Zhou, Wei Zhang, Jason J. Corso, Chenliang Xu
2019CVPRNot All Frames Are Equal: Weakly-Supervised Video Grounding With Contextual Similarity and Visual Clustering Losses.Jing Shi, Jia Xu, Boqing Gong, Chenliang Xu
2019CVPRHierarchical Cross-Modal Talking Face Generation With Dynamic Pixel-Wise Loss.Lele Chen, Ross K. Maddox, Zhiyao Duan, Chenliang Xu
2019CVPRSound to Visual: Hierarchical Cross-Modal Talking Face Generation.Lele Chen, Haitian Zheng, Ross K. Maddox, Zhiyao Duan, Chenliang Xu
2019CVPRNTIRE 2019 Challenge on Video Super-Resolution: Methods and Results.Seungjun Nah, Radu Timofte, Shuhang Gu, Sungyong Baik, Seokil Hong, Gyeongsik Moon, Sanghyun Son, Kyoung Mu Lee, Xintao Wang, Kelvin C. K. Chan, Ke Yu, Chao Dong, Chen Change Loy, Yuchen Fan, Jiahui Yu, Ding Liu, Thomas S. Huang, Xiao Liu, Chao Li, Dongliang He, Yukang Ding, Shilei Wen, Fatih Porikli, Ratheesh Kalarot, Muhammad Haris, Greg Shakhnarovich, Norimichi Ukita, Peng Yi, Zhongyuan Wang, Kui Jiang, Junjun Jiang, Jiayi Ma, Hang Dong, Xinyi Zhang, Zhe Hu, Kwan-Young Kim, Dong Un Kang, Se Young Chun, Kuldeep Purohit, A. N. Rajagopalan, Yapeng Tian, Yulun Zhang, Yun Fu, Chenliang Xu, Ahmet Murat Tekalp, Mustafa Akin Yilmaz, Cansu Korkmaz, Manoj Sharma, Megh Makwana, Anuj Badhwar, Ajay Pratap Singh, Avinash Upadhyay, Rudrabha Mukhopadhyay, Ankit Shukla, Dheeraj Khanna, A. S. Mandal, Santanu Chaudhury, Si Miao, Yongxin Zhu, Xiao Huo
2019CVPRAudio-Visual Event Localization in the Wild.Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu
2019CVPRAudio-Visual Interpretable and Controllable Video Captioning.Yapeng Tian, Chenxiao Guan, Justin Goodman, Marc Moore, Chenliang Xu
2019IJCAIGAN-EM: GAN Based EM Learning Framework.Wentian Zhao, Shaojie Wang, Zhihuai Xie, Jing Shi, Chenliang Xu
2018AAAITowards Automatic Learning of Procedures From Web Instructional Videos.Luowei Zhou, Chenliang Xu, Jason J. Corso
2018CVPRWeakly-Supervised Action Segmentation With Iterative Soft Boundary Assignment.Li Ding, Chenliang Xu
2018ECCVLip Movements Generation at a Glance.Lele Chen, Zhiheng Li, Ross K. Maddox, Zhiyao Duan, Chenliang Xu
2018ECCVAudio-Visual Event Localization in Unconstrained Videos.Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu
2018WACVImproving Text-Based Person Search by Spatial Matching and Adaptive Threshold.Tianlang Chen, Chenliang Xu, Jiebo Luo
2017CVPRWeakly Supervised Actor-Action Segmentation via Robust Multi-task Ranking.Yan Yan, Chenliang Xu, Dawen Cai, Jason J. Corso
2016CVPRActor-Action Semantic Segmentation with Grouping Process Models.Chenliang Xu, Jason J. Corso
2015CVPRCan humans fly? Action understanding with multiple classes of actors.Chenliang Xu, Shao-Hang Hsieh, Caiming Xiong, Jason J. Corso
2013CVPRA Thousand Frames in Just a Few Words: Lingual Description of Videos through Latent Topics and Sparse Object Stitching.Pradipto Das, Chenliang Xu, Richard F. Doell, Jason J. Corso
2013ICCVFlattening Supervoxel Hierarchies by the Uniform Entropy Slice.Chenliang Xu, Spencer Whitt, Jason J. Corso
2012CVPREvaluation of super-voxel methods for early video processing.Chenliang Xu, Jason J. Corso
2012ECCVStreaming Hierarchical Video Segmentation.Chenliang Xu, Caiming Xiong, Jason J. Corso