Chenliang Xu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
81
Venues
19
Active years
2012–2026
Best venue rank
A*
Where they publish
Papers
81 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Caption Anything in Video: Fine-grained Object-centric Captioning via Spatiotemporal Multimodal Prompting. | Yolo Yunlong Tang, Jing Bi, Chao Huang, Susan Liang, Daiki Shimada, Hang Hua, Yunzhong Xiao, Yizhi Song, Pinxin Liu, Mingqian Feng, Junjia Guo, Zhuo Liu, Luchuan Song, Ali Vosoughi, Jinxi He, Liu He, Zeliang Zhang, Jiebo Luo, Chenliang Xu |
| 2026 | ACL | DRIFT: Transferring Reasoning Priors for Efficient MLLM Fine-Tuning. | Chao Huang, Zeliang Zhang, Jiang Liu, Ximeng Sun, Jialian Wu, Xiaodong Yu, Ze Wang, Chenliang Xu, Emad Barsoum, Zicheng Liu |
| 2025 | AAAI | Empowering LLMs with Pseudo-Untrimmed Videos for Audio-Visual Temporal Understanding. | Yunlong Tang, Daiki Shimada, Jing Bi, Mingqian Feng, Hang Hua, Chenliang Xu |
| 2025 | AAAI | V2Xum-LLM: Cross-Modal Video Summarization with Temporal Prompt Instruction Tuning. | Hang Hua, Yunlong Tang, Chenliang Xu, Jiebo Luo |
| 2025 | AAAI | CaRDiff: Video Salient Object Ranking Chain of Thought Reasoning for Saliency Prediction with Diffusion. | Yunlong Tang, Gen Zhan, Li Yang, Yiting Liao, Chenliang Xu |
| 2025 | ACL | Diversifying the Expert Knowledge for Task-Agnostic Pruning in Sparse Mixture-of-Experts. | Zeliang Zhang, Xiaodong Liu, Hao Cheng, Chenliang Xu, Jianfeng Gao |
| 2025 | CVPR | Unveiling Visual Perception in Language Models: An Attention Head Analysis Approach. | Jing Bi, Junjia Guo, Yunlong Tang, Lianggong Bruce Wen, Zhang Liu, Bingjie Wang, Chenliang Xu |
| 2025 | CVPR | VidComposition: Can MLLMs Analyze Compositions in Compiled Videos? | Yunlong Tang, Junjia Guo, Hang Hua, Susan Liang, Mingqian Feng, Xinyang Li, Rui Mao, Chao Huang, Jing Bi, Zeliang Zhang, Pooyan Fazli, Chenliang Xu |
| 2025 | CVPR | Learning to Highlight Audio by Watching Movies. | Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh |
| 2025 | CVPR | Targeted Forgetting of Image Subgroups in CLIP Models. | Zeliang Zhang, Gaowen Liu, Charles Fleming, Ramana Rao Kompella, Chenliang Xu |
| 2025 | ICCV | $\pi$-AVAS: Can Physics-Integrated Audio-Visual Modeling Boost Neural Acoustic Synthesis? | Susan Liang, Chao Huang, Yunlong Tang, Zeliang Zhang, Chenliang Xu |
| 2025 | ICCV | GestureLSM: Latent Shortcut Based Co-Speech Gesture Generation with Spatial-Temporal Modeling. | Pinxin Liu, Luchuan Song, Junhua Huang, Haiyang Liu, Chenliang Xu |
| 2025 | ICCV | Generative AI for Cel-Animation: A Survey. | Yunlong Tang, Junjia Guo, Pinxin Liu, Zhiyuan Wang, Hang Hua, Jia-Xing Zhong, Yunzhong Xiao, Chao Huang, Luchuan Song, Susan Liang, Yizhi Song, Liu He, Jing Bi, Mingqian Feng, Xinyang Li, Zeliang Zhang, Chenliang Xu |
| 2025 | ICLR | Rethinking Audio-Visual Adversarial Vulnerability from Temporal and Modality Perspectives. | Zeliang Zhang, Susan Liang, Daiki Shimada, Chenliang Xu |
| 2025 | ICML | BinauralFlow: A Causal and Streamable Approach for High-Quality Binaural Speech Synthesis with Flow Matching Models. | Susan Liang, Dejan Markovic, Israel D. Gebru, Steven Krenn, Todd Keebler, Jacob Sandakly, Frank Yu, Samuel Hassel, Chenliang Xu, Alexander Richard |
| 2025 | SIGGRAPH | StreamME: Simplify 3D Gaussian Avatar within Live Stream. | Luchuan Song, Yang Zhou, Zhan Xu, Yi Zhou, Deepali Aneja, Chenliang Xu |
| 2024 | ACCV | High-Quality Visually-Guided Sound Separation from Diverse Categories. | Chao Huang, Susan Liang, Yapeng Tian, Anurag Kumar, Chenliang Xu |
| 2024 | ACCV | Language-Guided Joint Audio-Visual Editing via One-Shot Adaptation. | Susan Liang, Chao Huang, Yapeng Tian, Anurag Kumar, Chenliang Xu |
| 2024 | CVPR | Discover and Mitigate Multiple Biased Subgroups in Image Classifiers. | Zeliang Zhang, Mingqian Feng, Zhiheng Li, Chenliang Xu |
| 2024 | CVPR | Learning to Transform Dynamically for Better Adversarial Transferability. | Rongyi Zhu, Zeliang Zhang, Zhuo Liu, Chenliang Xu, Susan Liang |
| 2024 | EACL | Random Smooth-based Certified Defense against Text Adversarial Attack. | Zeliang Zhang, Wei Yao, Susan Liang, Chenliang Xu |
| 2024 | ECCV | Modeling and Driving Human Body Soundfields Through Acoustic Primitives. | Chao Huang, Dejan Markovic, Chenliang Xu, Alexander Richard |
| 2024 | ECCV | Tri | Luchuan Song, Pinxin Liu, Lele Chen, Guojun Yin, Chenliang Xu |
| 2024 | EMNLP | Can CLIP Count Stars? An Empirical Study on Quantity Bias in CLIP. | Zeliang Zhang, Zhuo Liu, Mingqian Feng, Chenliang Xu |
| 2024 | ICASSP | Adaptive Super Resolution for One-Shot Talking-Head Generation. | Luchuan Song, Pinxin Liu, Guojun Yin, Chenliang Xu |
| 2024 | ICASSP | Learning Audio Concepts from Counterfactual Natural Language. | Ali Vosoughi, Luca Bondi, Ho-Hsiang Wu, Chenliang Xu |
| 2024 | ICLR | One Forward is Enough for Neural Network Training via Likelihood Ratio Method. | Jinyang Jiang, Zeliang Zhang, Chenliang Xu, Zhaofei Yu, Yijie Peng |
| 2024 | NAACL | OSCaR: Object State Captioning and State Change Representation. | Nguyen Nguyen, Jing Bi, Ali Vosoughi, Yapeng Tian, Pooyan Fazli, Chenliang Xu |
| 2024 | SiggraphA | TextToon: Real-Time Text Toonify Head Avatar from Single Video. | Luchuan Song, Lele Chen, Celong Liu, Pinxin Liu, Chenliang Xu |
| 2023 | CVPR | Egocentric Audio-Visual Object Localization. | Chao Huang, Yapeng Tian, Anurag Kumar, Chenliang Xu |
| 2023 | CVPR | A Whac-A-Mole Dilemma: Shortcuts Come in Multiples Where Mitigating One Amplifies Others. | Zhiheng Li, Ivan Evtimov, Albert Gordo, Caner Hazirbas, Tal Hassner, Cristian Canton-Ferrer, Chenliang Xu, Mark Ibrahim |
| 2023 | ICCV | Emotional Listener Portrait: Realistic Listener Motion Simulation in Conversation. | Luchuan Song, Guojun Yin, Zhenchao Jin, Xiaoyi Dong, Chenliang Xu |
| 2023 | UIST | PEANUT: A Human-AI Collaborative Tool for Annotating Audio-Visual Data. | Zheng Zhang, Zheng Ning, Chenliang Xu, Yapeng Tian, Toby Jia-Jun Li |
| 2022 | CVPR | SpaceEdit: Learning a Unified Editing Space for Open-Domain Image Color Editing. | Jing Shi, Ning Xu, Haitian Zheng, Alex Smith, Jiebo Luo, Chenliang Xu |
| 2022 | CVPR | Transformer-empowered Multi-scale Contextual Matching and Aggregation for Multi-contrast MRI Super-resolution. | Guangyuan Li, Jun Lv, Yapeng Tian, Qi Dou, Chengyan Wang, Chenliang Xu, Jing Qin |
| 2022 | CVPR | StyleT2I: Toward Compositional and High-Fidelity Text-to-Image Synthesis. | Zhiheng Li, Martin Renqiang Min, Kai Li, Chenliang Xu |
| 2022 | CVPR | Learning to Answer Questions in Dynamic Audio-Visual Scenarios. | Guangyao Li, Yake Wei, Yapeng Tian, Chenliang Xu, Ji-Rong Wen, Di Hu |
| 2022 | ECCV | Discover and Mitigate Unknown Biases with Debiasing Alternate Networks. | Zhiheng Li, Anthony Hoogs, Chenliang Xu |
| 2022 | ICPR | Cross-modal Contrastive Distillation for Instructional Activity Anticipation. | Zhengyuan Yang, Jingen Liu, Jing Huang, Xiaodong He, Tao Mei, Chenliang Xu, Jiebo Luo |
| 2021 | BMVC | Space-Time Memory Network for Sounding Object Localization in Videos. | Sizhe Li, Yapeng Tian, Chenliang Xu |
| 2021 | CVPR | Learning by Planning: Language-Guided Global Image Editing. | Jing Shi, Ning Xu, Yihang Xu, Trung Bui, Franck Dernoncourt, Chenliang Xu |
| 2021 | CVPR | High-Fidelity Face Tracking for AR/VR via Deep Lighting Adaptation. | Lele Chen, Chen Cao, Fernando De la Torre, Jason M. Saragih, Chenliang Xu, Yaser Sheikh |
| 2021 | CVPR | Cyclic Co-Learning of Sounding Object Visual Grounding and Sound Separation. | Yapeng Tian, Di Hu, Chenliang Xu |
| 2021 | CVPR | Can Audio-Visual Integration Strengthen Robustness Under Multimodal Attacks? | Yapeng Tian, Chenliang Xu |
| 2021 | ICCV | A Simple Baseline for Weakly-Supervised Scene Graph Generation. | Jing Shi, Yiwu Zhong, Ning Xu, Yin Li, Chenliang Xu |
| 2021 | ICCV | Procedure Planning in Instructional Videos via Contextual Modeling and Model-based Policy Learning. | Jing Bi, Jiebo Luo, Chenliang Xu |
| 2021 | ICCV | Explaining Local, Global, And Higher-Order Interactions In Deep Learning. | Samuel Lerman, Charles Venuto, Henry A. Kautz, Chenliang Xu |
| 2021 | ICCV | Discover the Unknown Biased Attribute of an Image Classifier. | Zhiheng Li, Chenliang Xu |
| 2021 | ICCV | Learning to Generate Scene Graph from Natural Language Supervision. | Yiwu Zhong, Jing Shi, Jianwei Yang, Chenliang Xu, Yin Li |
| 2021 | WACV | Improve CAM with Auto-adapted Segmentation and Co-supervised Augmentation. | Ziyi Kou, Guofeng Cui, Shaojie Wang, Wentian Zhao, Chenliang Xu |
| 2021 | WACV | How to Make a BLT Sandwich? Learning VQA towards Understanding Web Instructional Videos. | Shaojie Wang, Wentian Zhao, Ziyi Kou, Jing Shi, Chenliang Xu |
| 2020 | AAAI | Learning from Interventions Using Hierarchical Policies for Safe Learning. | Jing Bi, Vikas Dhiman, Tianyou Xiao, Chenliang Xu |
| 2020 | ACCV | A Benchmark and Baseline for Language-Driven Image Editing. | Jing Shi, Ning Xu, Trung Bui, Franck Dernoncourt, Zheng Wen, Chenliang Xu |
| 2020 | CVPR | Learning a Weakly-Supervised Video Actor-Action Segmentation Model With a Wise Selection. | Jie Chen, Zhiheng Li, Jiebo Luo, Chenliang Xu |
| 2020 | CVPR | Deep Grouping Model for Unified Perceptual Parsing. | Zhiheng Li, Wenxuan Bao, Jiayang Zheng, Chenliang Xu |
| 2020 | CVPR | TDAN: Temporally-Deformable Alignment Network for Video Super-Resolution. | Yapeng Tian, Yulun Zhang, Yun Fu, Chenliang Xu |
| 2020 | CVPR | Zooming Slow-Mo: Fast and Accurate One-Stage Space-Time Video Super-Resolution. | Xiaoyu Xiang, Yapeng Tian, Yulun Zhang, Yun Fu, Jan P. Allebach, Chenliang Xu |
| 2020 | ECCV | Talking-Head Generation with Rhythmic Head Motion. | Lele Chen, Guofeng Cui, Celong Liu, Zhong Li, Ziyi Kou, Yi Xu, Chenliang Xu |
| 2020 | ECCV | Unified Multisensory Perception: Weakly-Supervised Audio-Visual Video Parsing. | Yapeng Tian, Dingzeyu Li, Chenliang Xu |
| 2020 | ICASSP | End-To-End Generation of Talking Faces from Noisy Speech. | Sefik Emre Eskimez, Ross K. Maddox, Chenliang Xu, Zhiyao Duan |
| 2020 | WACV | TailorGAN: Making User-Defined Fashion Designs. | Lele Chen, Justin Tian, Guo Li, Cheng-Haw Wu, Erh-Kan King, Kuan-Ting Chen, Shao-Hang Hsieh, Chenliang Xu |
| 2019 | BMVC | Dynamic Graph Modules for Modeling Object-Object Interactions in Activity Recognition. | Hao Huang, Luowei Zhou, Wei Zhang, Jason J. Corso, Chenliang Xu |
| 2019 | CVPR | Not All Frames Are Equal: Weakly-Supervised Video Grounding With Contextual Similarity and Visual Clustering Losses. | Jing Shi, Jia Xu, Boqing Gong, Chenliang Xu |
| 2019 | CVPR | Hierarchical Cross-Modal Talking Face Generation With Dynamic Pixel-Wise Loss. | Lele Chen, Ross K. Maddox, Zhiyao Duan, Chenliang Xu |
| 2019 | CVPR | Sound to Visual: Hierarchical Cross-Modal Talking Face Generation. | Lele Chen, Haitian Zheng, Ross K. Maddox, Zhiyao Duan, Chenliang Xu |
| 2019 | CVPR | NTIRE 2019 Challenge on Video Super-Resolution: Methods and Results. | Seungjun Nah, Radu Timofte, Shuhang Gu, Sungyong Baik, Seokil Hong, Gyeongsik Moon, Sanghyun Son, Kyoung Mu Lee, Xintao Wang, Kelvin C. K. Chan, Ke Yu, Chao Dong, Chen Change Loy, Yuchen Fan, Jiahui Yu, Ding Liu, Thomas S. Huang, Xiao Liu, Chao Li, Dongliang He, Yukang Ding, Shilei Wen, Fatih Porikli, Ratheesh Kalarot, Muhammad Haris, Greg Shakhnarovich, Norimichi Ukita, Peng Yi, Zhongyuan Wang, Kui Jiang, Junjun Jiang, Jiayi Ma, Hang Dong, Xinyi Zhang, Zhe Hu, Kwan-Young Kim, Dong Un Kang, Se Young Chun, Kuldeep Purohit, A. N. Rajagopalan, Yapeng Tian, Yulun Zhang, Yun Fu, Chenliang Xu, Ahmet Murat Tekalp, Mustafa Akin Yilmaz, Cansu Korkmaz, Manoj Sharma, Megh Makwana, Anuj Badhwar, Ajay Pratap Singh, Avinash Upadhyay, Rudrabha Mukhopadhyay, Ankit Shukla, Dheeraj Khanna, A. S. Mandal, Santanu Chaudhury, Si Miao, Yongxin Zhu, Xiao Huo |
| 2019 | CVPR | Audio-Visual Event Localization in the Wild. | Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu |
| 2019 | CVPR | Audio-Visual Interpretable and Controllable Video Captioning. | Yapeng Tian, Chenxiao Guan, Justin Goodman, Marc Moore, Chenliang Xu |
| 2019 | IJCAI | GAN-EM: GAN Based EM Learning Framework. | Wentian Zhao, Shaojie Wang, Zhihuai Xie, Jing Shi, Chenliang Xu |
| 2018 | AAAI | Towards Automatic Learning of Procedures From Web Instructional Videos. | Luowei Zhou, Chenliang Xu, Jason J. Corso |
| 2018 | CVPR | Weakly-Supervised Action Segmentation With Iterative Soft Boundary Assignment. | Li Ding, Chenliang Xu |
| 2018 | ECCV | Lip Movements Generation at a Glance. | Lele Chen, Zhiheng Li, Ross K. Maddox, Zhiyao Duan, Chenliang Xu |
| 2018 | ECCV | Audio-Visual Event Localization in Unconstrained Videos. | Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu |
| 2018 | WACV | Improving Text-Based Person Search by Spatial Matching and Adaptive Threshold. | Tianlang Chen, Chenliang Xu, Jiebo Luo |
| 2017 | CVPR | Weakly Supervised Actor-Action Segmentation via Robust Multi-task Ranking. | Yan Yan, Chenliang Xu, Dawen Cai, Jason J. Corso |
| 2016 | CVPR | Actor-Action Semantic Segmentation with Grouping Process Models. | Chenliang Xu, Jason J. Corso |
| 2015 | CVPR | Can humans fly? Action understanding with multiple classes of actors. | Chenliang Xu, Shao-Hang Hsieh, Caiming Xiong, Jason J. Corso |
| 2013 | CVPR | A Thousand Frames in Just a Few Words: Lingual Description of Videos through Latent Topics and Sparse Object Stitching. | Pradipto Das, Chenliang Xu, Richard F. Doell, Jason J. Corso |
| 2013 | ICCV | Flattening Supervoxel Hierarchies by the Uniform Entropy Slice. | Chenliang Xu, Spencer Whitt, Jason J. Corso |
| 2012 | CVPR | Evaluation of super-voxel methods for early video processing. | Chenliang Xu, Jason J. Corso |
| 2012 | ECCV | Streaming Hierarchical Video Segmentation. | Chenliang Xu, Caiming Xiong, Jason J. Corso |