| 2026 | AAAI | AUVIC: Adversarial Unlearning of Visual Concepts for Multi-modal Large Language Models. | Haokun Chen, Jianing Li, Yao Zhang, Jinhe Bi, Yan Xia, Jindong Gu, Volker Tresp |
| 2026 | AAAI | CMMCoT: Enhancing Complex Multi-Image Comprehension via Multi-Modal Chain-of-Thought and Memory Augmentation. | Guanghao Zhang, Tao Zhong, Yan Xia, Mushui Liu, Zhelun Yu, Haoyuan Li, Wanggui He, Dong She, Yi Wang, Hao Jiang |
| 2026 | ACL | Single-Pass, Depth-Selective Reading for Multi-Aspect Sentiment Analysis. | Yan Xia, Zhuangzhuang Pan, Amirrudin Kamsin, Chee Seng Chan |
| 2026 | CHI | Balancing Openness and Safety: Central and Peripheral Governance Practices in the Lesbian Subreddit Ecosystem. | Yan Xia, Sushmita Khan, Naiyah Lewis, Jinkyung Katie Park |
| 2025 | AAAI | L4DR: LiDAR-4DRadar Fusion for Weather-Robust 3D Object Detection. | Xun Huang, Ziyu Xu, Hai Wu, Jinlong Wang, Qiming Xia, Yan Xia, Jonathan Li, Kyle Gao, Chenglu Wen, Cheng Wang |
| 2025 | ACL | CART: A Generative Cross-Modal Retrieval Framework With Coarse-To-Fine Semantic Modeling. | Minghui Fang, Shengpeng Ji, Jialong Zuo, Hai Huang, Yan Xia, Jieming Zhu, Xize Cheng, Xiaoda Yang, Wenrui Liu, Gang Wang, Zhenhua Dong, Zhou Zhao |
| 2025 | ACL | Enhancing Multimodal Unified Representations for Cross Modal Generalization. | Hai Huang, Yan Xia, Shengpeng Ji, Shulei Wang, Hanting Wang, Minghui Fang, Jieming Zhu, Zhenhua Dong, Sashuai Zhou, Zhou Zhao |
| 2025 | ACL | Bitnet.cpp: Efficient Edge Inference for Ternary LLMs. | Jinheng Wang, Hansong Zhou, Ting Song, Shijie Cao, Yan Xia, Ting Cao, Jianyu Wei, Shuming Ma, Hongyu Wang, Furu Wei |
| 2025 | CHI | ProductMeta: An Interactive System for Metaphorical Product Design Ideation with Multimodal Large Language Models. | Qinyi Zhou, Jie Deng, Yu Liu, Yun Wang, Yan Xia, Yang Ou, Zhicong Lu, Sai Ma, Scarlett Li, Yingqing Xu |
| 2025 | COLING | ALYMPICS: LLM Agents Meet Game Theory. | Shaoguang Mao, Yuzhe Cai, Yan Xia, Wenshan Wu, Xun Wang, Fengyi Wang, Qiang Guan, Tao Ge, Furu Wei |
| 2025 | CVPR | RADLER: Radar Object Detection Leveraging Semantic 3D City Models and Self-Supervised Radar-Image Learning. | Yuan Luo, Rudolf Hoffmann, Yan Xia, Olaf Wysocki, Benedikt Schwab, Thomas H. Kolbe, Daniel Cremers |
| 2025 | CVPR | Reconstructing Humans with a Biomechanically Accurate Skeleton. | Yan Xia, Xiaowei Zhou, Etienne Vouga, Qixing Huang, Georgios Pavlakos |
| 2025 | CVPR | SparseAlign: a Fully Sparse Framework for Cooperative Object Detection. | Yunshuang Yuan, Yan Xia, Daniel Cremers, Monika Sester |
| 2025 | CVPR | Localizing Events in Videos with Multimodal Queries. | Gengyuan Zhang, Mang Ling Ada Fok, Jialu Ma, Yan Xia, Daniel Cremers, Philip Torr, Volker Tresp, Jindong Gu |
| 2025 | EMNLP | RecBase: Generative Foundation Model Pretraining for Zero-Shot Recommendation. | Sashuai Zhou, Weinan Gan, Qijiong Liu, Ke Lei, Jieming Zhu, Hai Huang, Yan Xia, Ruiming Tang, Zhenhua Dong, Zhou Zhao |
| 2025 | ICASSP | Semantic Residual for Multimodal Unified Discrete Representation. | Hai Huang, Shulei Wang, Yan Xia |
| 2025 | ICCV | Open-Set Cross Modal Generalization via Multimodal Unified Representation. | Hai Huang, Yan Xia, Shulei Wang, Hanting Wang, Minghui Fang, Shengpeng Ji, Sashuai Zhou, Tao Jin, Zhou Zhao |
| 2025 | ICCV | Bridging Domain Generalization to Multimodal Domain Generalization via Unified Representations. | Hai Huang, Yan Xia, Sashuai Zhou, Hanting Wang, Shulei Wang, Zhou Zhao |
| 2025 | ICCV | CoDa-4DGS: Dynamic Gaussian Splatting with Context and Deformation Awareness for Autonomous Driving. | Rui Song, Chenwei Liang, Yan Xia, Walter Zimmer, Hu Cao, Holger Caesar, Andreas Festag, Alois Knoll |
| 2025 | ICCV | CSG-Fusion: Consistent Sparse-View Gaussian Splatting via Matching-based Fusion. | Yan Xia, Wenbo Ji, Weirong Chen, Daniel Cremers |
| 2025 | ICCV | Trafficloc: Localizing Traffic Surveillance Cameras in 3D Scenes. | Yan Xia, Yunxiang Lu, Rui Song, Oussema Dhaouadi, Joo F. Henriques, Daniel Cremers |
| 2025 | ICML | Imagine While Reasoning in Space: Multimodal Visualization-of-Thought. | Chengzu Li, Wenshan Wu, Huanyu Zhang, Yan Xia, Shaoguang Mao, Li Dong, Ivan Vulic, Furu Wei |
| 2025 | ICRA | MonoCT: Overcoming Monocular 3D Detection Domain Shift with Consistent Teacher Models. | Johannes Meier, Louis Inchingolo, Oussema Dhaouadi, Yan Xia, Jacques Kaiser, Daniel Cremers |
| 2025 | Interspeech | Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval. | Ruofan Hu, Yan Xia, Minjie Hong, Jieming Zhu, Bo Chen, Xiaoda Yang, Minghui Fang, Tao Jin |
| 2025 | IROS | Feature-aligned Fisheye Object Detection Network for Autonomous Driving. | Hu Cao, Dongyi Sun, Rui Song, Yan Xia, Xinyi Li, Alois Knoll |
| 2025 | ICWSM | Integrated or Segregated? User Behavior Change After Cross-Party Interactions on Reddit. | Yan Xia, Corrado Monti, Barbara Keller, Mikko Kivel |
| 2025 | NAACL | Overcoming both Domain Shift and Label Shift for Referring Video Segmentation. | Hai Huang, Sashuai Zhou, Yan Xia |
| 2025 | NAACL | K-Level Reasoning: Establishing Higher Order Beliefs in Large Language Models for Strategic Reasoning. | Yadong Zhang, Shaoguang Mao, Tao Ge, Xun Wang, Yan Xia, Man Lan, Furu Wei |
| 2025 | WSC | Simulation-Based Online Retailer Supply Chain Inbound Node Arrival Capacity Control. | Michael Bloem, Song Sam Zhou, Kai He, Zhunyou Jony Hua, Yan Xia |
| 2025 | WWW | EAGER-LLM: Enhancing Large Language Models as Recommenders through Exogenous Behavior-Semantic Integration. | Minjie Hong, Yan Xia, Zehan Wang, Jieming Zhu, Ye Wang, Sihang Cai, Xiaoda Yang, Quanyu Dai, Zhenhua Dong, Zhimeng Zhang, Zhou Zhao |
| 2025 | WACV | ZAHA: Introducing the Level of Facade Generalization and the Large-Scale Point Cloud Facade Semantic Segmentation Benchmark Dataset. | Olaf Wysocki, Yue Tan, Thomas Froech, Yan Xia, Magdalena Wysocki, Ludwig Hoegner, Daniel Cremers, Christoph Holst |
| 2024 | AAAI | StyleSinger: Style Transfer for Out-of-Domain Singing Voice Synthesis. | Yu Zhang, Rongjie Huang, Ruiqi Li, Jinzheng He, Yan Xia, Feiyang Chen, Xinyu Duan, Baoxing Huai, Zhou Zhao |
| 2024 | CVPR | Text2Loc: 3D Point Cloud Localization from Natural Language. | Yan Xia, Letian Shi, Zifeng Ding, Joo F. Henriques, Daniel Cremers |
| 2024 | ECCV | Embracing Events and Frames with Hierarchical Feature Refinement Network for Object Detection. | Hu Cao, Zehua Zhang, Yan Xia, Xinyi Li, Jiahao Xia, Guang Chen, Alois Knoll |
| 2024 | ECCV | Boosting 3D Single Object Tracking with 2D Matching Distillation and 3D Pre-training. | Qiangqiang Wu, Yan Xia, Jia Wan, Antoni B. Chan |
| 2024 | EMNLP | Temporal Fact Reasoning over Hyper-Relational Knowledge Graphs. | Zifeng Ding, Jingcheng Wu, Jingpei Wu, Yan Xia, Bo Xiong, Volker Tresp |
| 2024 | EMNLP | CERD: A Comprehensive Chinese Rhetoric Dataset for Rhetorical Understanding and Generation in Essays. | Nuowei Liu, Xinhao Chen, Hongyi Wu, Changzhi Sun, Man Lan, Yuanbin Wu, Xiaopeng Bai, Shaoguang Mao, Yan Xia |
| 2024 | IGARSS | Robust Estimation of Tree Diameter at Breast Height from Point Clouds. | Abdul Nurunnabi, Felicia Teferle, Ali Al-Sharadqah, Yan Xia, Addisu Hunegnaw |
| 2024 | IJCAI | Bridging LiDAR Gaps: A Multi-LiDARs Domain Adaptation Dataset for 3D Semantic Segmentation. | Shaoyang Chen, Bochun Yang, Yan Xia, Ming Cheng, Siqi Shen, Cheng Wang |
| 2024 | ISCAS | A Microfluidic Impedance Cytometer for Accurate Detection and Counting of Circulating Tumor Cells by Simultaneous Mechanical and Electrical Sensing. | Xiang Ke, Jin Chen, Jingjing Sun, Rikui Xiang, Wenjing Fang, Liangzun Fu, Xiwei Huang, Yan Xia, Jinhong Guo, Lingling Sun |
| 2024 | KDD | EAGER: Two-Stream Generative Recommender with Behavior-Semantic Collaboration. | Ye Wang, Jiahao Xun, Minjie Hong, Jieming Zhu, Tao Jin, Wang Lin, Haoyuan Li, Linjun Li, Yan Xia, Zhou Zhao, Zhenhua Dong |
| 2024 | NAACL | Low-code LLM: Graphical User Interface over Large Language Models. | Yuzhe Cai, Shaoguang Mao, Wenshan Wu, Zehua Wang, Yaobo Liang, Tao Ge, Chenfei Wu, Wang You, Ting Song, Yan Xia, Nan Duan, Furu Wei |
| 2024 | SiggraphA | World-Grounded Human Motion Recovery via Gravity-View Coordinates. | Zehong Shen, Huaijin Pi, Yan Xia, Zhi Cen, Sida Peng, Zechen Hu, Hujun Bao, Ruizhen Hu, Xiaowei Zhou |
| 2023 | ACL | Smart Word Suggestions for Writing Assistance. | Chenshuo Wang, Shaoguang Mao, Tao Ge, Wenshan Wu, Xun Wang, Yan Xia, Jonathan Tien, Dongyan Zhao |
| 2023 | ACL | Scene-robust Natural Language Video Localization via Learning Domain-invariant Representations. | Zehan Wang, Yang Zhao, Haifeng Huang, Yan Xia, Zhou Zhao |
| 2023 | CVPR | Scan2LoD3: Reconstructing semantic 3D building models at LoD3 using ray casting and Bayesian networks. | Olaf Wysocki, Yan Xia, Magdalena Wysocki, Eleonora Grilli, Ludwig Hoegner, Daniel Cremers, Uwe Stilla |
| 2023 | EMNLP | Not All Languages Are Created Equal in LLMs: Improving Multilingual Capability by Cross-Lingual-Thought Prompting. | Haoyang Huang, Tianyi Tang, Dongdong Zhang, Xin Zhao, Ting Song, Yan Xia, Furu Wei |
| 2023 | HCI | A Review of How Team Creativity is Affected by the Design of Communication Tools. | Yan Xia, Yue Chen |
| 2023 | ICCV | CASSPR: Cross Attention Single Scan Place Recognition. | Yan Xia, Mariia Gladkova, Rui Wang, Qianyun Li, Uwe Stilla, Joo F. Henriques, Daniel Cremers |
| 2023 | ICDM | E-swish Regularized Nonnegative Latent Factorization of Tensors for Dynamic Network Link Prediction. | Hao Wu, Yan Xia, ChengXuan Zhou |
| 2023 | Interspeech | Assessing Phrase Break of ESL Speech with Pre-trained Language Models and Large Language Models. | Zhiyi Wang, Shaoguang Mao, Wenshan Wu, Yan Xia, Yan Deng, Jonathan Tien |
| 2023 | MICCAI | Learned Local Attention Maps for Synthesising Vessel Segmentations from T2 MRI. | Yash Deo, Rodrigo Bonazzola, Haoran Dou, Yan Xia, Tianyou Wei, Nishant Ravikumar, Alejandro F. Frangi, Toni Lassila |
| 2023 | MICCAI | Adaptive Semi-supervised Segmentation of Brain Vessels with Ambiguous Labels. | Fengming Lin, Yan Xia, Nishant Ravikumar, Qiongyao Liu, Michael MacRaild, Alejandro F. Frangi |
| 2022 | CVPR | Cross-modal Background Suppression for Audio-Visual Event Localization. | Yan Xia, Zhou Zhao |
| 2022 | ICASSP | A Universal Ordinal Regression for Assessing Phoneme-Level Pronunciation. | Shaoguang Mao, Frank K. Soong, Yan Xia, Jonathan Tien |
| 2022 | ICASSP | An Approach to Mispronunciation Detection and Diagnosis with Acoustic, Phonetic and Linguistic (APL) Embeddings. | Wenxuan Ye, Shaoguang Mao, Frank K. Soong, Wenshan Wu, Yan Xia, Jonathan Tien, Zhiyong Wu |
| 2022 | ICWSM | Limits of Multilayer Diffusion Network Inference in Social Media Research. | Yan Xia, Ted Hsuan Yun Chen, Mikko Kivel |
| 2021 | CVPR | SOE-Net: A Self-Attention and Orientation Encoding Network for Point Cloud Based Place Recognition. | Yan Xia, Yusheng Xu, Shuang Li, Rui Wang, Juan Du, Daniel Cremers, Uwe Stilla |
| 2021 | ICASSP | Improving Pronunciation Assessment Via Ordinal Regression with Anchored Reference Samples. | Bin Su, Shaoguang Mao, Frank K. Soong, Yan Xia, Jonathan Tien, Zhiyong Wu |
| 2021 | MICCAI | A Deep Discontinuity-Preserving Image Registration Network. | Xiang Chen, Yan Xia, Nishant Ravikumar, Alejandro F. Frangi |
| 2021 | VR | Matching 2D Image Patches and 3D Point Cloud Volumes by Learning Local Cross-domain Feature Descriptors. | Weiquan Liu, Baiqi Lai, Cheng Wang, Xuesheng Bian, Chenglu Wen, Ming Cheng, Yu Zang, Yan Xia, Jonathan Li |
| 2020 | CIKM | Relevance Ranking for Real-Time Tweet Search. | Yan Xia, Yu Sun, Tian Wang, Juan Caicedo Carvajal, Jinliang Fan, Bhargav Mangipudi, Lisa Huang, Yatharth Saraf |
| 2020 | VR | Learning to Match 2D Images and 3D LiDAR Point Clouds for Outdoor Augmented Reality. | Weiquan Liu, Baiqi Lai, Cheng Wang, Xuesheng Bian, Wentao Yang, Yan Xia, Xiuhong Lin, Shang-Hong Lai, Dongdong Weng, Jonathan Li |
| 2019 | CSEDU | Performance Evaluation of Universities and Colleges based on Method of Principal Component Analysis and Data Envelopment Analysis. | Yan Xia, Xinlin Wu, Hui Feng |
| 2017 | CSEDU | Discipline Evaluation Management Platform based on Big Data. | Yan Xia, Xinlin Wu, Hui Feng |
| 2017 | CSEDU | Evaluation of Talents' Scientific Research Capability based on Rough Set Fuzzy Clustering Algorithm. | Yan Xia, Xinlin Wu, Hui Feng |
| 2017 | ITNAC | Latency optimal broadcasting in noisy wireless mesh networks. | Qin Xin, Yan Xia |
| 2016 | CSEDU | Discipline Decision Tree Classification Algorithm and Application based on Weighted Information Gain Ratio. | Yan Xia, Jian Shu, Na Xu, Hui Feng |
| 2016 | ECCV | Robust Text Detection with Vertically-Regressed Proposal Network. | Donglai Xiang, Qiang Guo, Yan Xia |
| 2015 | CVPR | Sparse projections for high-dimensional binary codes. | Yan Xia, Kaiming He, Pushmeet Kohli, Jian Sun |
| 2015 | ICCV | Learning Discriminative Reconstructions for Unsupervised Outlier Removal. | Yan Xia, Xudong Cao, Fang Wen, Gang Hua, Jian Sun |
| 2014 | ECCV | Well Begun Is Half Done: Generating High-Quality Seeds for Automatic Image Dataset Construction from Web. | Yan Xia, Xudong Cao, Fang Wen, Jian Sun |
| 2013 | ICCV | Joint Inverted Indexing. | Yan Xia, Kaiming He, Fang Wen, Jian Sun |
| 2010 | ECCV | A Close-Form Iterative Algorithm for Depth Inferring from a Single Image. | Yang Cao, Yan Xia, Zengfu Wang |
| 2005 | MICCAI | Knowledge-Based Classification of Neuronal Fibers in Entire Brain. | Yan Xia, And U. Turken, Susan L. Whitfield-Gabrieli, John D. E. Gabrieli |
| 2003 | MICCAI | Rapid and Automated Extraction of the Fourth Ventricle from MR Images. | Yan Xia, Aamer Aziz, Qingmao Hu, Wieslaw Lucjan Nowinski |
| 2000 | APSEC | CIMO - Component Integration MOdel. | Yan Xia, Anthony Tung Shuen Ho, YuCheng Zhang |