Skip to content

Weidi Xie

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

87

Venues

13

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

87 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIVersatile Vision-Language Model for 3D Computed Tomography.Jiayu Lei, Ziqing Fan, Yanyong Zhang, Weidi Xie, Ya Zhang, Yanfeng Wang
2025AAAIGrounded Multi-Hop VideoQA in Long-Form Egocentric Videos.Qirui Chen, Shangzhe Di, Weidi Xie
2025CBMIELIP: Enhanced Visual-Language Foundation Models for Image Retrieval.Guanqi Zhan, Yuanpei Liu, Kai Han, Weidi Xie, Andrew Zisserman
2025CVPRLamRA: Large Multimodal Model as Your Advanced Retrieval Assistant.Yikun Liu, Yajie Zhang, Jiayin Cai, Xiaolong Jiang, Yao Hu, Jiangchao Yao, Yanfeng Wang, Weidi Xie
2025CVPRTowards Universal Soccer Video Understanding.Jiayuan Rao, Haoning Wu, Hao Jiang, Ya Zhang, Yanfeng Wang, Weidi Xie
2025CVPREnhancing Video-LLM Reasoning via Agent-of-Thoughts Distillation.Yudi Shi, Shangzhe Di, Qirui Chen, Weidi Xie
2025ICCVObject-Centric Video Question Answering with Visual Grounding and Referring.Haochen Wang, Qirui Chen, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Weidi Xie, Stratis Gavves
2025ICCVMRGen: Segmentation Data Engine for Underrepresented MRI Modalities.Haoning Wu, Ziheng Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie
2025ICCVShot-by-Shot: Film-Grammar-Aware Training-Free Audio Description Generation.Junyu Xie, Tengda Han, Max Bain, Arsha Nagrani, Eshika Khandelwal, Gl Varol, Weidi Xie, Andrew Zisserman
2025ICCVLearning Streaming Video Representation via Multitask Training.Yibin Yan, Jilan Xu, Shangzhe Di, Yikun Liu, Yudi Shi, Qirui Chen, Zeqian Li, Yifei Huang, Weidi Xie
2025ICLRTrack-On: Transformer-based Online Point Tracking with Memory.Grkay Aydemir, Xiongyi Cai, Weidi Xie, Fatma Gney
2025ICLRModeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning.Baoqi Pei, Yifei Huang, Jilan Xu, Guo Chen, Yuping He, Lijin Yang, Yali Wang, Weidi Xie, Yu Qiao, Fei Wu, Limin Wang
2025ICLREgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos.Jilan Xu, Yifei Huang, Baoqi Pei, Junlin Hou, Qingqiu Li, Guo Chen, Yuejie Zhang, Rui Feng, Weidi Xie
2025ICLRA Sanity Check for AI-generated Image Detection.Shilin Yan, Ouxiang Li, Jiayin Cai, Yanbin Hao, Xiaolong Jiang, Yao Hu, Weidi Xie
2025MICCAIMJinghao Feng, Qiaoyu Zheng, Chaoyi Wu, Ziheng Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie
2025MICCAIRadIR: A Scalable Framework for Multi-grained Medical Image Retrieval via Radiology Report Mining.Tengfei Zhang, Ziheng Zhao, Chaoyi Wu, Xiao Zhou, Ya Zhang, Yanfeng Wang, Weidi Xie
2024ACCVAutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description.Junyu Xie, Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman
2024ACCVMoving Object Segmentation: All You Need is SAM (and Flow).Junyu Xie, Charig Yang, Weidi Xie, Andrew Zisserman
2024CVPRGrounded Question-Answering in Long Egocentric Videos.Shangzhe Di, Weidi Xie
2024CVPRInstaGen: Enhancing Object Detection by Training on Synthetic Dataset.Chengjian Feng, Yujie Zhong, Zequn Jie, Weidi Xie, Lin Ma
2024CVPRAutoAD III: The Prequel - Back to the Pixels.Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman
2024CVPRIntelligent Grimm - Open-ended Visual Storytelling via Latent Diffusion Models.Chang Liu, Haoning Wu, Yujie Zhong, Xiaoyun Zhang, Yanfeng Wang, Weidi Xie
2024CVPRRetrieval-Augmented Egocentric Video Captioning.Jilan Xu, Yifei Huang, Junlin Hou, Guo Chen, Yuejie Zhang, Rui Feng, Weidi Xie
2024CVPRAmodal Ground Truth and Completion in the Wild.Guanqi Zhan, Chuanxia Zheng, Weidi Xie, Andrew Zisserman
2024ECCVMulti-sentence Grounding for Long-Term Instructional Video.Zeqian Li, Qirui Chen, Tengda Han, Ya Zhang, Yanfeng Wang, Weidi Xie
2024ECCVAppearance-Based Refinement for Object-Centric Motion Segmentation.Junyu Xie, Weidi Xie, Andrew Zisserman
2024ECCVMade to Order: Discovering Monotonic Temporal Changes via Self-supervised Video Ordering.Charig Yang, Weidi Xie, Andrew Zisserman
2024ECCVVISA: Reasoning Video Object Segmentation via Large Language Models.Cilin Yan, Haochen Wang, Shilin Yan, Xiaolong Jiang, Yao Hu, Guoliang Kang, Weidi Xie, Efstratios Gavves
2024ECCVKnowledge-Enhanced Visual-Language Pretraining for Computational Pathology.Xiao Zhou, Xiaoman Zhang, Chaoyi Wu, Ya Zhang, Weidi Xie, Yanfeng Wang
2024EMNLPMatchTime: Towards Automatic Soccer Game Commentary Generation.Jiayuan Rao, Haoning Wu, Chang Liu, Yanfeng Wang, Weidi Xie
2024EMNLPEchoSight: Advancing Visual-Language Models with Wiki Knowledge.Yibin Yan, Weidi Xie
2024EMNLPRaTEScore: A Metric for Radiology Report Generation.Weike Zhao, Chaoyi Wu, Xiaoman Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie
2024ICASSPSynchformer: Efficient Synchronization From Sparse Cues.Vladimir Iashin, Weidi Xie, Esa Rahtu, Andrew Zisserman
2024WACVAnnotation-free Audio-Visual Segmentation.Jinxiang Liu, Yu Wang, Chen Ju, Chaofan Ma, Ya Zhang, Weidi Xie
2023BMVCZero-shot Composed Text-Image Retrieval.Yikun Liu, Jiangchao Yao, Ya Zhang, Yanfeng Wang, Weidi Xie
2023BMVCBoost Video Frame Interpolation via Motion Adaptation.Haoning Wu, Xiaoyun Zhang, Weidi Xie, Ya Zhang, Yanfeng Wang
2023CVPROvarNet: Towards Open-Vocabulary Object Attribute Recognition.Keyan Chen, Xiaolong Jiang, Yao Hu, Xu Tang, Yan Gao, Jianqi Chen, Weidi Xie
2023CVPRAutoAD: Movie Description in Context.Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman
2023CVPRCollaboration Helps Camera Overtake LiDAR in 3D Detection.Yue Hu, Yifan Lu, Runsheng Xu, Weidi Xie, Siheng Chen, Yanfeng Wang
2023CVPRZero-shot Unsupervised Transfer Instance Segmentation.Gyungin Shin, Samuel Albanie, Weidi Xie
2023CVPRNamedMask: Distilling Segmenters from Complementary Foundation Models.Gyungin Shin, Weidi Xie, Samuel Albanie
2023CVPRLearning Open-Vocabulary Semantic Segmentation Models From Natural Language Supervision.Jilan Xu, Junlin Hou, Yuejie Zhang, Rui Feng, Yi Wang, Yu Qiao, Weidi Xie
2023CVPRCali-NCE: Boosting Cross-modal Video Representation Learning with Calibrated Alignment.Nanxuan Zhao, Jianbo Jiao, Weidi Xie, Dahua Lin
2023ICCVAutoAD II: The Sequel - Who, When, and What in Movie Audio Description.Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman
2023ICCVThe Making and Breaking of Camouflage.Hala Lamdouar, Weidi Xie, Andrew Zisserman
2023ICCVOpen-vocabulary Object Segmentation with Diffusion Models.Ziyi Li, Qinye Zhou, Xiaoyun Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie
2023ICCVTowards Open-Vocabulary Video Instance Segmentation.Haochen Wang, Xiaolong Jiang, Xu Tang, Yao Hu, Cilin Yan, Weidi Xie, Shuai Wang, Efstratios Gavves
2023ICCVMedKLIP: Medical Knowledge Enhanced Language-Image Pre-Training for X-ray Diagnosis.Chaoyi Wu, Xiaoman Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie
2023ICCVJoint-Relation Transformer for Multi-Person Motion Prediction.Qingyao Xu, Weibo Mao, Jingze Gong, Chenxin Xu, Siheng Chen, Weidi Xie, Ya Zhang, Yanfeng Wang
2023ICMLMulti-Modal Classifiers for Open-Vocabulary Object Detection.Prannay Kaul, Weidi Xie, Andrew Zisserman
2023MICCAIPMC-CLIP: Contrastive Language-Image Pre-training Using Biomedical Documents.Weixiong Lin, Ziheng Zhao, Xiaoman Zhang, Chaoyi Wu, Ya Zhang, Yanfeng Wang, Weidi Xie
2022BMVCTurbo Training with Token Dropout.Tengda Han, Weidi Xie, Andrew Zisserman
2022BMVCSparse in Space and Time: Audio-visual Synchronisation with Trainable Selectors.Vladimir Iashin, Weidi Xie, Esa Rahtu, Andrew Zisserman
2022BMVCCounTR: Transformer-based Generalised Visual Counting.Chang Liu, Yujie Zhong, Andrew Zisserman, Weidi Xie
2022BMVCOpen-vocabulary Semantic Segmentation with Frozen Vision-Language Models.Chaofan Ma, Yuhuan Yang, Yanfeng Wang, Ya Zhang, Weidi Xie
2022BMVCA Tri-Layer Plugin to Improve Occluded Detection.Guanqi Zhan, Weidi Xie, Andrew Zisserman
2022BMVCK-Space Transformer for Undersampled MRI Reconstruction.Ziheng Zhao, Tianjiao Zhang, Weidi Xie, Yanfeng Wang, Ya Zhang
2022BMVCA Simple Plugin for Transforming Images to Arbitrary Scales.Qinye Zhou, Ziyi Li, Weidi Xie, Xiaoyun Zhang, Yanfeng Wang, Ya Zhang
2022CVPRTemporal Alignment Networks for Long-term Video.Tengda Han, Weidi Xie, Andrew Zisserman
2022CVPRLabel, Verify, Correct: A Simple Few Shot Object Detection Method.Prannay Kaul, Weidi Xie, Andrew Zisserman
2022CVPRUnsupervised Salient Object Detection with Spectral Cluster Voting.Gyungin Shin, Samuel Albanie, Weidi Xie
2022CVPRIt's About Time: Analog Clock Reading in the Wild.Charig Yang, Weidi Xie, Andrew Zisserman
2022ECCVPromptDet: Towards Open-Vocabulary Detection Using Uncurated Images.Chengjian Feng, Yujie Zhong, Zequn Jie, Xiangxiang Chu, Haibing Ren, Xiaolin Wei, Weidi Xie, Lin Ma
2022ECCVPrompting Visual-Language Models for Efficient Video Understanding.Chen Ju, Tengda Han, Kunhao Zheng, Ya Zhang, Weidi Xie
2022MICCAITransforming the Interactive Segmentation for Medical Imaging.Wentao Liu, Chaofan Ma, Yuhuan Yang, Weidi Xie, Ya Zhang
2022MICCAIAdaptive 3D Localization of 2D Freehand Ultrasound Brain Images.Pak-Hei Yeung, Moska Aliasi, Monique C. Haak, Weidi Xie, Ana I. L. Namburete
2021BMVCAudio-Visual Synchronisation in the wild.Triantafyllos Afouras, Honglie Chen, Weidi Xie, Arsha Nagrani, Andrea Vedaldi, Andrew Zisserman
2021BMVCSegmenting Invisible Moving Objects.Hala Lamdouar, Weidi Xie, Andrew Zisserman
2021CVPRLocalizing Visual Sounds the Hard Way.Honglie Chen, Weidi Xie, Triantafyllos Afouras, Arsha Nagrani, Andrea Vedaldi, Andrew Zisserman
2021ICCVSelf-supervised Video Object Segmentation by Motion Grouping.Charig Yang, Hala Lamdouar, Erika Lu, Andrew Zisserman, Weidi Xie
2021MICCAISli2Vol: Annotate a 3D Volume from a Single Slice with Self-supervised Learning.Pak-Hei Yeung, Ana I. L. Namburete, Weidi Xie
2020ACCVBetrayed by Motion: Camouflaged Object Discovery via Motion Segmentation.Hala Lamdouar, Charig Yang, Weidi Xie, Andrew Zisserman
2020BMVCInducing Predictive Uncertainty Estimation for Face Verification.Weidi Xie, Jeffrey Byrne, Andrew Zisserman
2020CVPRMAST: A Memory-Augmented Self-Supervised Tracker.Zihang Lai, Erika Lu, Weidi Xie
2020ECCVSmooth-AP: Smoothing the Path Towards Large-Scale Image Retrieval.Andrew Brown, Weidi Xie, Vicky Kalogeiton, Andrew Zisserman
2020ECCVMemory-Augmented Dense Predictive Coding for Video Representation Learning.Tengda Han, Weidi Xie, Andrew Zisserman
2020ICASSPVggsound: A Large-Scale Audio-Visual Dataset.Honglie Chen, Weidi Xie, Andrea Vedaldi, Andrew Zisserman
2019BMVCAutoCorrect: Deep Inductive Alignment of Noisy Geometric Annotations.Honglie Chen, Weidi Xie, Andrea Vedaldi, Andrew Zisserman
2019BMVCSelf-supervised Video Representation Learning for Correspondence Flow.Zihang Lai, Weidi Xie
2019BMVCGeometry-Aware Video Object Detection for Static Cameras.Dan Xu, Weidi Xie, Andrew Zisserman
2019ICASSPUtterance-level Aggregation for Speaker Recognition in the Wild.Weidi Xie, Arsha Nagrani, Joon Son Chung, Andrew Zisserman
2018ACCVClass-Agnostic Counting.Erika Lu, Weidi Xie, Andrew Zisserman
2018BMVCMulticolumn Networks for Face Recognition.Weidi Xie, Andrew Zisserman
2018ECCVComparator Networks.Weidi Xie, Li Shen, Andrew Zisserman
2018MICCAICan Dilated Convolutions Capture Ultrasound Video Dynamics?Mohammad Ali Maraci, Weidi Xie, J. Alison Noble
2017MICCAIFreehand Ultrasound Image Simulation with Spatially-Conditioned Generative Adversarial Networks.Yipeng Hu, Eli Gibson, Li-Lin Lee, Weidi Xie, Dean C. Barratt, Tom Vercauteren, J. Alison Noble
2017MICCAIRobust Regression of Brain Maturation from 3D Fetal Neurosonography Using CRNs.Ana I. L. Namburete, Weidi Xie, J. Alison Noble