Weidi Xie
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
87
Venues
13
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
87 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Versatile Vision-Language Model for 3D Computed Tomography. | Jiayu Lei, Ziqing Fan, Yanyong Zhang, Weidi Xie, Ya Zhang, Yanfeng Wang |
| 2025 | AAAI | Grounded Multi-Hop VideoQA in Long-Form Egocentric Videos. | Qirui Chen, Shangzhe Di, Weidi Xie |
| 2025 | CBMI | ELIP: Enhanced Visual-Language Foundation Models for Image Retrieval. | Guanqi Zhan, Yuanpei Liu, Kai Han, Weidi Xie, Andrew Zisserman |
| 2025 | CVPR | LamRA: Large Multimodal Model as Your Advanced Retrieval Assistant. | Yikun Liu, Yajie Zhang, Jiayin Cai, Xiaolong Jiang, Yao Hu, Jiangchao Yao, Yanfeng Wang, Weidi Xie |
| 2025 | CVPR | Towards Universal Soccer Video Understanding. | Jiayuan Rao, Haoning Wu, Hao Jiang, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2025 | CVPR | Enhancing Video-LLM Reasoning via Agent-of-Thoughts Distillation. | Yudi Shi, Shangzhe Di, Qirui Chen, Weidi Xie |
| 2025 | ICCV | Object-Centric Video Question Answering with Visual Grounding and Referring. | Haochen Wang, Qirui Chen, Cilin Yan, Jiayin Cai, Xiaolong Jiang, Yao Hu, Weidi Xie, Stratis Gavves |
| 2025 | ICCV | MRGen: Segmentation Data Engine for Underrepresented MRI Modalities. | Haoning Wu, Ziheng Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2025 | ICCV | Shot-by-Shot: Film-Grammar-Aware Training-Free Audio Description Generation. | Junyu Xie, Tengda Han, Max Bain, Arsha Nagrani, Eshika Khandelwal, Gl Varol, Weidi Xie, Andrew Zisserman |
| 2025 | ICCV | Learning Streaming Video Representation via Multitask Training. | Yibin Yan, Jilan Xu, Shangzhe Di, Yikun Liu, Yudi Shi, Qirui Chen, Zeqian Li, Yifei Huang, Weidi Xie |
| 2025 | ICLR | Track-On: Transformer-based Online Point Tracking with Memory. | Grkay Aydemir, Xiongyi Cai, Weidi Xie, Fatma Gney |
| 2025 | ICLR | Modeling Fine-Grained Hand-Object Dynamics for Egocentric Video Representation Learning. | Baoqi Pei, Yifei Huang, Jilan Xu, Guo Chen, Yuping He, Lijin Yang, Yali Wang, Weidi Xie, Yu Qiao, Fei Wu, Limin Wang |
| 2025 | ICLR | EgoExo-Gen: Ego-centric Video Prediction by Watching Exo-centric Videos. | Jilan Xu, Yifei Huang, Baoqi Pei, Junlin Hou, Qingqiu Li, Guo Chen, Yuejie Zhang, Rui Feng, Weidi Xie |
| 2025 | ICLR | A Sanity Check for AI-generated Image Detection. | Shilin Yan, Ouxiang Li, Jiayin Cai, Yanbin Hao, Xiaolong Jiang, Yao Hu, Weidi Xie |
| 2025 | MICCAI | M | Jinghao Feng, Qiaoyu Zheng, Chaoyi Wu, Ziheng Zhao, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2025 | MICCAI | RadIR: A Scalable Framework for Multi-grained Medical Image Retrieval via Radiology Report Mining. | Tengfei Zhang, Ziheng Zhao, Chaoyi Wu, Xiao Zhou, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2024 | ACCV | AutoAD-Zero: A Training-Free Framework for Zero-Shot Audio Description. | Junyu Xie, Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman |
| 2024 | ACCV | Moving Object Segmentation: All You Need is SAM (and Flow). | Junyu Xie, Charig Yang, Weidi Xie, Andrew Zisserman |
| 2024 | CVPR | Grounded Question-Answering in Long Egocentric Videos. | Shangzhe Di, Weidi Xie |
| 2024 | CVPR | InstaGen: Enhancing Object Detection by Training on Synthetic Dataset. | Chengjian Feng, Yujie Zhong, Zequn Jie, Weidi Xie, Lin Ma |
| 2024 | CVPR | AutoAD III: The Prequel - Back to the Pixels. | Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman |
| 2024 | CVPR | Intelligent Grimm - Open-ended Visual Storytelling via Latent Diffusion Models. | Chang Liu, Haoning Wu, Yujie Zhong, Xiaoyun Zhang, Yanfeng Wang, Weidi Xie |
| 2024 | CVPR | Retrieval-Augmented Egocentric Video Captioning. | Jilan Xu, Yifei Huang, Junlin Hou, Guo Chen, Yuejie Zhang, Rui Feng, Weidi Xie |
| 2024 | CVPR | Amodal Ground Truth and Completion in the Wild. | Guanqi Zhan, Chuanxia Zheng, Weidi Xie, Andrew Zisserman |
| 2024 | ECCV | Multi-sentence Grounding for Long-Term Instructional Video. | Zeqian Li, Qirui Chen, Tengda Han, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2024 | ECCV | Appearance-Based Refinement for Object-Centric Motion Segmentation. | Junyu Xie, Weidi Xie, Andrew Zisserman |
| 2024 | ECCV | Made to Order: Discovering Monotonic Temporal Changes via Self-supervised Video Ordering. | Charig Yang, Weidi Xie, Andrew Zisserman |
| 2024 | ECCV | VISA: Reasoning Video Object Segmentation via Large Language Models. | Cilin Yan, Haochen Wang, Shilin Yan, Xiaolong Jiang, Yao Hu, Guoliang Kang, Weidi Xie, Efstratios Gavves |
| 2024 | ECCV | Knowledge-Enhanced Visual-Language Pretraining for Computational Pathology. | Xiao Zhou, Xiaoman Zhang, Chaoyi Wu, Ya Zhang, Weidi Xie, Yanfeng Wang |
| 2024 | EMNLP | MatchTime: Towards Automatic Soccer Game Commentary Generation. | Jiayuan Rao, Haoning Wu, Chang Liu, Yanfeng Wang, Weidi Xie |
| 2024 | EMNLP | EchoSight: Advancing Visual-Language Models with Wiki Knowledge. | Yibin Yan, Weidi Xie |
| 2024 | EMNLP | RaTEScore: A Metric for Radiology Report Generation. | Weike Zhao, Chaoyi Wu, Xiaoman Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2024 | ICASSP | Synchformer: Efficient Synchronization From Sparse Cues. | Vladimir Iashin, Weidi Xie, Esa Rahtu, Andrew Zisserman |
| 2024 | WACV | Annotation-free Audio-Visual Segmentation. | Jinxiang Liu, Yu Wang, Chen Ju, Chaofan Ma, Ya Zhang, Weidi Xie |
| 2023 | BMVC | Zero-shot Composed Text-Image Retrieval. | Yikun Liu, Jiangchao Yao, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2023 | BMVC | Boost Video Frame Interpolation via Motion Adaptation. | Haoning Wu, Xiaoyun Zhang, Weidi Xie, Ya Zhang, Yanfeng Wang |
| 2023 | CVPR | OvarNet: Towards Open-Vocabulary Object Attribute Recognition. | Keyan Chen, Xiaolong Jiang, Yao Hu, Xu Tang, Yan Gao, Jianqi Chen, Weidi Xie |
| 2023 | CVPR | AutoAD: Movie Description in Context. | Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman |
| 2023 | CVPR | Collaboration Helps Camera Overtake LiDAR in 3D Detection. | Yue Hu, Yifan Lu, Runsheng Xu, Weidi Xie, Siheng Chen, Yanfeng Wang |
| 2023 | CVPR | Zero-shot Unsupervised Transfer Instance Segmentation. | Gyungin Shin, Samuel Albanie, Weidi Xie |
| 2023 | CVPR | NamedMask: Distilling Segmenters from Complementary Foundation Models. | Gyungin Shin, Weidi Xie, Samuel Albanie |
| 2023 | CVPR | Learning Open-Vocabulary Semantic Segmentation Models From Natural Language Supervision. | Jilan Xu, Junlin Hou, Yuejie Zhang, Rui Feng, Yi Wang, Yu Qiao, Weidi Xie |
| 2023 | CVPR | Cali-NCE: Boosting Cross-modal Video Representation Learning with Calibrated Alignment. | Nanxuan Zhao, Jianbo Jiao, Weidi Xie, Dahua Lin |
| 2023 | ICCV | AutoAD II: The Sequel - Who, When, and What in Movie Audio Description. | Tengda Han, Max Bain, Arsha Nagrani, Gl Varol, Weidi Xie, Andrew Zisserman |
| 2023 | ICCV | The Making and Breaking of Camouflage. | Hala Lamdouar, Weidi Xie, Andrew Zisserman |
| 2023 | ICCV | Open-vocabulary Object Segmentation with Diffusion Models. | Ziyi Li, Qinye Zhou, Xiaoyun Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2023 | ICCV | Towards Open-Vocabulary Video Instance Segmentation. | Haochen Wang, Xiaolong Jiang, Xu Tang, Yao Hu, Cilin Yan, Weidi Xie, Shuai Wang, Efstratios Gavves |
| 2023 | ICCV | MedKLIP: Medical Knowledge Enhanced Language-Image Pre-Training for X-ray Diagnosis. | Chaoyi Wu, Xiaoman Zhang, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2023 | ICCV | Joint-Relation Transformer for Multi-Person Motion Prediction. | Qingyao Xu, Weibo Mao, Jingze Gong, Chenxin Xu, Siheng Chen, Weidi Xie, Ya Zhang, Yanfeng Wang |
| 2023 | ICML | Multi-Modal Classifiers for Open-Vocabulary Object Detection. | Prannay Kaul, Weidi Xie, Andrew Zisserman |
| 2023 | MICCAI | PMC-CLIP: Contrastive Language-Image Pre-training Using Biomedical Documents. | Weixiong Lin, Ziheng Zhao, Xiaoman Zhang, Chaoyi Wu, Ya Zhang, Yanfeng Wang, Weidi Xie |
| 2022 | BMVC | Turbo Training with Token Dropout. | Tengda Han, Weidi Xie, Andrew Zisserman |
| 2022 | BMVC | Sparse in Space and Time: Audio-visual Synchronisation with Trainable Selectors. | Vladimir Iashin, Weidi Xie, Esa Rahtu, Andrew Zisserman |
| 2022 | BMVC | CounTR: Transformer-based Generalised Visual Counting. | Chang Liu, Yujie Zhong, Andrew Zisserman, Weidi Xie |
| 2022 | BMVC | Open-vocabulary Semantic Segmentation with Frozen Vision-Language Models. | Chaofan Ma, Yuhuan Yang, Yanfeng Wang, Ya Zhang, Weidi Xie |
| 2022 | BMVC | A Tri-Layer Plugin to Improve Occluded Detection. | Guanqi Zhan, Weidi Xie, Andrew Zisserman |
| 2022 | BMVC | K-Space Transformer for Undersampled MRI Reconstruction. | Ziheng Zhao, Tianjiao Zhang, Weidi Xie, Yanfeng Wang, Ya Zhang |
| 2022 | BMVC | A Simple Plugin for Transforming Images to Arbitrary Scales. | Qinye Zhou, Ziyi Li, Weidi Xie, Xiaoyun Zhang, Yanfeng Wang, Ya Zhang |
| 2022 | CVPR | Temporal Alignment Networks for Long-term Video. | Tengda Han, Weidi Xie, Andrew Zisserman |
| 2022 | CVPR | Label, Verify, Correct: A Simple Few Shot Object Detection Method. | Prannay Kaul, Weidi Xie, Andrew Zisserman |
| 2022 | CVPR | Unsupervised Salient Object Detection with Spectral Cluster Voting. | Gyungin Shin, Samuel Albanie, Weidi Xie |
| 2022 | CVPR | It's About Time: Analog Clock Reading in the Wild. | Charig Yang, Weidi Xie, Andrew Zisserman |
| 2022 | ECCV | PromptDet: Towards Open-Vocabulary Detection Using Uncurated Images. | Chengjian Feng, Yujie Zhong, Zequn Jie, Xiangxiang Chu, Haibing Ren, Xiaolin Wei, Weidi Xie, Lin Ma |
| 2022 | ECCV | Prompting Visual-Language Models for Efficient Video Understanding. | Chen Ju, Tengda Han, Kunhao Zheng, Ya Zhang, Weidi Xie |
| 2022 | MICCAI | Transforming the Interactive Segmentation for Medical Imaging. | Wentao Liu, Chaofan Ma, Yuhuan Yang, Weidi Xie, Ya Zhang |
| 2022 | MICCAI | Adaptive 3D Localization of 2D Freehand Ultrasound Brain Images. | Pak-Hei Yeung, Moska Aliasi, Monique C. Haak, Weidi Xie, Ana I. L. Namburete |
| 2021 | BMVC | Audio-Visual Synchronisation in the wild. | Triantafyllos Afouras, Honglie Chen, Weidi Xie, Arsha Nagrani, Andrea Vedaldi, Andrew Zisserman |
| 2021 | BMVC | Segmenting Invisible Moving Objects. | Hala Lamdouar, Weidi Xie, Andrew Zisserman |
| 2021 | CVPR | Localizing Visual Sounds the Hard Way. | Honglie Chen, Weidi Xie, Triantafyllos Afouras, Arsha Nagrani, Andrea Vedaldi, Andrew Zisserman |
| 2021 | ICCV | Self-supervised Video Object Segmentation by Motion Grouping. | Charig Yang, Hala Lamdouar, Erika Lu, Andrew Zisserman, Weidi Xie |
| 2021 | MICCAI | Sli2Vol: Annotate a 3D Volume from a Single Slice with Self-supervised Learning. | Pak-Hei Yeung, Ana I. L. Namburete, Weidi Xie |
| 2020 | ACCV | Betrayed by Motion: Camouflaged Object Discovery via Motion Segmentation. | Hala Lamdouar, Charig Yang, Weidi Xie, Andrew Zisserman |
| 2020 | BMVC | Inducing Predictive Uncertainty Estimation for Face Verification. | Weidi Xie, Jeffrey Byrne, Andrew Zisserman |
| 2020 | CVPR | MAST: A Memory-Augmented Self-Supervised Tracker. | Zihang Lai, Erika Lu, Weidi Xie |
| 2020 | ECCV | Smooth-AP: Smoothing the Path Towards Large-Scale Image Retrieval. | Andrew Brown, Weidi Xie, Vicky Kalogeiton, Andrew Zisserman |
| 2020 | ECCV | Memory-Augmented Dense Predictive Coding for Video Representation Learning. | Tengda Han, Weidi Xie, Andrew Zisserman |
| 2020 | ICASSP | Vggsound: A Large-Scale Audio-Visual Dataset. | Honglie Chen, Weidi Xie, Andrea Vedaldi, Andrew Zisserman |
| 2019 | BMVC | AutoCorrect: Deep Inductive Alignment of Noisy Geometric Annotations. | Honglie Chen, Weidi Xie, Andrea Vedaldi, Andrew Zisserman |
| 2019 | BMVC | Self-supervised Video Representation Learning for Correspondence Flow. | Zihang Lai, Weidi Xie |
| 2019 | BMVC | Geometry-Aware Video Object Detection for Static Cameras. | Dan Xu, Weidi Xie, Andrew Zisserman |
| 2019 | ICASSP | Utterance-level Aggregation for Speaker Recognition in the Wild. | Weidi Xie, Arsha Nagrani, Joon Son Chung, Andrew Zisserman |
| 2018 | ACCV | Class-Agnostic Counting. | Erika Lu, Weidi Xie, Andrew Zisserman |
| 2018 | BMVC | Multicolumn Networks for Face Recognition. | Weidi Xie, Andrew Zisserman |
| 2018 | ECCV | Comparator Networks. | Weidi Xie, Li Shen, Andrew Zisserman |
| 2018 | MICCAI | Can Dilated Convolutions Capture Ultrasound Video Dynamics? | Mohammad Ali Maraci, Weidi Xie, J. Alison Noble |
| 2017 | MICCAI | Freehand Ultrasound Image Simulation with Spatially-Conditioned Generative Adversarial Networks. | Yipeng Hu, Eli Gibson, Li-Lin Lee, Weidi Xie, Dean C. Barratt, Tom Vercauteren, J. Alison Noble |
| 2017 | MICCAI | Robust Regression of Brain Maturation from 3D Fetal Neurosonography Using CRNs. | Ana I. L. Namburete, Weidi Xie, J. Alison Noble |