Xiang Bai
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
192
Venues
28
Active years
2007–2026
Best venue rank
A*
Where they publish
- A*CVPR50 papers
- A*ECCV31 papers
- AICDAR25 papers
- A*ICCV22 papers
- A*AAAI15 papers
- BICPR9 papers
- BICIP6 papers
- A*ACL4 papers
- BACCV3 papers
- A*SIGGRAPH2 papers
- A*EMNLP2 papers
- A*ICML2 papers
- AWACV2 papers
- BDAS2 papers
- A*IJCAI2 papers
- NationalICIG2 papers
- CPSIVT2 papers
- A*ICLR1 paper
- AMICCAI1 paper
- A*SIGIR1 paper
- MulticonferenceICASSP1 paper
- A*ICDM1 paper
- ABMVC1 paper
- CICARCV1 paper
- AICDCS1 paper
- A*INFOCOM1 paper
- NationalISVC1 paper
- BPRICAI1 paper
Papers
192 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | StreamKV: Streaming Video Question-Answering with Segment-based KV Cache Retrieval and Compression. | Yilong Chen, Xiang Bai, Zhibin Wang, Chengyu Bai, Yuhan Dai, Ming Lu |
| 2026 | AAAI | Cook and Clean Together: Teaching Embodied Agents for Parallel Task Execution. | Dingkang Liang, Cheng Zhang, Xiaopeng Xu, Jianzhong Ju, Zhenbo Luo, Xiang Bai |
| 2026 | AAAI | AutoLink: Autonomous Schema Exploration and Expansion for Scalable Schema Linking in Text-to-SQL at Scale. | Ziyang Wang, Yuanlei Zheng, Zhenbiao Cao, Xiaojin Zhang, Zhongyu Wei, Pei Fu, Zhenbo Luo, Wei Chen, Xiang Bai |
| 2026 | AAAI | OwlCap: Harmonizing Motion-Detail for Video Captioning via HMD-270K and Caption Set Equivalence Reward. | Chunlin Zhong, Qiuxia Hou, Zhangjun Zhou, Yanhao Zhang, Shuang Hao, Haonan Lu, He Tang, Xiang Bai |
| 2026 | ACL | I2E: From Image Pixels to Actionable Interactive Environments for Text-Guided Image Editing. | Jinghan Yu, Junhao Xiao, Chenyu Zhu, Jiaming Li, Jia Li, HanMing Deng, Xirui Wang, Guoli Jia, Jianjun Li, Xiang Bai, Bowen Zhou, Zhiyuan Ma |
| 2026 | ACL | Doc-V^*: Coarse-to-Fine Interactive Visual Reasoning for Multi-Page Document VQA. | Yuanlei Zheng, Pei Fu, Hang Li, Ziyang Wang, Yuyi Zhang, Wenyu Ruan, Xiaojin Zhang, Zhongyu Wei, Zhenbo Luo, Jian Luan, Wei Chen, Xiang Bai |
| 2026 | SIGGRAPH | R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow: R-DMesh. | Zijie Wu, Lixin Xu, Puhua Jiang, Sicong Liu, Chunchao Guo, Xiang Bai |
| 2025 | ACL | MTVQA: Benchmarking Multilingual Text-Centric Visual Question Answering. | Jingqun Tang, Qi Liu, Yongjie Ye, Jinghui Lu, Shu Wei, An-Lan Wang, Chunhui Lin, Hao Feng, Zhen Zhao, Yanjie Wang, Yuliang Liu, Hao Liu, Xiang Bai, Can Huang |
| 2025 | CVPR | A Unified Image-Dense Annotation Generation Model for Underwater Scenes. | Hongkai Lin, Dingkang Liang, Zhenghao Qi, Xiang Bai |
| 2025 | CVPR | SemiETS: Integrating Spatial and Content Consistencies for Semi-Supervised End-to-end Text Spotting. | Dongliang Luo, Hanshen Zhu, Ziyang Zhang, Dingkang Liang, Xudong Xie, Yuliang Liu, Xiang Bai |
| 2025 | CVPR | MINIMA: Modality Invariant Image Matching. | Jiangwei Ren, Xingyu Jiang, Zizhuo Li, Dingkang Liang, Xin Zhou, Xiang Bai |
| 2025 | EMNLP | Theorem-Validated Reverse Chain-of-Thought Problem Generation for Geometric Reasoning. | Linger Deng, Linghao Zhu, Yuliang Liu, Yu Wang, Qunyi Xie, Jingjing Wu, Gang Zhang, Yingying Zhu, Xiang Bai |
| 2025 | EMNLP | WildDoc: How Far Are We from Achieving Comprehensive and Robust Document Understanding in the Wild? | An-Lan Wang, Jingqun Tang, Lei Liao, Hao Feng, Qi Liu, Xiang Fei, Jinghui Lu, Han Wang, Hao Liu, Yuliang Liu, Xiang Bai, Can Huang |
| 2025 | ICCV | Recammaster: Camera-Controlled Generative Rendering From a Single Video. | Jianhong Bai, Menghan Xia, Xiao Fu, Xintao Wang, Lianrui Mu, Jinwen Cao, Zuozhu Liu, Haoji Hu, Xiang Bai, Pengfei Wan, Di Zhang |
| 2025 | ICCV | LLaVA-KD: A Framework of Distilling Multimodal Large Language Models. | Yuxuan Cai, Jiangning Zhang, Haoyang He, Xinwei He, Ao Tong, Zhenye Gan, Chengjie Wang, Zhucun Xue, Yong Liu, Xiang Bai |
| 2025 | ICCV | Orion: A Holistic End-To-End Autonomous Driving Framework by Vision-Language Instructed Action Generation. | Haoyu Fu, Diankun Zhang, Zongchuang Zhao, Jianfeng Cui, Dingkang Liang, Chong Zhang, Dingyuan Zhang, Hongwei Xie, Bing Wang, Xiang Bai |
| 2025 | ICCV | Multi-Scenario Overlapping Text Segmentation with Depth Awareness. | Yang Liu, Xudong Xie, Yuliang Liu, Xiang Bai |
| 2025 | ICCV | LIRA: Inferring Segmentation in Large Multi-Modal Models with Local Interleaved Region Assistance. | Zhang Li, Biao Yang, Qiang Liu, Shuo Zhang, Zhiyin Ma, Liang Yin, Linger Deng, Yabo Sun, Yuliang Liu, Xiang Bai |
| 2025 | ICCV | Describe, Adapt and Combine: Empowering CLIP Encoders for Open-Set 3D Object Retrieval. | Zhichuan Wang, Yang Zhou, Zhe Liu, Rui Yu, Song Bai, Yulong Wang, Xinwei He, Xiang Bai |
| 2025 | ICCV | AnimateAnyMesh: A Feed-Forward 4D Foundation Model for Text-Driven Universal Mesh Animation. | Zijie Wu, Chaohui Yu, Fan Wang, Xiang Bai |
| 2025 | ICCV | DocThinker: Explainable Multimodal Large Language Models with Rule-Based Reinforcement Learning for Document Understanding. | Wenwen Yu, Zhibo Yang, Yuliang Liu, Xiang Bai |
| 2025 | ICCV | Towards Comprehensive Lecture Slides Understanding: Large-Scale Dataset and Effective Method. | Enming Zhang, Yuzhe Li, Yuliang Liu, Yingying Zhu, Xiang Bai |
| 2025 | ICCV | HERMES: A Unified Self-Driving World Model for Simultaneous 3D Scene Understanding and Generation. | Xin Zhou, Dingkang Liang, Sifan Tu, Xiwu Chen, Yikang Ding, Dingyuan Zhang, Feiyang Tan, Hengshuang Zhao, Xiang Bai |
| 2025 | ICCV | Training-Free Geometric Image Editing on Diffusion Models. | Hanshen Zhu, Zhen Zhu, Kaile Zhang, Yiming Gong, Yuliang Liu, Xiang Bai |
| 2025 | ICLR | Mini-Monkey: Alleviating the Semantic Sawtooth Effect for Lightweight MLLMs via Complementary Image Pyramid. | Mingxin Huang, Yuliang Liu, Dingkang Liang, Lianwen Jin, Xiang Bai |
| 2025 | ICML | VIP: Vision Instructed Pre-training for Robotic Manipulation. | Zhuoling Li, Liangliang Ren, Jinrong Yang, Yong Zhao, Xiaoyang Wu, Zhenhua Xu, Xiang Bai, Hengshuang Zhao |
| 2025 | MICCAI | PathVG: A New Benchmark and Dataset for Pathology Visual Grounding. | Chunlin Zhong, Shuang Hao, Junhua Wu, Xiaona Chang, Jiwei Jiang, Xiu Nie, He Tang, Xiang Bai |
| 2025 | SIGGRAPH | VideoAnydoor: High-fidelity Video Object Insertion with Precise Motion Control. | Yuanpeng Tu, Hao Luo, Xi Chen, Sihui Ji, Xiang Bai, Hengshuang Zhao |
| 2025 | SIGIR | CLIP-AdaM: Adapting Multi-view CLIP for Open-set 3D Object Retrieval. | Xinwei He, Liang Ma, Yuxuan Cheng, Zhichuan Wang, Yulong Wang, Yang Zhou, Xiang Bai |
| 2024 | ACL | Deciphering Oracle Bone Language with Diffusion Models. | Haisu Guan, Huanxin Yang, Xinyu Wang, Shengwei Han, Yongge Liu, Lianwen Jin, Xiang Bai, Yuliang Liu |
| 2024 | CVPR | Bridging the Gap Between End-to-End and Two-Step Text Spotting. | Mingxin Huang, Hongliang Li, Yuliang Liu, Xiang Bai, Lianwen Jin |
| 2024 | CVPR | Monkey: Image Resolution and Text Label are Important Things for Large Multi-Modal Models. | Zhang Li, Biao Yang, Qiang Liu, Zhiyin Ma, Shuo Zhang, Jingxu Yang, Yabo Sun, Yuliang Liu, Xiang Bai |
| 2024 | CVPR | OMNIPARSER: A Unified Framework for Text Spotting, Key Information Extraction and Table Recognition. | Jianqiang Wan, Sibo Song, Wenwen Yu, Yuliang Liu, Wenqing Cheng, Fei Huang, Xiang Bai, Cong Yao, Zhibo Yang |
| 2024 | CVPR | General Object Foundation Model for Images and Videos at Scale. | Junfeng Wu, Yi Jiang, Qihao Liu, Zehuan Yuan, Xiang Bai, Song Bai |
| 2024 | CVPR | Dynamic Adapter Meets Prompt Tuning: Parameter-Efficient Transfer Learning for Point Cloud Analysis. | Xin Zhou, Dingkang Liang, Wei Xu, Xingkui Zhu, Yihan Xu, Zhikang Zou, Xiang Bai |
| 2024 | ECCV | Well Begun is Half Done: The Importance of Initialization in Dataset Distillation. | Yiran Guan, Zhu Chen, Xingkui Zhu, Dingkang Liang, Yuliang Liu, Xiang Bai |
| 2024 | ECCV | OPEN: Object-Wise Position Embedding for Multi-view 3D Object Detection. | Jinghua Hou, Tong Wang, Xiaoqing Ye, Zhe Liu, Shi Gong, Xiao Tan, Errui Ding, Jingdong Wang, Xiang Bai |
| 2024 | ECCV | SEED: A Simple and Effective 3D DETR in Point Clouds. | Zhe Liu, Jinghua Hou, Xiaoqing Ye, Tong Wang, Jingdong Wang, Xiang Bai |
| 2024 | ECCV | PartGLEE: A Foundation Model for Recognizing and Parsing Any Objects. | Junyi Li, Junfeng Wu, Weizhi Zhao, Song Bai, Xiang Bai |
| 2024 | ECCV | SC4D: Sparse-Controlled Video-to-4D Generation and Motion Transfer. | Zijie Wu, Chaohui Yu, Yanqin Jiang, Chenjie Cao, Fan Wang, Xiang Bai |
| 2024 | ECCV | WAS: Dataset and Methods for Artistic Text Segmentation. | Xudong Xie, Yuzhe Li, Yang Liu, Zhifei Zhang, Zhaowen Wang, Wei Xiong, Xiang Bai |
| 2024 | ECCV | Make Your ViT-Based Multi-view 3D Detectors Faster via Token Compression. | Dingyuan Zhang, Dingkang Liang, Zichang Tan, Xiaoqing Ye, Cheng Zhang, Jingdong Wang, Xiang Bai |
| 2024 | ECCV | PSALM: Pixelwise SegmentAtion with Large Multi-modal Model. | Zheng Zhang, Yeyao Ma, Enming Zhang, Xiang Bai |
| 2024 | ICASSP | Maskstr: Guide Scene Text Recognition Models with Masking. | Baole Wei, Minghang He, Liangcai Gao, Duoyou Zhou, Xiang Bai, Zhi Tang |
| 2024 | ICDAR | Progressive Evolution from Single-Point to Polygon for Scene Text. | Linger Deng, Mingxin Huang, Xudong Xie, Yuliang Liu, Lianwen Jin, Xiang Bai |
| 2024 | ICDAR | The First Swahili Language Scene Text Detection and Recognition Dataset. | Fadila Wendigoundi Douamba, Jianjun Song, Ling Fu, Yuliang Liu, Xiang Bai |
| 2024 | ICDAR | Knowledge Mining of Scene Text for Referring Expression Comprehension. | Chenyang Gao, Biao Yang, Wenwen Yu, Yuliang Liu, Xiang Bai |
| 2024 | ICDAR | Dataset and Benchmark for Urdu Natural Scenes Text Detection, Recognition and Visual Question Answering. | Hiba Maryam, Ling Fu, Jiajun Song, Tajrian ABM Shafayet, Qidi Luo, Xiang Bai, Yuliang Liu |
| 2024 | ICDAR | Puzzle Pieces Picker: Deciphering Ancient Chinese Characters with Radical Reconstruction. | Pengjie Wang, Kaile Zhang, Xinyu Wang, Shengwei Han, Yongge Liu, Lianwen Jin, Xiang Bai, Yuliang Liu |
| 2024 | ICDAR | Exploring the Capabilities of Large Multimodal Models on Dense Text. | Shuo Zhang, Biao Yang, Zhang Li, Zhiyin Ma, Yuliang Liu, Xiang Bai |
| 2023 | AAAI | StereoDistill: Pick the Cream from LiDAR for Distilling Stereo-Based 3D Object Detection. | Zhe Liu, Xiaoqing Ye, Xiao Tan, Errui Ding, Xiang Bai |
| 2023 | CVPR | SOOD: Towards Semi-Supervised Oriented Object Detection. | Wei Hua, Dingkang Liang, Jingyu Li, Xiaolong Liu, Zhikang Zou, Xiaoqing Ye, Xiang Bai |
| 2023 | CVPR | CrowdCLIP: Unsupervised Crowd Counting via Vision-Language Model. | Dingkang Liang, Jiahao Xie, Zhikang Zou, Xiaoqing Ye, Wei Xu, Xiang Bai |
| 2023 | CVPR | InstMove: Instance Motion for Object-centric Video Segmentation. | Qihao Liu, Junfeng Wu, Yi Jiang, Xiang Bai, Alan L. Yuille, Song Bai |
| 2023 | CVPR | CAPE: Camera View Position Embedding for Multi-View 3D Object Detection. | Kaixin Xiong, Shi Gong, Xiaoqing Ye, Xiao Tan, Ji Wan, Errui Ding, Jingdong Wang, Xiang Bai |
| 2023 | CVPR | Side Adapter Network for Open-Vocabulary Semantic Segmentation. | Mengde Xu, Zheng Zhang, Fangyun Wei, Han Hu, Xiang Bai |
| 2023 | CVPR | Modeling Entities as Semantic Points for Visual Information Extraction in the Wild. | Zhibo Yang, Rujiao Long, Pengfei Wang, Sibo Song, Humen Zhong, Wenqing Cheng, Xiang Bai, Cong Yao |
| 2023 | CVPR | Turning a CLIP Model into a Scene Text Detector. | Wenwen Yu, Yuliang Liu, Wei Hua, Deqiang Jiang, Bo Ren, Xiang Bai |
| 2023 | ICCV | ESTextSpotter: Towards Better Scene Text Spotting with Explicit Synergy in Transformer. | Mingxin Huang, Jiaxin Zhang, Dezhi Peng, Hao Lu, Can Huang, Yuliang Liu, Xiang Bai, Lianwen Jin |
| 2023 | ICCV | A Simple Vision Transformer for Weakly Semi-supervised 3D Object Detection. | Dingyuan Zhang, Dingkang Liang, Zhikang Zou, Jingyu Li, Xiaoqing Ye, Zhe Liu, Xiao Tan, Xiang Bai |
| 2023 | ICDAR | ICDAR 2023 Competition on Recognition of Multi-line Handwritten Mathematical Expressions. | Chenyang Gao, Yuliang Liu, Shiyu Yao, Jinfeng Bai, Xiang Bai, Lianwen Jin, Cheng-Lin Liu |
| 2023 | ICDAR | TextREC: A Dataset for Referring Expression Comprehension with Reading Comprehension. | Chenyang Gao, Biao Yang, Hao Wang, Mingkun Yang, Wenwen Yu, Yuliang Liu, Xiang Bai |
| 2023 | ICDAR | Visual Information Extraction in the Wild: Practical Dataset and End-to-End Solution. | Jianfeng Kuang, Wei Hua, Dingkang Liang, Mingkun Yang, Deqiang Jiang, Bo Ren, Xiang Bai |
| 2023 | ICDAR | Semantic Graph Representation Learning for Handwritten Mathematical Expression Recognition. | Zhuang Liu, Ye Yuan, Zhilong Ji, Jinfeng Bai, Xiang Bai |
| 2023 | ICDAR | ICDAR 2023 Competition on Detecting Tampered Text in Images. | Dongliang Luo, Yu Zhou, Rui Yang, Yuliang Liu, Xianjin Liu, Jishen Zeng, Enming Zhang, Biao Yang, Ziming Huang, Lianwen Jin, Xiang Bai |
| 2023 | ICDAR | ICDAR 2023 Competition on Video Text Reading for Dense and Small Text. | Weijia Wu, Yuzhong Zhao, Zhuang Li, Jiahong Li, Mike Zheng Shou, Umapada Pal, Dimosthenis Karatzas, Xiang Bai |
| 2023 | ICDAR | ICDAR 2023 Competition on Born Digital Video Text Question Answering. | Zhibo Yang, Xiaoge Song, Sibo Song, Tong Lu, Xiang Bai, Cheng-Lin Liu, Fei Huang, Cong Yao |
| 2023 | ICDAR | ICDAR 2023 Competition on Reading the Seal Title. | Wenwen Yu, Mingyu Liu, Mingrui Chen, Ning Lu, Yinlong Wen, Yuliang Liu, Dimosthenis Karatzas, Xiang Bai |
| 2023 | ICDAR | ICDAR 2023 Competition on Structured Text Extraction from Visually-Rich Document Images. | Wenwen Yu, Chengquan Zhang, Haoyu Cao, Wei Hua, Bohan Li, Huang Chen, Mingyu Liu, Mingrui Chen, Jianfeng Kuang, Mengjun Cheng, Yuning Du, Shikun Feng, Xiaoguang Hu, Pengyuan Lyu, Kun Yao, Yuechen Yu, Yuliang Liu, Wanxiang Che, Errui Ding, Cheng-Lin Liu, Jiebo Luo, Shuicheng Yan, Min Zhang, Dimosthenis Karatzas, Xing Sun, Jingdong Wang, Xiang Bai |
| 2022 | CVPR | An Empirical Study of End-to-End Temporal Action Detection. | Xiaolong Liu, Song Bai, Xiang Bai |
| 2022 | CVPR | Vision-Language Pre-Training for Boosting Scene Text Detectors. | Sibo Song, Jianqiang Wan, Zhibo Yang, Jun Tang, Wenqing Cheng, Xiang Bai, Cong Yao |
| 2022 | CVPR | Few Could Be Better Than All: Feature Sampling and Grouping for Scene Text Detection. | Jingqun Tang, Wenqing Zhang, Hongye Liu, Mingkun Yang, Bo Jiang, Guanglong Hu, Xiang Bai |
| 2022 | CVPR | Knowledge Mining with Scene Text for Fine-Grained Recognition. | Hao Wang, Junchao Liao, Tianheng Cheng, Zewen Gao, Hao Liu, Bo Ren, Xiang Bai, Wenyu Liu |
| 2022 | CVPR | Syntax-Aware Network for Handwritten Mathematical Expression Recognition. | Ye Yuan, Xiao Liu, Wondimu Dikubab, Hui Liu, Zhilong Ji, Zhongqin Wu, Xiang Bai |
| 2022 | ECCV | GitNet: Geometric Prior-Based Transformation for Birds-Eye-View Segmentation. | Shi Gong, Xiaoqing Ye, Xiao Tan, Jingdong Wang, Errui Ding, Yu Zhou, Xiang Bai |
| 2022 | ECCV | An End-to-End Transformer Model for Crowd Localization. | Dingkang Liang, Wei Xu, Xiang Bai |
| 2022 | ECCV | When Counting Meets HMER: Counting-Aware Network for Handwritten Mathematical Expression Recognition. | Bohan Li, Ye Yuan, Dingkang Liang, Xiao Liu, Zhilong Ji, Jinfeng Bai, Wenyu Liu, Xiang Bai |
| 2022 | ECCV | Optimal Boxes: Boosting End-to-End Scene Text Recognition by Adjusting Annotated Bounding Boxes via Reinforcement Learning. | Jingqun Tang, Wenming Qian, Luchuan Song, Xiena Dong, Lan Li, Xiang Bai |
| 2022 | ECCV | SeqFormer: Sequential Transformer for Video Instance Segmentation. | Junfeng Wu, Yi Jiang, Song Bai, Wenqing Zhang, Xiang Bai |
| 2022 | ECCV | In Defense of Online Models for Video Instance Segmentation. | Junfeng Wu, Qihao Liu, Yi Jiang, Song Bai, Alan L. Yuille, Xiang Bai |
| 2022 | ECCV | CCPL: Contrastive Coherence Preserving Loss for Versatile Style Transfer. | Zijie Wu, Zhen Zhu, Junping Du, Xiang Bai |
| 2022 | ECCV | Toward Understanding WordArt: Corner-Guided Transformer for Scene Text Recognition. | Xudong Xie, Ling Fu, Zhifei Zhang, Zhaowen Wang, Xiang Bai |
| 2022 | ECCV | A Simple Baseline for Open-Vocabulary Semantic Segmentation with Pre-trained Vision-Language Model. | Mengde Xu, Zheng Zhang, Fangyun Wei, Yutong Lin, Yue Cao, Han Hu, Xiang Bai |
| 2022 | ICDM | Origin-Destination Traffic Prediction based on Hybrid Spatio-Temporal Network. | Tingyang Chen, Lugang Nie, Jiwei Pan, Lai Tu, Bolong Zheng, Xiang Bai |
| 2021 | AAAI | FaceController: Controllable Attribute Editing for Face in the Wild. | Zhiliang Xu, Xiyu Yu, Zhibin Hong, Zhen Zhu, Junyu Han, Jingtuo Liu, Errui Ding, Xiang Bai |
| 2021 | CVPR | MOST: A Multi-Oriented Scene Text Detector With Localization Refinement. | Minghang He, Minghui Liao, Zhibo Yang, Humen Zhong, Jun Tang, Wenqing Cheng, Cong Yao, Yongpan Wang, Xiang Bai |
| 2021 | CVPR | Multi-Shot Temporal Event Localization: A Benchmark. | Xiaolong Liu, Yao Hu, Song Bai, Fei Ding, Xiang Bai, Philip H. S. Torr |
| 2021 | CVPR | Scene Text Retrieval via Joint Text Detection and Similarity Learning. | Hao Wang, Xiang Bai, Mingkun Yang, Shenggao Zhu, Jing Wang, Wenyu Liu |
| 2021 | CVPR | Improving OCR-Based Image Captioning by Incorporating Geometrical Relationship. | Jing Wang, Jinhui Tang, Mingkun Yang, Xiang Bai, Jiebo Luo |
| 2021 | ICCV | End-to-End Semi-Supervised Object Detection with Soft Teacher. | Mengde Xu, Zheng Zhang, Han Hu, Jianfeng Wang, Lijuan Wang, Fangyun Wei, Xiang Bai, Zicheng Liu |
| 2021 | ICDAR | Scene Text Detection with Scribble Line. | Wenqing Zhang, Yang Qiu, Minghui Liao, Rui Zhang, Xiaolin Wei, Xiang Bai |
| 2021 | WACV | WDNet: Watermark-Decomposition Network for Visible Watermark Removal. | Yang Liu, Zhen Zhu, Xiang Bai |
| 2020 | AAAI | Real-Time Scene Text Detection with Differentiable Binarization. | Minghui Liao, Zhaoyi Wan, Cong Yao, Kai Chen, Xiang Bai |
| 2020 | AAAI | TANet: Robust 3D Object Detection from Point Clouds with Triple Attention. | Zhe Liu, Xin Zhao, Tengteng Huang, Ruolan Hu, Yu Zhou, Xiang Bai |
| 2020 | AAAI | All You Need Is Boundary: Toward Arbitrary-Shaped Text Spotting. | Hao Wang, Pu Lu, Hui Zhang, Mingkun Yang, Xiang Bai, Yongchao Xu, Mengchao He, Yongpan Wang, Wenyu Liu |
| 2020 | AAAI | TextScanner: Reading Characters in Order for Robust Scene Text Recognition. | Zhaoyi Wan, Minghang He, Haoran Chen, Xiang Bai, Cong Yao |
| 2020 | CVPR | Super-BPD: Super Boundary-to-Pixel Direction for Fast Image Segmentation. | Jianqiang Wan, Yang Liu, Donglai Wei, Xiang Bai, Yongchao Xu |
| 2020 | CVPR | Semantically Multi-Modal Image Synthesis. | Zhen Zhu, Zhiliang Xu, Ansheng You, Xiang Bai |
| 2020 | DAS | Maximum Entropy Regularization and Chinese Text Recognition. | Changxu Cheng, Wuheng Xu, Xiang Bai, Bin Feng, Wenyu Liu |
| 2020 | ECCV | VisDrone-CC2020: The Vision Meets Drone Crowd Counting Challenge Results. | Dawei Du, Longyin Wen, Pengfei Zhu, Heng Fan, Qinghua Hu, Haibin Ling, Mubarak Shah, Junwen Pan, Ali Al-Ali, Amr Mohamed, Bakour Imene, Bin Dong, Binyu Zhang, Bouchali Hadia Nesma, Chenfeng Xu, Chenzhen Duan, Ciro Castiello, Corrado Mencar, Dingkang Liang, Florian Krger, Gennaro Vessio, Giovanna Castellano, Jieru Wang, Junyu Gao, Khalid Abualsaud, Laihui Ding, Lei Zhao, Marco Cianciotta, Muhammad Saqib, Noor Almaadeed, Omar Elharrouss, Pei Lyu, Qi Wang, Shidong Liu, Shuang Qiu, Siyang Pan, Somaya Al-Madeed, Sultan Daud Khan, Tamer Khattab, Tao Han, Thomas Golda, Wei Xu, Xiang Bai, Xiaoqing Xu, Xuelong Li, Yanyun Zhao, Ye Tian, Yingnan Lin, Yongchao Xu, Yuehan Yao, Zhenyu Xu, Zhijian Zhao, Zhipeng Luo, Zhiwei Wei, Zhiyuan Zhao |
| 2020 | ECCV | EPNet: Enhancing Point Features with Image Semantics for 3D Object Detection. | Tengteng Huang, Zhe Liu, Xiwu Chen, Xiang Bai |
| 2020 | ECCV | Mask TextSpotter v3: Segmentation Proposal Network for Robust Scene Text Spotting. | Minghui Liao, Guan Pang, Jing Huang, Tal Hassner, Xiang Bai |
| 2020 | ECCV | Scene Text Image Super-Resolution in the Wild. | Wenjia Wang, Enze Xie, Xuebo Liu, Wenhai Wang, Ding Liang, Chunhua Shen, Xiang Bai |
| 2020 | ECCV | Intra-class Feature Variation Distillation for Semantic Segmentation. | Yukang Wang, Wei Zhou, Tao Jiang, Xiang Bai, Yongchao Xu |
| 2020 | ECCV | AutoSTR: Efficient Backbone Search for Scene Text Recognition. | Hui Zhang, Quanming Yao, Mingkun Yang, Yongchao Xu, Xiang Bai |
| 2020 | ICPR | Cost-Effective Adversarial Attacks against Scene Text Recognition. | Mingkun Yang, Haitian Zheng, Xiang Bai, Jiebo Luo |
| 2019 | AAAI | Human-Like Delicate Region Erasing Strategy for Weakly Supervised Detection. | Qing En, Lijuan Duan, Zhaoxiang Zhang, Xiang Bai, Yundong Zhang |
| 2019 | AAAI | Scene Text Recognition from Two-Dimensional Perspective. | Minghui Liao, Jian Zhang, Zhaoyi Wan, Fengming Xie, Jiajun Liang, Pengyuan Lyu, Cong Yao, Xiang Bai |
| 2019 | CVPR | DeepFlux for Skeletons in the Wild. | Yukang Wang, Yongchao Xu, Stavros Tsogkas, Xiang Bai, Sven J. Dickinson, Kaleem Siddiqi |
| 2019 | CVPR | iSAID: A Large-scale Dataset for Instance Segmentation in Aerial Images. | Syed Waqas Zamir, Aditya Arora, Akshita Gupta, Salman H. Khan, Guolei Sun, Fahad Shahbaz Khan, Fan Zhu, Ling Shao, Gui-Song Xia, Xiang Bai |
| 2019 | CVPR | Progressive Pose Attention Transfer for Person Image Generation. | Zhen Zhu, Tengteng Huang, Baoguang Shi, Miao Yu, Bofei Wang, Xiang Bai |
| 2019 | ICCV | View N-Gram Network for 3D Object Retrieval. | Xinwei He, Tengteng Huang, Song Bai, Xiang Bai |
| 2019 | ICCV | Learn to Scale: Generating Multipolar Normalized Density Maps for Crowd Counting. | Chenfeng Xu, Kai Qiu, Jianlong Fu, Song Bai, Yongchao Xu, Xiang Bai |
| 2019 | ICCV | Symmetry-Constrained Rectification Network for Scene Text Recognition. | Mingkun Yang, Yushuo Guan, Minghui Liao, Xin He, Kaigui Bian, Song Bai, Cong Yao, Xiang Bai |
| 2019 | ICCV | Asymmetric Non-Local Neural Networks for Semantic Segmentation. | Zhen Zhu, Mengdu Xu, Song Bai, Tengteng Huang, Xiang Bai |
| 2019 | ICDAR | Patch Aggregator for Scene Text Script Identification. | Changxu Cheng, Qiuhui Huang, Xiang Bai, Bin Feng, Wenyu Liu |
| 2019 | ICDAR | ICDAR2019 Competition on Scanned Receipt OCR and Information Extraction. | Zheng Huang, Kai Chen, Jianhua He, Xiang Bai, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar |
| 2019 | ICDAR | Multiple Comparative Attention Network for Offline Handwritten Chinese Character Recognition. | Qingquan Xu, Xiang Bai, Wenyu Liu |
| 2019 | ICDAR | ICDAR 2019 Robust Reading Challenge on Reading Chinese Text on Signboard. | Rui Zhang, Mingkun Yang, Xiang Bai, Baoguang Shi, Dimosthenis Karatzas, Shijian Lu, C. V. Jawahar, Yongsheng Zhou, Qianyi Jiang, Qi Song, Nan Li, Kai Zhou, Lei Wang, Dong Wang, Minghui Liao |
| 2018 | CVPR | Triplet-Center Loss for Multi-View 3D Object Retrieval. | Xinwei He, Yang Zhou, Zhichao Zhou, Song Bai, Xiang Bai |
| 2018 | CVPR | Rotation-Sensitive Regression for Oriented Scene Text Detection. | Minghui Liao, Zhen Zhu, Baoguang Shi, Gui-Song Xia, Xiang Bai |
| 2018 | CVPR | Multi-Oriented Scene Text Detection via Corner Localization and Region Segmentation. | Pengyuan Lyu, Cong Yao, Wenhao Wu, Shuicheng Yan, Xiang Bai |
| 2018 | CVPR | DOTA: A Large-Scale Dataset for Object Detection in Aerial Images. | Gui-Song Xia, Xiang Bai, Jian Ding, Zhen Zhu, Serge J. Belongie, Jiebo Luo, Mihai Datcu, Marcello Pelillo, Liangpei Zhang |
| 2018 | DAS | Feature Fusion for Scene Text Detection. | Zhen Zhu, Minghui Liao, Baoguang Shi, Xiang Bai |
| 2018 | ECCV | Mask TextSpotter: An End-to-End Trainable Neural Network for Spotting Text with Arbitrary Shapes. | Pengyuan Lyu, Minghui Liao, Cong Yao, Wenhao Wu, Xiang Bai |
| 2018 | ECCV | Adaptively Transforming Graph Matching. | Fudong Wang, Nan Xue, Yipeng Zhang, Xiang Bai, Gui-Song Xia |
| 2018 | ECCV | Hard-Aware Point-to-Set Deep Metric for Person Re-identification. | Rui Yu, Zhiyong Dou, Song Bai, Zhaoxiang Zhang, Yongchao Xu, Xiang Bai |
| 2018 | ICPR | ICPR2018 Contest on Object Detection in Aerial Images (ODAI-18). | Jian Ding, Zhen Zhu, Gui-Song Xia, Xiang Bai, Serge J. Belongie, Jiebo Luo, Mihai Datcu, Marcello Pelillo, Liangpei Zhang |
| 2018 | IJCAI | Cascaded SR-GAN for Scale-Adaptive Low Resolution Person Re-identification. | Zheng Wang, Mang Ye, Fan Yang, Xiang Bai, Shin'ichi Satoh |
| 2018 | ICPR | Learning Training Samples for Occlusion Edge Detection and Its Application in Depth Ordering Inference. | Yu Zhou, Jianxiang Ma, Anlong Ming, Xiang Bai |
| 2017 | AAAI | Multidimensional Scaling on Multiple Input Distance Matrices. | Song Bai, Xiang Bai, Longin Jan Latecki, Qi Tian |
| 2017 | AAAI | Regularized Diffusion Process for Visual Retrieval. | Song Bai, Xiang Bai, Qi Tian, Longin Jan Latecki |
| 2017 | AAAI | TextBoxes: A Fast Text Detector with a Single Deep Neural Network. | Minghui Liao, Baoguang Shi, Xiang Bai, Xinggang Wang, Wenyu Liu |
| 2017 | BMVC | Divide and Fuse: A Re-ranking Approach for Person Re-identification. | Rui Yu, Zhichao Zhou, Song Bai, Xiang Bai |
| 2017 | CVPR | Scalable Person Re-identification on Supervised Smoothed Manifold. | Song Bai, Xiang Bai, Qi Tian |
| 2017 | CVPR | Richer Convolutional Features for Edge Detection. | Yun Liu, Ming-Ming Cheng, Xiaowei Hu, Kai Wang, Xiang Bai |
| 2017 | CVPR | Detecting Oriented Text in Natural Images by Linking Segments. | Baoguang Shi, Xiang Bai, Serge J. Belongie |
| 2017 | CVPR | Multiple Instance Detection Network with Online Instance Classifier Refinement. | Peng Tang, Xinggang Wang, Xiang Bai, Wenyu Liu |
| 2017 | ICCV | Ensemble Diffusion for Retrieval. | Song Bai, Zhichao Zhou, Jingdong Wang, Xiang Bai, Longin Jan Latecki, Qi Tian |
| 2017 | ICDAR | Auto-Encoder Guided GAN for Chinese Calligraphy Synthesis. | Pengyuan Lyu, Xiang Bai, Cong Yao, Zhen Zhu, Tengteng Huang, Wenyu Liu |
| 2017 | ICDAR | ICDAR2017 Competition on Reading Chinese Text in the Wild (RCTW-17). | Baoguang Shi, Cong Yao, Minghui Liao, Mingkun Yang, Pei Xu, Linyan Cui, Serge J. Belongie, Shijian Lu, Xiang Bai |
| 2017 | ICDAR | Max-Pooling Based Scene Text Proposal for Scene Text Detection. | Dinh Nguyen Van, Shijian Lu, Xiang Bai, Nizar Ouarti, Mounir Mokhtari |
| 2017 | ICIG | Joint Classification Loss and Histogram Loss for Sketch-Based Image Retrieval. | Yongluan Yan, Xinggang Wang, Xin Yang, Xiang Bai, Wenyu Liu |
| 2017 | IJCAI | Dynamic Multi-Task Learning with Convolutional Neural Network. | Yuchun Fang, Zhengyan Ma, Zhaoxiang Zhang, Xu-Yao Zhang, Xiang Bai |
| 2016 | CVPR | GIFT: A Real-Time and Scalable 3D Shape Search Engine. | Song Bai, Xiang Bai, Zhichao Zhou, Zhaoxiang Zhang, Longin Jan Latecki |
| 2016 | CVPR | Object Skeleton Extraction in Natural Images by Fusing Scale-Associated Deep Side Outputs. | Wei Shen, Kai Zhao, Yuan Jiang, Yan Wang, Zhijiang Zhang, Xiang Bai |
| 2016 | CVPR | Robust Scene Text Recognition with Automatic Rectification. | Baoguang Shi, Xinggang Wang, Pengyuan Lyu, Cong Yao, Xiang Bai |
| 2016 | CVPR | Multi-oriented Text Detection with Fully Convolutional Networks. | Zheng Zhang, Chengquan Zhang, Wei Shen, Cong Yao, Wenyu Liu, Xiang Bai |
| 2016 | ECCV | Smooth Neighborhood Structure Mining on Multiple Affinity Graphs with Applications to Context-Sensitive Similarity. | Song Bai, Shaoyan Sun, Xiang Bai, Zhaoxiang Zhang, Qi Tian |
| 2016 | ICPR | Distinguishing text/non-text natural images with Multi-Dimensional Recurrent Neural Networks. | Pengyuan Lyu, Baoguang Shi, Chengquan Zhang, Xiang Bai |
| 2016 | ICPR | Scene text script identification with Convolutional Recurrent Neural Networks. | Jieru Mei, Luo Dai, Baoguang Shi, Xiang Bai |
| 2016 | ICPR | Symmetry-based object proposal for text detection. | Xuelei Zhang, Zheng Zhang, Chengquan Zhang, Xiang Bai |
| 2015 | CVPR | DeepContour: A deep convolutional feature learned by positive-sharing loss for contour detection. | Wei Shen, Xinggang Wang, Yan Wang, Xiang Bai, Zhijiang Zhang |
| 2015 | CVPR | Symmetry-based text line detection in natural scenes. | Zheng Zhang, Wei Shen, Cong Yao, Xiang Bai |
| 2015 | ICCV | Relaxed Multiple-Instance SVM with Application to Object Discovery. | Xinggang Wang, Zhuotun Zhu, Cong Yao, Xiang Bai |
| 2015 | ICDAR | Automatic script identification in the wild. | Baoguang Shi, Cong Yao, Chengquan Zhang, Xiaowei Guo, Feiyue Huang, Xiang Bai |
| 2015 | ICDAR | Automatic discrimination of text and non-text natural images. | Chengquan Zhang, Cong Yao, Baoguang Shi, Xiang Bai |
| 2014 | ACCV | Multiple Stage Residual Model for Accurate Image Classification. | Song Bai, Xinggang Wang, Cong Yao, Xiang Bai |
| 2014 | CVPR | Strokelets: A Learned Multi-scale Representation for Scene Text Recognition. | Cong Yao, Xiang Bai, Baoguang Shi, Wenyu Liu |
| 2014 | ECCV | Human Detection Using Learned Part Alphabet and Pose Dictionary. | Cong Yao, Xiang Bai, Wenyu Liu, Longin Jan Latecki |
| 2014 | ICIP | Aggregating contour fragments for shape classification. | Song Bai, Xinggang Wang, Xiang Bai |
| 2014 | ICIP | Real-time object tracking via optimal feature subspace. | Xu Min, Yu Zhou, Shu Liu, Xiang Bai |
| 2014 | WACV | Scale-Space SIFT flow. | Weichao Qiu, Xinggang Wang, Xiang Bai, Alan L. Yuille, Zhuowen Tu |
| 2013 | ICIP | Traffic sign classification using two-layer image representation. | Yingying Zhu, Xinggang Wang, Cong Yao, Xiang Bai |
| 2013 | ICML | Max-Margin Multiple-Instance Dictionary Learning. | Xinggang Wang, Baoyuan Wang, Xiang Bai, Wenyu Liu, Zhuowen Tu |
| 2012 | ACCV | One-Class Multiple Instance Learning via Robust PCA for Common Object Discovery. | Xinggang Wang, Zhengdong Zhang, Yi Ma, Xiang Bai, Wenyu Liu, Zhuowen Tu |
| 2012 | CVPR | Exemplar-based human action pose correction and tagging. | Wei Shen, Ke Deng, Xiang Bai, Tommer Leyvand, Baining Guo, Zhuowen Tu |
| 2012 | CVPR | Fan Shape Model for object detection. | Xinggang Wang, Xiang Bai, Tianyang Ma, Wenyu Liu, Longin Jan Latecki |
| 2012 | CVPR | Detecting texts of arbitrary orientations in natural images. | Cong Yao, Xiang Bai, Wenyu Liu, Yi Ma, Zhuowen Tu |
| 2012 | ICARCV | Color image segmentation using mean shift and improved spectral clustering. | Yang Gui, Xiang Bai, Zheng Li, Yun Yuan |
| 2012 | ICDCS | Skeleton Extraction from Incomplete Boundaries in Sensor Networks Based on Distance Transform. | Wenping Liu, Hongbo Jiang, Xiang Bai, Guang Tan, Chonggang Wang, Wenyu Liu, Kechao Cai |
| 2012 | ICPR | Online Random Ferns for robust visual tracking. | Cong Rao, Cong Yao, Xiang Bai, Weichao Qiu, Wenyu Liu |
| 2012 | ICPR | Adjacent coding for image classification. | Yueming Wang, Xinggang Wang, Shaojun Zhu, Xiang Bai, Wenyu Liu |
| 2011 | CVPR | Feature context for image classification and object detection. | Xinggang Wang, Xiang Bai, Wenyu Liu, Longin Jan Latecki |
| 2011 | ICIG | Shape Matching Using Points Co-occurrence Pattern. | Yu Zhou, Junwei Wang, Quan Zhou, Xiang Bai, Wenyu Liu |
| 2011 | ICIP | Image labeling by multiple segmentation. | Quan Zhou, Canxiang Yan, Yingying Zhu, Xiang Bai, Wenyu Liu |
| 2011 | PSIVT | Shape Matching and Recognition Using Group-Wised Points. | Junwei Wang, Yu Zhou, Xiang Bai, Wenyu Liu |
| 2010 | ECCV | Co-transduction for Shape Retrieval. | Xiang Bai, Bo Wang, Xinggang Wang, Wenyu Liu, Zhuowen Tu |
| 2010 | ECCV | Object Recognition Using Junctions. | Bo Wang, Xiang Bai, Xinggang Wang, Wenyu Liu, Zhuowen Tu |
| 2010 | ICPR | Shape Classification Using Tree -Unions. | Bo Wang, Wei Shen, Wenyu Liu, Xinge You, Xiang Bai |
| 2009 | ACCV | Skeleton Graph Matching Based on Critical Points Using Path Similarity. | Yao Xu, Bo Wang, Wenyu Liu, Xiang Bai |
| 2009 | CVPR | Shape band: A deformable object detection approach. | Xiang Bai, Quannan Li, Longin Jan Latecki, Wenyu Liu, Zhuowen Tu |
| 2009 | ICCV | Active skeleton for non-rigid object detection. | Xiang Bai, Xinggang Wang, Longin Jan Latecki, Wenyu Liu, Zhuowen Tu |
| 2009 | INFOCOM | CASE: Connectivity-Based Skeleton Extraction in Wireless Sensor Networks. | Hongbo Jiang, Wenping Liu, Dan Wang, Chen Tian, Xiang Bai, Xue Liu, Ying Wu, Wenyu Liu |
| 2009 | PSIVT | Contour Grouping with Partial Shape Similarity. | Chengqian Wu, Xiang Bai, Quannan Li, Xingwei Yang, Wenyu Liu |
| 2008 | ECCV | Improving Shape Retrieval by Learning Graph Transduction. | Xingwei Yang, Xiang Bai, Longin Jan Latecki, Zhuowen Tu |
| 2008 | ICIP | Skeletonization of gray-scale image from incomplete boundaries. | Quannan Li, Xiang Bai, Wenyu Liu |
| 2008 | ISVC | Symmetry of Shapes Via Self-similarity. | Xingwei Yang, Nagesh Adluru, Longin Jan Latecki, Xiang Bai, Zygmunt Pizlo |
| 2008 | PRICAI | Computing Stable Skeletons with Particle Filters. | Xiang Bai, Xingwei Yang, Longin Jan Latecki, Yanbo Xu, Wenyu Liu |
| 2007 | CVPR | Visual Curvature. | Hairong Liu, Longin Jan Latecki, Wenyu Liu, Xiang Bai |
| 2007 | ICCV | Contour Grouping Based on Local Symmetry. | Nagesh Adluru, Longin Jan Latecki, Rolf Lakmper, Thomas Young, Xiang Bai, Ari D. Gross |
| 2007 | ICIP | Skeletonization using SSM of the Distance Transform. | Longin Jan Latecki, Quannan Li, Xiang Bai, Wenyu Liu |