| 2024 | Part-Aware Prompt Tuning for Weakly Supervised Referring Expression Grounding. | Chenlin Zhao, Jiabo Ye, Yaguang Song, Ming Yan, Xiaoshan Yang, Changsheng Xu |
| 2024 | High Capacity Reversible Data Hiding in Encrypted Images Based on Pixel Value Preprocessing and Block Classification. | Tao Zhang, Ju Zhang, Yicheng Zou, Yu Zhang |
| 2024 | TNT-Net: Point Cloud Completion by Transformer in Transformer. | Xiaohai Zhang, Jinming Zhang, Jianliang Li, Ming Chen |
| 2024 | GDTNet: A Synergistic Dilated Transformer and CNN by Gate Attention for Abdominal Multi-organ Segmentation. | Can Zhang, Zhiqiang Wang, Yuan Zhang, Xuanya Li, Kai Hu |
| 2024 | SEAS-Net: Segment Exchange Augmentation for Semi-supervised Brain Tumor Segmentation. | Jing Zhang, Wei Wu |
| 2024 | Self-distillation Enhanced Vertical Wavelet Spatial Attention for Person Re-identification. | Yuxuan Zhang, Huibin Tan, Long Lan, Xiao Teng, Jing Ren, Yongjun Zhang |
| 2024 | MoCap-Video Data Retrieval with Deep Cross-Modal Learning. | Lu Zhang, Jingliang Peng, Na Lv |
| 2024 | DPM-Det: Diffusion Model Object Detection Based on DPM-Solver++ Guided Sampling. | Jingzhi Zhang, Xudong Li, Linghui Sun, Chengjie Bai |
| 2024 | ASF-Conformer: Audio Scoring Conformer with FFC for Speaker Verification in Noisy Environments. | Xiran Zhang, Haiyan Liu, Caixia Liu, Haiyang Zhang, Zhiwei Huo |
| 2024 | A Region Based Non-overlapping Reference Speech Estimation Method for Speaker Extraction. | Yiru Zhang, Zeke Li, Bijing Liu, Haiwei Fan, Yong Yang, Qun Yang |
| 2024 | A Custom GAN-Based Robust Algorithm for Medical Image Watermarking. | Kun Zhang, Chunling Gao, Shuangyuan Yang |
| 2024 | "Car or Bus?" CLearSeg: CLIP-Enhanced Discrimination Among Resembling Classes for Few-Shot Semantic Segmentation. | Anqi Zhang, Guangyu Gao, Zhuocheng Lv, Yukun An |
| 2024 | MAVAR-SE: Multi-scale Audio-Visual Association Representation Network for End-to-End Speaker Extraction. | Shilong Yu, Chenhui Yang |
| 2024 | Towards Cross-Modal Point Cloud Retrieval for Indoor Scenes. | Fuyang Yu, Zhen Wang, Dongyuan Li, Peide Zhu, Xiaohui Liang, Xiaochuan Wang, Manabu Okumura |
| 2024 | Foreground Feature Enhancement and Peak & Background Suppression for Fine-Grained Visual Classification. | Die Yu, Zhaoyan Fang, Yong Jiang |
| 2024 | Bi-directional Interaction and Dense Aggregation Network for RGB-D Salient Object Detection. | Kang Yi, Haoran Tang, Hongyu Bai, Yinjie Wang, Jing Xu, Ping Li |
| 2024 | RDC-YOLOv5: Improved Safety Helmet Detection in Adverse Weather. | Dexu Yao, Aimin Li, Deqi Liu, Mengfan Cheng |
| 2024 | LRATNet: Local-Relationship-Aware Transformer Network for Table Structure Recognition. | Guangjie Yang, Dajian Zhong, Yu-Jie Xiong, Hongjian Zhan |
| 2024 | TICondition: Expanding Control Capabilities for Text-to-Image Generation with Multi-Modal Conditions. | Yuhang Yang, Xiao Yan, Sanyuan Zhang |
| 2024 | Learning Collaborative Reinforcement Attention for 3D Face Reconstruction and Dense Alignment. | Zhengwei Yang, Yange Wang, Lei Ma, Xiangzheng Li |
| 2024 | Appearance-Motion Dual-Stream Heterogeneous Network for VideoQA. | Feifei Xu, Zheng Zhong, Yitao Zhu, Yingchen Zhou, Guangzhen Li |
| 2024 | A Coarse and Fine Grained Masking Approach for Video-Grounded Dialogue. | Feifei Xu, Wang Zhou, Tao Sun, Jiahao Lu, Ziheng Yu, Guangzhen Li |
| 2024 | Fractional-Order Image Moments and Applications. | Liyun Xu, Min Zhang |
| 2024 | DatAR: Supporting Neuroscience Literature Exploration by Finding Relations Between Topics in Augmented Reality. | Boyu Xu, Ghazaleh Tanhaei, Lynda Hardman, Wolfgang Hrst |
| 2024 | Cross-Modal Hash Retrieval with Category Semantics. | Mengying Xu, Hanjiang Lai, Jian Yin |