| 2024 | Non-Local Spatial-Wise and Global Channel-Wise Transformer for Efficient Image Super-Resolution. | Xiang Gao, Sining Wu, Fan Wang, Xiaopeng Hu |
| 2024 | Cross-Modal Semantic Alignment Learning for Text-Based Person Search. | Wenjun Gan, Jiawei Liu, Yangchun Zhu, Yong Wu, Guozhi Zhao, Zheng-Jun Zha |
| 2024 | Drive-CLIP: Cross-Modal Contrastive Safety-Critical Driving Scenario Representation Learning and Zero-Shot Driving Risk Analysis. | Wenbin Gan, Minh-Son Dao, Koji Zettsu |
| 2024 | Super-Resolution-Assisted Feature Refined Extraction for Small Objects in Remote Sensing Images. | Lihua Du, Wei Wu, Chen Li |
| 2024 | HPattack: An Effective Adversarial Attack for Human Parsing. | Xin Dong, Rui Wang, Sanyi Zhang, Lihua Jing |
| 2024 | EmoAda: A Multimodal Emotion Interaction and Psychological Adaptation System. | Tengteng Dong, Fangyuan Liu, Xinke Wang, Yishun Jiang, Xiwei Zhang, Xiao Sun |
| 2024 | Improving Small License Plate Detection with Bidirectional Vehicle-Plate Relation. | Songkang Dai, Song-Lu Chen, Qi Liu, Chao Zhu, Yan Liu, Feng Chen, Xu-Cheng Yin |
| 2024 | Lightweight Image Captioning Model Based on Knowledge Distillation. | Zhenlei Cui, Zhenhua Tang, Jianze Li, Kai Chen |
| 2024 | CESegNet:Context-Enhancement Semantic Segmentation Network Based on Transformer. | Xu Chen, Zhibin Zhang |
| 2024 | Fourier Transformer for Joint Super-Resolution and Reconstruction of MR Image. | Jiacheng Chen, Fei Wu, Wanliang Wang, Haoxin Sheng |
| 2024 | Hierarchical Supervised Contrastive Learning for Multimodal Sentiment Analysis. | Kezhou Chen, Shuo Wang, Yanbin Hao |
| 2024 | Semantic Transition Detection for Self-supervised Video Scene Segmentation. | Lu Chen, Jiawei Tan, Pingan Yang, Hongxing Wang |
| 2024 | A Lightweight Local Attention Network for Image Super-Resolution. | Feng Chen, Xin Song, Liang Zhu |
| 2024 | C3-PO: A Convolutional Neural Network for COVID Onset Prediction from Cough Sounds. | Xiangyu Chen, Md Ayshik Rahman Khan, Md. Rakibul Hasan, Tom Gedeon, Md. Zakir Hossain |
| 2024 | Global-to-Local Feature Mining Network for RGB-Infrared Person Re-Identification. | Qiang Chen, Fuxiao He, Guoqiang Xiao |
| 2024 | Exploring Imperceptible Adversarial Examples in YC | Pei Chen, Zhiyong Feng, Meng Xing, Yiming Zhang, Jinqing Zheng |
| 2024 | Where Are Biases? Adversarial Debiasing with Spurious Feature Visualization. | Chi-Yu Chen, Pu Ching, Pei-Hsin Huang, Min-Chun Tien |
| 2024 | Gait Recognition Based on Temporal Gait Information Enhancing. | Qizhen Chen, Xin Chen, Xiaoling Deng, Yubin Lan |
| 2024 | The Rach3 Dataset: Towards Data-Driven Analysis of Piano Performance Rehearsal. | Carlos Eduardo Cancino-Chacn, Ivan Pilkov |
| 2024 | Quality Scalable Video Coding Based on Neural Representation. | Qian Cao, Dongdong Zhang, Chengyu Sun |
| 2024 | MVD-NeRF: Resolving Shape-Radiance Ambiguity via Mitigating View Dependency. | Yangjie Cao, Bo Wang, Zhenqiang Li, Jie Li |
| 2024 | MC-TCMNER: A Multi-modal Fusion Model Combining Contrast Learning Method for Traditional Chinese Medicine NER. | Shan Cao, Qingfeng Wu |
| 2024 | Deep Self-supervised Subspace Clustering with Triple Loss. | Xiaotong Bu, Jiwen Dong, Mengjiao Zhang, Guang Feng, Xizhan Gao, Sijie Niu |
| 2024 | Find the Cliffhanger: Multi-modal Trailerness in Soap Operas. | Carlo Bretti, Pascal Mettes, Hendrik Vincent Koops, Daan Odijk, Nanne van Noord |
| 2024 | A Multidimensional Taxonomy Model for Music Tangible User Interfaces. | Adriano Barat, Luca Andrea Ludovico |