| 2024 | CoVLM: Leveraging Consensus from Vision-Language Models for Semi-supervised Multi-modal Fake News Detection. | Devank, Jayateja Kalla, Soma Biswas |
| 2024 | Contrastive Max-Correlation for Multi-view Clustering. | Yanghao Deng, Zenghui Wang, Songlin Du |
| 2024 | LoG-VMamba 🐍: Local-Global Vision Mamba for Medical Image Segmentation. | Trung DQ. Dang, Huy Hoang Nguyen, Aleksei Tiulpin |
| 2024 | Leveraging Thermal Imaging for Robust Human Pose Estimation in Low-Light Vision. | Mickael Cormier, Caleb Ng Zhi Yi, Andreas Specker, Benjamin Bla, Michael Heizmann, Jrgen Beyerer |
| 2024 | Enhancing Anchor-Based Weakly Supervised Referring Expression Comprehension with Cross-Modality Attention. | Ting-Yu Chu, Yong-Xiang Lin, Ching-Chun Huang, Kai-Lung Hua |
| 2024 | A Recipe for CAC: Mosaic-Based Generalized Loss for Improved Class-Agnostic Counting. | Tsung-Han Chou, Brian Wang, Wei-Chen Chiu, Jun-Cheng Chen |
| 2024 | CNG-SFDA: Clean-and-Noisy Region Guided Online-Offline Source-Free Domain Adaptation. | Hyeonwoo Cho, Chanmin Park, Dong-Hee Kim, Jinyoung Kim, Won Hwa Kim |
| 2024 | MeshGS: Adaptive Mesh-Aligned Gaussian Splatting for High-Quality Rendering. | Jaehoon Choi, Yonghan Lee, Hyungtae Lee, Heesung Kwon, Dinesh Manocha |
| 2024 | LCM: Log Conformal Maps for Robust Representation Learning to Mitigate Perspective Distortion. | Meenakshi Subhash Chippa, Prakash Chandra Chhipa, Kanjar De, Marcus Liwicki, Rajkumar Saini |
| 2024 | Match-Free Inbetweening Assistant (MIBA): A Practical Animation Tool Without User Stroke Correspondence. | Shuhong Chen, Matthias Zwicker |
| 2024 | Act Like a Radiologist: Radiology Report Generation Across Anatomical Regions. | Qi Chen, Yutong Xie, Biao Wu, Xiaomin Chen, James Ang, Minh-Son To, Xiaojun Chang, Qi Wu |
| 2024 | DepthBLIP-2: Leveraging Language to Guide BLIP-2 in Understanding Depth Information. | Wei Chen, Changyong Shi, Chuanxiang Ma, Wenhao Li, Shulei Dong |
| 2024 | Structure-Centric Robust Monocular Depth Estimation via Knowledge Distillation. | Runze Chen, Haiyong Luo, Fang Zhao, Jingze Yu, Yupeng Jia, Juan Wang, Xuepeng Ma |
| 2024 | MedBLIP: Bootstrapping Language-Image Pretraining from 3D Medical Images and Texts. | Qiuhui Chen, Yi Hong |
| 2024 | BAMG: Text-Based Person Re-identification via Bottlenecks Attention and Masked Graph Modeling. | Keyang Cheng, Wenxuan Zou, Hongjian Gu, Anxiang Ouyang |
| 2024 | Seamless-Through-Breaking: Rethinking Image Stitching for Optimal Alignment. | KuanYan Chen, Atik Garg, Yu-Shuen Wang |
| 2024 | Beyond Coarse-Grained Matching in Video-Text Retrieval. | Aozhu Chen, Hazel Doughty, Xirong Li, Cees G. M. Snoek |
| 2024 | Latency Attack Resilience in Object Detectors: Insights from Computing Architecture. | Erh-Chung Chen, Pin-Yu Chen, I-Hsin Chung, Che-Rung Lee |
| 2024 | TranSPORTmer: A Holistic Approach to Trajectory Understanding in Multi-agent Sports. | Guillem Capellera, Luis Ferraz, Antonio Rubio, Antonio Agudo, Francesc Moreno-Noguer |
| 2024 | PARNet: Aortic Reconstruction from Orthogonal X-Rays Using Pre-trained Generative Adversarial Networks. | Chengwei Cao, Jinhui Zhang, Yueyang Gao, Zheng Li |
| 2024 | HDNeXt: Hybrid Dynamic MedNeXt with Level Set Regularization for Medical Image Segmentation. | Haoyu Cao, Tianyi Han, Yunyun Yang |
| 2024 | CNN Mixture-of-Depths. | Rinor Cakaj, Jens Mehnert, Bin Yang |
| 2024 | Medical Imaging Complexity and Its Effects on GAN Performance. | William Cagas, Chan Ko, Blake Hsiao, Shryuk Grandhi, Rishi Bhattacharya, Kevin Zhu, Michael Lam |
| 2024 | MECFormer: Multi-task Whole Slide Image Classification with Expert Consultation Network. | Doanh C. Bui, Jin Tae Kwak |
| 2024 | InstantGeoAvatar: Effective Geometry and Appearance Modeling of Animatable Avatars from Monocular Video. | Alvaro Budria, Adrin Lpez Rodrguez, scar Lorente, Francesc Moreno-Noguer |