| 2024 | Deep Learning for Automated Shark Detection and Biometrics Without Keypoints. | Jaden V. Clark, Chinmay K. Lalgudi, Mark E. Leone, Jayson Meribe, Sergio Madrigal-Mora, Mario Espinoza |
| 2024 | RingID: Rethinking Tree-Ring Watermarking for Enhanced Multi-key Identification. | Hai Ci, Pei Yang, Yiren Song, Mike Zheng Shou |
| 2024 | Comparative Analysis of Synthetic and Real Melanoma Images in AI-Driven Diagnosis. | Alessia Auriemma Citarella, Fabiola De Marco, Luigi Di Biasi, Genoveffa Tortora |
| 2024 | Are CLIP Features All You Need for Universal Synthetic Image Origin Attribution? | Dario Cioni, Christos Tzelepis, Lorenzo Seidenari, Ioannis Patras |
| 2024 | Revisiting Calibration of Wide-Angle Radially Symmetric Cameras. | Andrea Porfiri Dal Cin, Francesco Azzoni, Giacomo Boracchi, Luca Magri |
| 2024 | A Biologically-Inspired Approach to Biomedical Image Segmentation. | Luca Ciampi, Gabriele Lagani, Giuseppe Amato, Fabrizio Falchi |
| 2024 | Understanding Multi-compositional Learning in Vision and Language Models via Category Theory. | Sotirios Panagiotis Chytas, Hyunwoo J. Kim, Vikas Singh |
| 2024 | Towards Natural Language-Guided Drones: GeoText-1652 Benchmark with Spatial Relation Matching. | Meng Chu, Zhedong Zheng, Wei Ji, Tingyu Wang, Tat-Seng Chua |
| 2024 | VisionLLaMA: A Unified LLaMA Backbone for Vision Tasks. | Xiangxiang Chu, Jianlin Su, Bo Zhang, Chunhua Shen |
| 2024 | Facial Expression-Enhanced TTS: Combining Face Representation and Emotion Intensity for Adaptive Speech. | Yunji Chu, Yunseob Shim, Unsang Park |
| 2024 | Deep Diffusion Image Prior for Efficient OOD Adaptation in 3D Inverse Problems. | Hyungjin Chung, Jong Chul Ye |
| 2024 | 6DoF Head Pose Estimation Through Explicit Bidirectional Interaction with Face Geometry. | Sungho Chun, Ju Yong Chang |
| 2024 | Geometry Fidelity for Spherical Images. | Anders Christensen, Nooshin Mojab, Khushman Patel, Karan Ahuja, Zeynep Akata, Ole Winther, Mar Gonzlez-Franco, Andrea Colaco |
| 2024 | Finding Meaning in Points: Weakly Supervised Semantic Segmentation for Event Cameras. | Hoonhee Cho, Sung-Hoon Yoon, Hyeokjun Kweon, Kuk-Jin Yoon |
| 2024 | Personalized Privacy Protection Mask Against Unauthorized Facial Recognition. | Ka-Ho Chow, Sihao Hu, Tiansheng Huang, Ling Liu |
| 2024 | MEERKAT: Audio-Visual Large Language Model for Grounding in Space and Time. | Sanjoy Chowdhury, Sayan Nag, Subhrajyoti Dasgupta, Jun Chen, Mohamed Elhoseiny, Ruohan Gao, Dinesh Manocha |
| 2024 | Video Question Answering with Procedural Programs. | Rohan Choudhury, Koichiro Niinuma, Kris M. Kitani, Lszl A. Jeni |
| 2024 | Embedding Geometries of Contrastive Language-Image Pre-training. | Jason Chuan-Chih Chou, Nahid Alam |
| 2024 | Learning to Enhance Aperture Phasor Field for Non-Line-of-Sight Imaging. | In Cho, Hyunbo Shim, Seon Joo Kim |
| 2024 | Enhanced Controllability of Diffusion Models via Feature Disentanglement and Realism-Enhanced Sampling Methods. | Wonwoong Cho, Hareesh Ravi, Midhun Harikumar, Vinh Khuc, Krishna Kumar Singh, Jingwan Lu, David I. Inouye, Ajinkya Kale |
| 2024 | Non-Line-of-Sight Estimation of Fast Human Motion with Slow Scanning Imagers. | Javier Grau Chopite, Patrick Haehn, Matthias B. Hullin |
| 2024 | Dense Hand-Object (HO) GraspNet with Full Grasping Taxonomy and Dynamics. | Woojin Cho, Jihyun Lee, Minjae Yi, Minje Kim, Taeyun Woo, Donghwan Kim, Taewook Ha, Hyokeun Lee, Je-Hwan Ryu, Woontack Woo, Tae-Kyun Kim |
| 2024 | Temporal Event Stereo via Joint Learning with Stereoscopic Flow. | Hoonhee Cho, Jae-Young Kang, Kuk-Jin Yoon |
| 2024 | Click-Gaussian: Interactive Segmentation to Any 3D Gaussians. | Seokhun Choi, Hyeonseop Song, Jaechul Kim, Taehyeong Kim, Hoseok Do |
| 2024 | Salience-Based Adaptive Masking: Revisiting Token Dynamics for Enhanced Pre-training. | Hyesong Choi, Hyejin Park, Kwang Moo Yi, Sungmin Cha, Dongbo Min |