| 2024 | Character-Aware Audio-Visual Subtitling in Context. | Jaesung Huh, Andrew Zisserman |
| 2024 | OneDiff: A Generalist Model for Image Difference Captioning. | Erdong Hu, Longteng Guo, Tongtian Yue, Zijia Zhao, Shuning Xue, Jing Liu |
| 2024 | Generalizable Structure-Aware INF: Biplanar-View CT Reconstruction via Disentangled Implicit Neural Field. | Bei Huang, Yuru Pei |
| 2024 | High-Quality Visually-Guided Sound Separation from Diverse Categories. | Chao Huang, Susan Liang, Yapeng Tian, Anurag Kumar, Chenliang Xu |
| 2024 | Hi-NeRF: Hybridizing 2D Inpainting with Neural Radiance Fields for 3D Scene Inpainting. | Xianliang Huang, Shuhang Chen, Zhizhou Zhong, Jiajie Gou, Jihong Guan, Shuigeng Zhou |
| 2024 | Towards Robust Video Frame Interpolation with Long-Term Propagation. | Ziqi Huang, Kelvin C. K. Chan, Bihan Wen, Ziwei Liu |
| 2024 | Enhancing 3D Human Pose Estimation with Bone Length Adjustment. | Chih-Hsiang Hsu, Jyh-Shing Roger Jang |
| 2024 | Mitigating Backdoor Attacks Using Activation-Guided Model Editing. | Felix Hsieh, Huy H. Nguyen, AprilPyone MaungMaung, Dmitrii Usynin, Isao Echizen |
| 2024 | ADSP: Advanced Dataset for Shadow Processing, Enabling Visible Occluders via Synthesizing Strategy. | Chang-Yu Hsieh, Jian-Jiun Ding |
| 2024 | RSSep: Sequence-to-Sequence Model for Simultaneous Referring Remote Sensing Segmentation and Detection. | Ngoc-Vuong Ho, Thinh Phan, Meredith Adkins, Chase Rainwater, Jackson David Cothren, Ngan Le |
| 2024 | Revisiting Sample Weights Based Method for Noisy-Label Detection and Classification. | Tuan Hoang, Hung Tran, Santu Rana, Sunil Gupta, Svetha Venkatesh |
| 2024 | BiEfficient: Bidirectionally Prompting Vision-Language Models for Parameter-Efficient Video Recognition. | Haichen He, Weibin Liu, Weiwei Xing |
| 2024 | Graph Cut-Guided Maximal Coding Rate Reduction for Learning Image Embedding and Clustering. | Wei He, Zhiyuan Huang, Xianghan Meng, Xianbiao Qi, Rong Xiao, Chun-Guang Li |
| 2024 | Calibration Transfer via Knowledge Distillation. | Ramya Hebbalaguppe, Mayank Baranwal, Kartik Anand, Chetan Arora |
| 2024 | Greit-HRNet: Grouped Lightweight High-Resolution Network for Human Pose Estimation. | Junjia Han, Yanxia Wang |
| 2024 | SRIL: Selective Regularization for Class-Incremental Learning. | Jisu Han, Jaemin Na, Wonjun Hwang |
| 2024 | Analysis of Adapter in Attention of Change Detection Vision Transformer. | Ryunosuke Hamada, Tsubasa Minematsu, Cheng Tang, Atsushi Shimada |
| 2024 | Physically Interpretable Probabilistic Domain Characterization. | Anas Halin, Sbastien Pirard, Renaud Vandeghen, Benot Grin, Maxime Zanella, Martin Colot, Jan Held, Anthony Cioppa, Emmanuel Jean, Gianluca Bontempi, Sad Mahmoudi, Benot Macq, Marc Van Droogenbroeck |
| 2024 | Randomized Channel-Pass Mask for Channel-Wise Explanation of Black-Box Models. | Hirotaka Hachiya, Daiki Nisawa |
| 2024 | ELLAR: An Action Recognition Dataset for Extremely Low-Light Conditions with Dual Gamma Adaptive Modulation. | Minse Ha, Wan-Gi Bae, Geunyoung Bae, Jong Taek Lee |
| 2024 | Conditional Distribution Modelling for Few-Shot Image Synthesis with Diffusion Models. | Parul Gupta, Munawar Hayat, Abhinav Dhall, Thanh-Toan Do |
| 2024 | PMTrack: Multi-object Tracking with Motion-Aware. | Xu Guo, Yujin Zheng, Dingwen Wang |
| 2024 | Tracking Reflected Objects: A Benchmark. | Xiaoyu Guo, Pengzhi Zhong, Lizhi Lin, Hao Zhang, Ling Huang, Shuiwang Li |
| 2024 | Relative Pose from Cylinder Silhouettes. | Anna Gummeson, Magnus Oskarsson |
| 2024 | Telling Stories for Common Sense Zero-Shot Action Recognition. | Shreyank N. Gowda, Laura Sevilla-Lara |