| 2024 | FG-Net: Facial Action Unit Detection with Generalizable Pyramidal Features. | Yufeng Yin, Di Chang, Guoxian Song, Shen Sang, Tiancheng Zhi, Jing Liu, Linjie Luo, Mohammad Soleymani |
| 2024 | Data-Centric Debugging: mitigating model failures via targeted image retrieval. | Sahil Singla, Atoosa Malemir Chegini, Mazda Moayeri, Soheil Feizi |
| 2024 | Spatio-temporal Filter Analysis Improves 3D-CNN For Action Classification. | Takumi Kobayashi, Jiaxing Ye |
| 2024 | MixtureGrowth: Growing Neural Networks by Recombining Learned Parameters. | Chau Pham, Piotr Teterwak, Soren Nelson, Bryan A. Plummer |
| 2024 | Diff2Lip: Audio Conditioned Diffusion Models for Lip-Synchronization. | Soumik Mukhopadhyay, Saksham Suri, Ravi Teja Gadde, Abhinav Shrivastava |
| 2024 | Wakening Past Concepts without Past Data: Class-Incremental Learning from Online Placebos. | Yaoyao Liu, Yingying Li, Bernt Schiele, Qianru Sun |
| 2024 | PGVT: Pose-Guided Video Transformer for Fine-Grained Action Recognition. | Haosong Zhang, Mei Chee Leong, Liyuan Li, Weisi Lin |
| 2024 | Elusive Images: Beyond Coarse Analysis for Fine-Grained Recognition. | Connor Anderson, Matthew Gwilliam, Evelyn Gaskin, Ryan Farrell |
| 2024 | LensNeRF: Rethinking Volume Rendering based on Thin-Lens Camera Model. | Min-Jung Kim, Gyojung Gu, Jaegul Choo |
| 2024 | Second-Order Graph ODEs for Multi-Agent Trajectory Forecasting. | Song Wen, Hao Wang, Di Liu, Qilong Zhangli, Dimitris N. Metaxas |
| 2023 | Gait Recognition Using 3-D Human Body Shape Inference. | Haidong Zhu, Zhaoheng Zheng, Ram Nevatia |
| 2023 | Adaptive Local-Component-aware Graph Convolutional Network for One-shot Skeleton-based Action Recognition. | Anqi Zhu, Qiuhong Ke, Mingming Gong, James Bailey |
| 2023 | MonoEdge: Monocular 3D Object Detection Using Local Perspectives. | Minghan Zhu, Lingting Ge, Panqu Wang, Huei Peng |
| 2023 | X-NeRF: Explicit Neural Radiance Field for Multi-Scene 360 | Haoyi Zhu |
| 2023 | SeCo: Separating Unknown Musical Visual Sounds with Consistency Guidance. | Xinchi Zhou, Dongzhan Zhou, Wanli Ouyang, Hang Zhou, Di Hu |
| 2023 | Exploiting Visual Context Semantics for Sound Source Localization. | Xinchi Zhou, Dongzhan Zhou, Di Hu, Hang Zhou, Wanli Ouyang |
| 2023 | Temporal Feature Enhancement Dilated Convolution Network for Weakly-supervised Temporal Action Localization. | Jianxiong Zhou, Ying Wu |
| 2023 | SCTS: Instance Segmentation of Single Cells Using a Transformer-Based Semantic-Aware Model and Space-Filling Augmentation. | Yating Zhou, Wenjing Li, Ge Yang |
| 2023 | DSFormer: A Dual-domain Self-supervised Transformer for Accelerated Multi-contrast MRI Reconstruction. | Bo Zhou, Neel Dey, Jo Schlemper, Seyed Sadegh Mohseni Salehi, Chi Liu, James S. Duncan, Michal Sofka |
| 2023 | Anticipative Feature Fusion Transformer for Multi-Modal Action Anticipation. | Zeyun Zhong, David Schneider, Michael Voit, Rainer Stiefelhagen, Jrgen Beyerer |
| 2023 | Combining Photogrammetric Computer Vision and Semantic Segmentation for Fine-grained Understanding of Coral Reef Growth under Climate Change. | Jiageng Zhong, Ming Li, Hanqi Zhang, Jiangying Qin |
| 2023 | MFFN: Multi-view Feature Fusion Network for Camouflaged Object Detection. | Dehua Zheng, Xiaochen Zheng, Laurence T. Yang, Yuan Gao, Chenlu Zhu, Yiheng Ruan |
| 2023 | Robustness of Trajectory Prediction Models Under Map-Based Attacks. | Zhihao Zheng, Xiaowen Ying, Zhen Yao, Mooi Choo Chuah |
| 2023 | Complementary Bi-directional Feature Compression for Indoor 360° Semantic Segmentation with Self-distillation. | Zishuo Zheng, Chunyu Lin, Lang Nie, Kang Liao, Zhijie Shen, Yao Zhao |
| 2023 | YOLOv7-sea: Object Detection of Maritime UAV Images based on Improved YOLOv7. | Hangyue Zhao, Hongpu Zhang, Yanyun Zhao |