| 2024 | 3DSA: Multi-view 3D Human Pose Estimation With 3D Space Attention Mechanisms. | Bo-Han Chen, Chia-Chi Tsai |
| 2024 | Just a Hint: Point-Supervised Camouflaged Object Detection. | Huafeng Chen, Dian Shao, Guangqian Guo, Shan Gao |
| 2024 | Thermal3D-GS: Physics-Induced 3D Gaussians for Thermal Infrared Novel-View Synthesis. | Qian Chen, Shihao Shu, Xiangzhi Bai |
| 2024 | OPPH: A Vision-Based Operator for Measuring Body Movements for Personal Healthcare. | Longfei Chen, Subramanian Ramamoorthy, Robert B. Fisher |
| 2024 | PromptIQA: Boosting the Performance and Generalization for No-Reference Image Quality Assessment via Prompts. | Zewen Chen, Haina Qin, Juan Wang, Chunfeng Yuan, Bing Li, Weiming Hu, Liang Wang |
| 2024 | IntrinsicAnything: Learning Diffusion Priors for Inverse Rendering Under Unknown Illumination. | Xi Chen, Sida Peng, Dongchen Yang, Yuan Liu, Bowen Pan, Chengfei Lv, Xiaowei Zhou |
| 2024 | Action2Sound: Ambient-Aware Generation of Action Sounds from Egocentric Videos. | Changan Chen, Puyuan Peng, Ami Baid, Zihui Xue, Wei-Ning Hsu, David Harwath, Kristen Grauman |
| 2024 | Topology-Preserving Downsampling of Binary Images. | Chia-Chia Chen, Chihan Peng |
| 2024 | Quanta Video Restoration. | Prateek Chennuri, Yiheng Chi, Enze Jiang, G. M. Dilshan Godaliyadda, Abhiram Gnanasambandam, Hamid R. Sheikh, Istvn Gyngy, Stanley H. Chan |
| 2024 | Mesh2NeRF: Direct Mesh Supervision for Neural Radiance Field Representation and Generation. | Yujin Chen, Yinyu Nie, Benjamin Ummenhofer, Reiner Birkl, Michael Paulitsch, Matthias Mller, Matthias Niener |
| 2024 | AutoEval-Video: An Automatic Benchmark for Assessing Large Vision Language Models in Open-Ended Video Question Answering. | Xiuyuan Chen, Yuan Lin, Yuchen Zhang, Weiran Huang |
| 2024 | General and Task-Oriented Video Segmentation. | Mu Chen, Liulei Li, Wenguan Wang, Ruijie Quan, Yi Yang |
| 2024 | DGE: Direct Gaussian 3D Editing by Consistent Multi-view Editing. | Minghao Chen, Iro Laina, Andrea Vedaldi |
| 2024 | SAM4MLLM: Enhance Multi-Modal Large Language Model for Referring Expression Segmentation. | Yi-Chia Chen, Wei-Hua Li, Cheng Sun, Yu-Chiang Frank Wang, Chu-Song Chen |
| 2024 | A Comparative Study of Image Restoration Networks for General Backbone Network Design. | Xiangyu Chen, Zheyuan Li, Yuandong Pu, Yihao Liu, Jiantao Zhou, Yu Qiao, Chao Dong |
| 2024 | A Unified Anomaly Synthesis Strategy with Gradient Ascent for Industrial Anomaly Detection and Localization. | Qiyu Chen, Huiyuan Luo, Chengkan Lv, Zhengtao Zhang |
| 2024 | A Secure Image Watermarking Framework with Statistical Guarantees via Adversarial Attacks on Secret Key Networks. | Feiyu Chen, Wei Lin, Ziquan Liu, Antoni B. Chan |
| 2024 | Dual-Rain: Video Rain Removal Using Assertive and Gentle Teachers. | Tingting Chen, Beibei Lin, Yeying Jin, Wending Yan, Wei Ye, Yuan Yuan, Robby T. Tan |
| 2024 | Learning Local Pattern Modularization for Point Cloud Reconstruction from Unseen Classes. | Chao Chen, Yu-Shen Liu, Zhizhong Han |
| 2024 | ShareGPT4V: Improving Large Multi-modal Models with Better Captions. | Lin Chen, Jinsong Li, Xiaoyi Dong, Pan Zhang, Conghui He, Jiaqi Wang, Feng Zhao, Dahua Lin |
| 2024 | Fully Authentic Visual Question Answering Dataset from Online Communities. | Chongyan Chen, Mengchen Liu, Noel Codella, Yunsheng Li, Lu Yuan, Danna Gurari |
| 2024 | LivePhoto: Real Image Animation with Text-Guided Motion Control. | Xi Chen, Zhiheng Liu, Mengting Chen, Yutong Feng, Yu Liu, Yujun Shen, Hengshuang Zhao |
| 2024 | Learning to Localize Actions in Instructional Videos with LLM-Based Multi-pathway Text-Video Alignment. | Yuxiao Chen, Kai Li, Wentao Bao, Deep Patel, Yu Kong, Martin Renqiang Min, Dimitris N. Metaxas |
| 2024 | GazeXplain: Learning to Predict Natural Language Explanations of Visual Scanpaths. | Xianyu Chen, Ming Jiang, Qi Zhao |
| 2024 | Knowledge Transfer with Simulated Inter-image Erasing for Weakly Supervised Semantic Segmentation. | Tao Chen, Xiruo Jiang, Gensheng Pei, Zeren Sun, Yucheng Wang, Yazhou Yao |