| 2024 | LMT-GP: Combined Latent Mean-Teacher and Gaussian Process for Semi-supervised Low-Light Image Enhancement. | Ye Yu, Fengxin Chen, Jun Yu, Zhen Kan |
| 2024 | Embedding-Free Transformer with Inference Spatial Reduction for Efficient Semantic Segmentation. | Hyunwoo Yu, Yubin Cho, Beoungwoo Kang, Seunghun Moon, Kyeongbo Kong, Suk-Ju Kang |
| 2024 | LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer. | Ning Yu, Chia-Chih Chen, Zeyuan Chen, Rui Meng, Gang Wu, Paul Josel, Juan Carlos Niebles, Caiming Xiong, Ran Xu |
| 2024 | Reg-TTA3D: Better Regression Makes Better Test-Time Adaptive 3D Object Detection. | Jiakang Yuan, Bo Zhang, Kaixiong Gong, Xiangyu Yue, Botian Shi, Yu Qiao, Tao Chen |
| 2024 | AUFormer: Vision Transformers Are Parameter-Efficient Facial Action Unit Detectors. | Kaishen Yuan, Zitong Yu, Xin Liu, Weicheng Xie, Huanjing Yue, Jingyu Yang |
| 2024 | StreamLTS: Query-Based Temporal-Spatial LiDAR Fusion for Cooperative Object Detection. | Yunshuang Yuan, Monika Sester |
| 2024 | PFEDEDIT: Personalized Federated Learning via Automated Model Editing. | Haolin Yuan, William Paul, John N. Aucott, Philippe Burlina, Yinzhi Cao |
| 2024 | PreSight: Enhancing Autonomous Vehicle Perception with City-Scale NeRF Priors. | Tianyuan Yuan, Yucheng Mao, Jiawei Yang, Yicheng Liu, Yue Wang, Hang Zhao |
| 2024 | Open-Vocabulary SAM: Segment and Recognize Twenty-Thousand Classes Interactively. | Haobo Yuan, Xiangtai Li, Chong Zhou, Yining Li, Kai Chen, Chen Change Loy |
| 2024 | Event-Based Head Pose Estimation: Benchmark and Method. | Jiahui Yuan, Hebei Li, Yansong Peng, Jin Wang, Yuheng Jiang, Yueyi Zhang, Xiaoyan Sun |
| 2024 | Learning Multimodal Latent Generative Models with Energy-Based Prior. | Shiyu Yuan, Jiali Cui, Hanao Li, Tian Han |
| 2024 | PolyOculus: Simultaneous Multi-view Image-Based Novel View Synthesis. | Jason J. Yu, Tristan Aumentado-Armstrong, Fereshteh Forghani, Konstantinos G. Derpanis, Marcus A. Brubaker |
| 2024 | Ferret-UI: Grounded Mobile UI Understanding with Multimodal LLMs. | Keen You, Haotian Zhang, Eldon Schoop, Floris Weers, Amanda Swearngin, Jeffrey Nichols, Yinfei Yang, Zhe Gan |
| 2024 | PACE: A Large-Scale Dataset with Pose Annotations in Cluttered Environments. | Yang You, Kai Xiong, Zhening Yang, Zhengxiang Huang, Junwei Zhou, Ruoxi Shi, Zhou Fang, Adam W. Harley, Leonidas J. Guibas, Cewu Lu |
| 2024 | NeRF-Supervised Feature Point Detection and Description. | Ali Youssef, Francisco Vasconcelos |
| 2024 | SparseCraft: Few-Shot Neural Reconstruction Through Stereopsis Guided Geometric Linearization. | Mae Younes, Amine Ouasfi, Adnane Boukhayma |
| 2024 | Depicting Beyond Scores: Advancing Image Quality Assessment Through Multi-modal Language Models. | Zhiyuan You, Zheyuan Li, Jinjin Gu, Zhenfei Yin, Tianfan Xue, Chao Dong |
| 2024 | DiffSurf: A Transformer-Based Diffusion Model for Generating and Reconstructing 3D Surfaces in Pose. | Yusuke Yoshiyasu, Leyuan Sun |
| 2024 | BI-MDRG: Bridging Image History in Multimodal Dialogue Response Generation. | Hee Suk Yoon, Eunseop Yoon, Joshua Tian Jin Tee, Kang Zhang, Yu-Jung Heo, Du-Seong Chang, Chang D. Yoo |
| 2024 | Probabilistic Weather Forecasting with Deterministic Guidance-Based Diffusion Model. | Donggeun Yoon, Minseok Seo, Doyi Kim, Yeji Choi, Donghyeon Cho |
| 2024 | Pick-a-Back: Selective Device-to-Device Knowledge Transfer in Federated Continual Learning. | JinYi Yoon, HyungJune Lee |
| 2024 | Enhancing Source-Free Domain Adaptive Object Detection with Low-Confidence Pseudo Label Distillation. | Ilhoon Yoon, Hyeongjun Kwon, Jin Kim, Junyoung Park, Hyunsung Jang, Kwanghoon Sohn |
| 2024 | IAM-VFI : Interpolate Any Motion for Video Frame Interpolation with Motion Complexity Map. | Kihwan Yoon, Yong Han Kim, Sungjei Kim, Jinwoo Jeong |
| 2024 | Diffusion-Guided Weakly Supervised Semantic Segmentation. | Sung-Hoon Yoon, Hoyong Kwon, Jaeseok Jeong, Daehee Park, Kuk-Jin Yoon |
| 2024 | DNI: Dilutional Noise Initialization for Diffusion Video Editing. | Sunjae Yoon, Gwanhyeong Koo, Ji Woo Hong, Chang D. Yoo |