| 2024 | AA-SGAN: Adversarially Augmented Social GAN with Synthetic Data. | Mirko Zaffaroni, Federico Signoretta, Marco Grangetto, Attilio Fiandrotti |
| 2024 | Merlin: Empowering Multimodal LLMs with Foresight Minds. | En Yu, Liang Zhao, Yana Wei, Jinrong Yang, Dongming Wu, Lingyu Kong, Haoran Wei, Tiancai Wang, Zheng Ge, Xiangyu Zhang, Wenbing Tao |
| 2024 | Attention Prompting on Image for Large Vision-Language Models. | Runpeng Yu, Weihao Yu, Xinchao Wang |
| 2024 | ERF-NAS: Efficient Receptive Field-Based Zero-Shot NAS for Object Detection. | Xinyi Yu, Runan Yin, Zhihao Lin, Yongtao Wang |
| 2024 | HiFi-123: Towards High-Fidelity One Image to 3D Content Generation. | Wangbo Yu, Li Yuan, Yan-Pei Cao, Xiangjun Gao, Xiaoyu Li, Wenbo Hu, Quan Long, Ying Shan, Yonghong Tian |
| 2024 | ProtoComp: Diverse Point Cloud Completion with Controllable Prototype. | Xumin Yu, Yanbo Wang, Jie Zhou, Jiwen Lu |
| 2024 | Effective Lymph Nodes Detection in CT Scans Using Location Debiased Query Selection and Contrastive Query Representation in Transformer. | Qinji Yu, Yirui Wang, Ke Yan, Haoshen Li, Dazhou Guo, Li Zhang, Na Shen, Qifeng Wang, Xiaowei Ding, Le Lu, Xianghua Ye, Dakai Jin |
| 2024 | Monocular Occupancy Prediction for Scalable Indoor Scenes. | Hongxiao Yu, Yuqi Wang, Yuntao Chen, Zhaoxiang Zhang |
| 2024 | Pseudo-RIS: Distinctive Pseudo-Supervision Generation for Referring Image Segmentation. | Seonghoon Yu, Paul Hongsuck Seo, Jeany Son |
| 2024 | Unmasking Bias in Diffusion Model Training. | Hu Yu, Li Shen, Jie Huang, Hongsheng Li, Feng Zhao |
| 2024 | STAMP: Outlier-Aware Test-Time Adaptation with Stable Memory Replay. | Yongcan Yu, Lijun Sheng, Ran He, Jian Liang |
| 2024 | Towards Open-Ended Visual Recognition with Large Language Models. | Qihang Yu, Xiaohui Shen, Liang-Chieh Chen |
| 2024 | DPA-Net: Structured 3D Abstraction from Sparse Views via Differentiable Primitive Assembly. | Fenggen Yu, Yiming Qian, Xu Zhang, Francisca Gil-Ureta, Brian Jackson, Eric P. Bennett, Hao Zhang |
| 2024 | NToP: NeRF-Powered Large-Scale Dataset Generation for 2D and 3D Human Pose Estimation in Top-View Fisheye Images. | Jingrui Yu, Dipankar Nandi, Roman Seidel, Gangolf Hirtz |
| 2024 | Semi-supervised Teacher-Reference-Student Architecture for Action Quality Assessment. | Wulian Yun, Mengshi Qi, Fei Peng, Huadong Ma |
| 2024 | Mew: Multiplexed Immunofluorescence Image Analysis Through an Efficient Multiplex Network. | Sukwon Yun, Jie Peng, Alexandro E. Trevino, Chanyoung Park, Tianlong Chen |
| 2024 | Spherical World-Locking for Audio-Visual Localization in Egocentric Videos. | Heeseung Yun, Ruohan Gao, Ishwarya Ananthabhotla, Anurag Kumar, Jacob Donley, Chao Li, Gunhee Kim, Vamsi Krishna Ithapu, Calvin Murdock |
| 2024 | Scaling Up Personalized Image Aesthetic Assessment via Task Vector Customization. | Jooyeol Yun, Jaegul Choo |
| 2024 | Teddy: Efficient Large-Scale Dataset Distillation via Taylor-Approximated Matching. | Ruonan Yu, Songhua Liu, Jingwen Ye, Xinchao Wang |
| 2024 | Select and Distill: Selective Dual-Teacher Knowledge Transfer for Continual Learning on Vision-Language Models. | Yu-Chu Yu, Chi-Pin Huang, Jr-Jen Chen, Kai-Po Chang, Yung-Hsuan Lai, Fu-En Yang, Yu-Chiang Frank Wang |
| 2024 | SignAvatars: A Large-Scale 3D Sign Language Holistic Motion Dataset and Benchmark. | Zhengdi Yu, Shaoli Huang, Yongkang Cheng, Tolga Birdal |
| 2024 | EAFormer: Scene Text Segmentation with Edge-Aware Transformers. | Haiyang Yu, Teng Fu, Bin Li, Xiangyang Xue |
| 2024 | AddMe: Zero-Shot Group-Photo Synthesis by Inserting People Into Scenes. | Dongxu Yue, Maomao Li, Yunfei Liu, Qin Guo, Ailing Zeng, Tianyu Yang, Yu Li |
| 2024 | Improving 2D Feature Representations by 3D-Aware Fine-Tuning. | Yuanwen Yue, Anurag Das, Francis Engelmann, Siyu Tang, Jan Eric Lenssen |
| 2024 | Surf-D: Generating High-Quality Surfaces of Arbitrary Topologies Using Diffusion Models. | Zhengming Yu, Zhiyang Dou, Xiaoxiao Long, Cheng Lin, Zekun Li, Yuan Liu, Norman Mller, Taku Komura, Marc Habermann, Christian Theobalt, Xin Li, Wenping Wang |