| 2024 | GMT: Enhancing Generalizable Neural Rendering via Geometry-Driven Multi-Reference Texture Transfer. | Youngho Yoon, Hyun-Kurl Jang, Kuk-Jin Yoon |
| 2024 | Generating Human Interaction Motions in Scenes with Text Control. | Hongwei Yi, Justus Thies, Michael J. Black, Xue Bin Peng, Davis Rempe |
| 2024 | SRPose: Two-View Relative Pose Estimation with Sparse Keypoints. | Rui Yin, Yulun Zhang, Zherong Pan, Jianjun Zhu, Cheng Wang, Biao Jia |
| 2024 | LG-Gaze: Learning Geometry-Aware Continuous Prompts for Language-Guided Gaze Estimation. | Pengwei Yin, Jingjing Wang, Guanzhong Zeng, Di Xie, Jiang Zhu |
| 2024 | Integrating Markov Blanket Discovery Into Causal Representation Learning for Domain Generalization. | Naiyu Yin, Hanjing Wang, Yue Yu, Tian Gao, Amit Dhurandhar, Qiang Ji |
| 2024 | ReGentS: Real-World Safety-Critical Driving Scenario Generation Made Stable. | Yuan Yin, Pegah Khayatan, loi Zablocki, Alexandre Boulch, Matthieu Cord |
| 2024 | WHAC: World-Grounded Humans and Cameras. | Wanqi Yin, Zhongang Cai, Ruisi Wang, Fanzhou Wang, Chen Wei, Haiyi Mei, Weiye Xiao, Zhitao Yang, Qingping Sun, Atsushi Yamashita, Ziwei Liu, Lei Yang |
| 2024 | Ray-Distance Volume Rendering for Neural Scene Reconstruction. | Ruihong Yin, Yunlu Chen, Sezer Karaoglu, Theo Gevers |
| 2024 | CAT: Enhancing Multimodal Large Language Model to Answer Questions in Dynamic Audio-Visual Scenarios. | Qilang Ye, Zitong Yu, Rui Shao, Xinyu Xie, Philip Torr, Xiaochun Cao |
| 2024 | Nickel and Diming Your GAN: A Dual-Method Approach to Enhancing GAN Efficiency via Knowledge Distillation. | Sangyeop Yeo, Yoojin Jang, Jaejun Yoo |
| 2024 | Tracking-Assisted Object Detection with Event Cameras. | Ting-Kang Yen, Igor Morawski, Shusil Dangi, Kai He, Chung-Yi Lin, Jia-Fong Yeh, Hung-Ting Su, Winston H. Hsu |
| 2024 | An Approach for Dataset Extension for Object Detection in Artworks Using Open-Vocabulary Models. | Tetiana Yemelianenko, Iuliia Tkachenko, Tess Masclef, Mihaela Scuturici, Serge Miguet |
| 2024 | Cross-View Image Geo-Localization with Panorama-BEV Co-retrieval Network. | Junyan Ye, Zhutao Lv, Weijia Li, Jinhua Yu, Haote Yang, Huaping Zhong, Conghui He |
| 2024 | DreamReward: Text-to-3D Generation with Human Preference. | Junliang Ye, Fangfu Liu, Qixiu Li, Zhengyi Wang, Yikai Wang, Xinzhou Wang, Yueqi Duan, Jun Zhu |
| 2024 | SegGen: Supercharging Segmentation Models with Text2Mask and Mask2Img Synthesis. | Hanrong Ye, Jason Kuen, Qing Liu, Zhe Lin, Brian L. Price, Dan Xu |
| 2024 | CVT-Occ: Cost Volume Temporal Fusion for 3D Occupancy Prediction. | Zhangchen Ye, Tao Jiang, Chenfeng Xu, Yiming Li, Hang Zhao |
| 2024 | Gaussian Grouping: Segment and Edit Anything in 3D Scenes. | Mingqiao Ye, Martin Danelljan, Fisher Yu, Lei Ke |
| 2024 | BEAF: Observing BEfore-AFter Changes to Evaluate Hallucination in Vision-Language Models. | Moon Ye-Bin, Nam Hyeon-Woo, Wonseok Choi, Tae-Hyun Oh |
| 2024 | Bucketed Ranking-Based Losses for Efficient Training of Object Detectors. | Feyza Yavuz, Baris Can Cam, Adnan Harun Dogan, Kemal Oksuz, Emre Akbas, Sinan Kalkan |
| 2024 | FutureDepth: Learning to Predict the Future Improves Video Depth Estimation. | Rajeev Yasarla, Manish Kumar Singh, Hong Cai, Yunxiao Shi, Jisoo Jeong, Yinhao Zhu, Shizhong Han, Risheek Garrepalli, Fatih Porikli |
| 2024 | Forecasting Future Videos from Novel Views via Disentangled 3D Scene Representation. | Sudhir Yarram, Junsong Yuan |
| 2024 | DSA: Discriminative Scatter Analysis for Early Smoke Segmentation. | Lujian Yao, Haitao Zhao, Jingchao Peng, Zhongze Wang, Kaijie Zhao |
| 2024 | Exploring Vulnerabilities in Spiking Neural Networks: Direct Adversarial Attacks on Raw Event Data. | Yanmeng Yao, Xiaohan Zhao, Bin Gu |
| 2024 | Improving Domain Generalization in Self-supervised Monocular Depth Estimation via Stabilized Adversarial Training. | Yuanqi Yao, Gang Wu, Kui Jiang, Siao Liu, Jian Kuai, Xianming Liu, Junjun Jiang |
| 2024 | HiFi-Score: Fine-Grained Image Description Evaluation with Hierarchical Parsing Graphs. | Ziwei Yao, Ruiping Wang, Xilin Chen |