| 2024 | SIRA: Scalable Inter-Frame Relation and Association for Radar Perception. | Ryoma Yataka, Pu Wang, Petros Boufounos, Ryuhei Takahashi |
| 2024 | CAM Back Again: Large Kernel CNNs from a Weakly Supervised Object Localization Perspective. | Shunsuke Yasuki, Masato Taki |
| 2024 | Mosaic-SDF for 3D Generative Models. | Lior Yariv, Omri Puny, Oran Gafni, Yaron Lipman |
| 2024 | DetCLIPv3: Towards Versatile Generative Open-Vocabulary Object Detection. | Lewei Yao, Renjie Pi, Jianhua Han, Xiaodan Liang, Hang Xu, Wei Zhang, Zhenguo Li, Dan Xu |
| 2024 | Evaluating the Effectiveness of Video Anomaly Detection in the Wild Online Learning and Inference for Real-world Deployment. | Shanle Yao, Ghazal Alinezhad Noghre, Armin Danesh Pazho, Hamed Tabkhi |
| 2024 | SPECAT: SPatial-spEctral Cumulative-Attention Transformer for High-Resolution Hyperspectral Image Reconstruction. | Zhiyang Yao, Shuyang Liu, Xiaoyun Yuan, Lu Fang |
| 2024 | PromptCoT: Align Prompt Distribution via Adapted Chain-of-Thought. | Junyi Yao, Yijiang Liu, Zhen Dong, Mingfei Guo, Helan Hu, Kurt Keutzer, Li Du, Daquan Zhou, Shanghang Zhang |
| 2024 | HUNTER: Unsupervised Human-Centric 3D Detection via Transferring Knowledge from Synthetic Instances to Real Scenes. | Yichen Yao, Zimo Jiang, Yujing Sun, Zhencai Zhu, Xinge Zhu, Runnan Chen, Yuexin Ma |
| 2024 | Weakly Supervised Set-Consistency Learning Improves Morphological Profiling of Single-Cell Images. | Heming Yao, Phil Hanslovsky, Jan-Christian Huetter, Burkhard Hoeckendorf, David Richmond |
| 2024 | TCP: Textual-Based Class-Aware Prompt Tuning for Visual-Language Model. | Hantao Yao, Rui Zhang, Changsheng Xu |
| 2024 | Multi-Modal Proxy Learning Towards Personalized Visual Multiple Clustering. | Jiawei Yao, Qi Qian, Juhua Hu |
| 2024 | MaskClustering: View Consensus Based Mask Graph Clustering for Open-Vocabulary 3D Instance Segmentation. | Mi Yan, Jiazhao Zhang, Yan Zhu, He Wang |
| 2024 | RELI11D: A Comprehensive Multimodal Human Motion Dataset and Method. | Ming Yan, Yan Zhang, Shuqiang Cai, Shuqi Fan, Xincheng Lin, Yudi Dai, Siqi Shen, Chenglu Wen, Lan Xu, Yuexin Ma, Cheng Wang |
| 2024 | MonoCD: Monocular 3D Object Detection with Complementary Depths. | Longfei Yan, Pei Yan, Shengzhou Xiong, Xuanyu Xiang, Yihua Tan |
| 2024 | Person-in-WiFi 3D: End-to-End Multi-Person 3D Pose Estimation with Wi-Fi. | Kangwei Yan, Fei Wang, Bo Qian, Han Ding, Jinsong Han, Xing Wei |
| 2024 | Orchestrate Latent Expertise: Advancing Online Continual Learning with Multi-Level Supervision and Reverse Self-Distillation. | Hongwei Yan, Liyuan Wang, Kaisheng Ma, Yi Zhong |
| 2024 | GS-SLAM: Dense Visual SLAM with 3D Gaussian Splatting. | Chi Yan, Delin Qu, Dan Xu, Bin Zhao, Zhigang Wang, Dong Wang, Xuelong Li |
| 2024 | Tri-Perspective view Decomposition for Geometry-Aware Depth Completion. | Zhiqiang Yan, Yuankai Lin, Kun Wang, Yupeng Zheng, Yufei Wang, Zhenyu Zhang, Jun Li, Jian Yang |
| 2024 | Multi-Scale 3D Gaussian Splatting for Anti-Aliased Rendering. | Zhiwen Yan, Weng Fei Low, Yu Chen, Gim Hee Lee |
| 2024 | DS-NeRV: Implicit Neural Video Representation with Decomposed Static and Dynamic Codes. | Hao Yan, Zhihui Ke, Xiaobo Zhou, Tie Qiu, Xidong Shi, Dadong Jiang |
| 2024 | Differentiable Information Bottleneck for Deterministic Multi-View Clustering. | Xiaoqiang Yan, Zhixiang Jin, Fengshou Han, Yangdong Ye |
| 2024 | MMA: Multi-Modal Adapter for Vision-Language Models. | Lingxiao Yang, Ru-Yuan Zhang, Yanchen Wang, Xiaohua Xie |
| 2024 | OmniMotionGPT: Animal Motion Generation with Limited Data. | Zhangsihao Yang, Mingyuan Zhou, Mengyi Shan, Bingbing Wen, Ziwei Xuan, Mitch Hill, Junjie Bai, Guo-Jun Qi, Yalin Wang |
| 2024 | ViewFusion: Towards Multi-View Consistency via Interpolated Denoising. | Xianghui Yang, Yan Zuo, Sameera Ramasinghe, Loris Bazzani, Gil Avraham, Anton van den Hengel |
| 2024 | Fresco: Spatial-Temporal Correspondence for Zero-Shot Video Translation. | Shuai Yang, Yifan Zhou, Ziwei Liu, Chen Change Loy |