| 2024 | ReMatching: Low-Resolution Representations for Scalable Shape Correspondence. | Filippo Maggioli, Daniele Baieri, Emanuele Rodol, Simone Melzi |
| 2024 | TimeLens-XL: Real-Time Event-Based Video Frame Interpolation with Large Motion. | Yongrui Ma, Shi Guo, Yutian Chen, Tianfan Xue, Jinwei Gu |
| 2024 | A Light and Smart Wearable Platform with Multimodal Foundation Model for Enhanced Spatial Reasoning in People with Blindness and Low Vision. | Alexey Magay, Dhurba Tripathi, Yu Hao, Yi Fang |
| 2024 | SiT: Exploring Flow and Diffusion-Based Generative Models with Scalable Interpolant Transformers. | Nanye Ma, Mark Goldstein, Michael S. Albergo, Nicholas M. Boffi, Eric Vanden-Eijnden, Saining Xie |
| 2024 | A Geometric Distortion Immunized Deep Watermarking Framework with Robustness Generalizability. | Linfeng Ma, Han Fang, Tianyi Wei, Zijin Yang, Zehua Ma, Weiming Zhang, Nenghai Yu |
| 2024 | Improving Adversarial Transferability via Model Alignment. | Avery Ma, Amir-massoud Farahmand, Yangchen Pan, Philip Torr, Jindong Gu |
| 2024 | COM Kitchens: An Unedited Overhead-View Video Dataset as a Vision-Language Benchmark. | Koki Maeda, Tosho Hirasawa, Atsushi Hashimoto, Jun Harashima, Leszek Rybicki, Yusuke Fukasawa, Yoshitaka Ushiku |
| 2024 | Local Occupancy-Enhanced Object Grasping with Multiple Triplanar Projection. | Kangqi Ma, Hao Dong, Yadong Mu |
| 2024 | Synchronization of Projective Transformations. | Rakshith Madhavan, Andrea Fusiello, Federica Arrigoni |
| 2024 | PEA-Diffusion: Parameter-Efficient Adapter with Knowledge Distillation in Non-english Text-to-Image Generation. | Jian Ma, Chen Chen, Qingsong Xie, Haonan Lu |
| 2024 | Shape-Guided Configuration-Aware Learning for Endoscopic-Image-Based Pose Estimation of Flexible Robotic Instruments. | Yiyao Ma, Kai Chen, Hon-Sing Tong, Ruofeng Wei, Yui-Lun Ng, Ka-Wai Kwok, Qi Dou |
| 2024 | Dolphins: Multimodal Language Model for Driving. | Yingzi Ma, Yulong Cao, Jiachen Sun, Marco Pavone, Chaowei Xiao |
| 2024 | GTMS: A Gradient-Driven Tree-Guided Mask-Free Referring Image Segmentation Method. | Haoxin Lyu, Tianxiong Zhong, Sanyuan Zhao |
| 2024 | TrojVLM: Backdoor Attack Against Vision Language Models. | Weimin Lyu, Lu Pang, Tengfei Ma, Haibin Ling, Chao Chen |
| 2024 | Learn from the Learnt: Source-Free Active Domain Adaptation via Contrastive Sampling and Visual Persistence. | Mengyao Lyu, Tianxiang Hao, Xinhao Xu, Hui Chen, Zijia Lin, Jungong Han, Guiguang Ding |
| 2024 | HIMO: A New Benchmark for Full-Body Human Interacting with Multiple Objects. | Xintao Lv, Liang Xu, Yichao Yan, Xin Jin, Congsheng Xu, Shuwen Wu, Yifan Liu, Lincheng Li, Mengxiao Bi, Wenjun Zeng, Xiaokang Yang |
| 2024 | Efficient Snapshot Spectral Imaging: Calibration-Free Parallel Structure with Aperture Diffraction Fusion. | Tao Lv, Lihao Hu, Shiqiao Li, Chenglong Huang, Xun Cao |
| 2024 | ManiGaussian: Dynamic Gaussian Splatting for Multi-task Robotic Manipulation. | Guanxing Lu, Shiyi Zhang, Ziwei Wang, Changliu Liu, Jiwen Lu, Yansong Tang |
| 2024 | Relightable Neural Actor with Intrinsic Decomposition and Pose Control. | Diogo Carbonera Luvizon, Vladislav Golyanik, Adam Kortylewski, Marc Habermann, Christian Theobalt |
| 2024 | ProCreate, Don't Reproduce! Propulsive Energy Diffusion for Creative Generation. | Jack Lu, Ryan Teehan, Mengye Ren |
| 2024 | Compensation Sampling for Improved Convergence in Diffusion Models. | Hui Lu, Albert Ali Salah, Ronald Poppe |
| 2024 | Improving Zero-Shot Generalization for CLIP with Variational Adapter. | Ziqian Lu, Fengli Shen, Mushui Liu, Yunlong Yu, Xi Li |
| 2024 | Event-Based Motion Deblurring with Dual Channel Attention. | Weiqi Luo, Chi Zhang, Lei Yu |
| 2024 | Pre-trained Visual Dynamics Representations for Efficient Policy Learning. | Hao Luo, Bohan Zhou, Zongqing Lu |
| 2024 | Plug and Play: A Representation Enhanced Domain Adapter for Collaborative Perception. | Tianyou Luo, Quan Yuan, Guiyang Luo, Yuchen Xia, Yujia Yang, Jinglin Li |