| 2025 | Greg: GEometry-Aware RegIon Refinement for Sign Language Video Generation. | Tongkai Shi, Lianyu Hu, Fanhua Shang, Liqing Gao, Wei Feng |
| 2025 | Harnessing Vision Foundation Models for High-Performance, Training-Free Open Vocabulary Segmentation. | Yuheng Shi, Minjing Dong, Chang Xu |
| 2025 | Competitive Distillation: A Simple Learning Strategy for Improving Visual Classification. | Daqian Shi, Xiaolei Diao, Xu Chen, Cdric M. John |
| 2025 | MedSAM-Guided Curriculum Learning for White Matter Tract Segmentation in Block Face Imaging of Fetal Brain. | Athira Kalladayil Shibu, Sriprabha Ramanarayanan, Vinoth Kanna, Jaikishan Jayakumar, Keerthi Ram, Mohanasankar Sivaprakasam |
| 2025 | Segmentation by Merging Models Specialized to Each Class. | Kazuya Shibata, Kazuhiro Hotta |
| 2025 | Simultaneous Motion and Noise Estimation with Event Cameras. | Shintaro Shiba, Yoshimitsu Aoki, Guillermo Gallego |
| 2025 | Relative Illumination Fields: Learning Medium and Light Independent Underwater Scenes. | Mengkun She, Felix Seegrber, David Nakath, Patricia Schntag, Kevin Kser |
| 2025 | Cross-View Isolated Sign Language Recognition via View Synthesis and Feature Disentanglement. | Xin Shen, Xinyu Wang, Lei Shen, Kaihao Zhang, Xin Yu |
| 2025 | Scene Graph Guided Generation: Enable Accurate Relations Generation in Text-to-Image Models via Textural Rectification. | Guibao Shen, Luozhou Wang, Jiantao Lin, Wenhang Ge, Chaozhe Zhang, Xin Tao, Di Zhang, Pengfei Wan, Guangyong Chen, Yijun Li, Ying-Cong Chen |
| 2025 | Fish2Mesh Transformer: 3D Human Mesh Recovery from Egocentric Vision. | Tianma Shen, Aditya Puranik, James Vong, Vrushabh Abhijit Deogirikar, Ryan Fell, Julianna Dietrich, Maria Kyrarini, Christopher Kitts, David C. Jeong |
| 2025 | Trace3D: Consistent Segmentation Lifting via Gaussian Instance Tracing. | Hongyu Shen, Junfeng Ni, Yixin Chen, Weishuo Li, Mingtao Pei, Siyuan Huang |
| 2025 | SpikePack: Enhanced Information Flow in Spiking Neural Networks with High Hardware Compatibility. | Guobin Shen, Jindong Li, Tenglong Li, Dongcheng Zhao, Yi Zeng |
| 2025 | Online Reasoning Video Segmentation with Just-in-Time Digital Twins. | Yiqing Shen, Bohan Liu, Chenjia Li, Lalithkumar Seenivasan, Mathias Unberath |
| 2025 | BlinkTrack: Feature Tracking Over 80 FPS via Events and Images. | Yichen Shen, Yijin Li, Shuo Chen, Guanglin Li, Zhaoyang Huang, Hujun Bao, Zhaopeng Cui, Guofeng Zhang |
| 2025 | QK-Edit: Revisiting Attention-based Injection in MM-DiT for Image and Video Editing. | Tiancheng Shen, Zilong Huang, Xiangtai Li, Zhijie Lin, Jiyang Liu, Yitong Wang, Jiashi Feng, Ming-Hsuan Yang, Jun Hao Liew |
| 2025 | CA2C: A Prior-Knowledge-Free Approach for Robust Label Noise Learning via Asymmetric Co-Learning and Co-Training. | Mengmeng Sheng, Zeren Sun, Tianfei Zhou, Xiangbo Shu, Jinshan Pan, Yazhou Yao |
| 2025 | SpatialSplat: Efficient Semantic 3D from Sparse Unposed Images. | Yu Sheng, Jiajun Deng, Xinran Zhang, Yu Zhang, Bei Hua, Yanyong Zhang, Jianmin Ji |
| 2025 | Autocompose: Automatic Generation of Pose Transition Descriptions for Composed Pose Retrieval Using Multimodal LLMs. | Yi-Ting Shen, Sungmin Eum, Doheon Lee, Rohit Shete, Chiao-Yi Wang, Heesung Kwon, Shuvra S. Bhattacharyya |
| 2025 | AdCorDA: Classifier Refinement via Adversarial Correction and Domain Adaptation. | Lulan Shen, Ali Edalati, Xiangyu Li, Brett H. Meyer, Warren J. Gross, James J. Clark |
| 2025 | Cross-Lingual Visual Text Stylization and Synthesis Incorporating Text Rendering and Diffusion Model. | Minmin Shen, Caren Chen |
| 2025 | LoRA.rar: Learning to Merge LoRAs via Hypernetworks for Subject-Style Conditioned Image Generation. | Donald Shenaj, Ondrej Bohdal, Mete Ozay, Pietro Zanuttigh, Umberto Michieli |
| 2025 | ZOD: Zero-Shot and Out-of-Distribution Detection Dataset for Document Images. | Talha Uddin Sheikh, Sankalp Sinha, Shino Sam, Didier Stricker, Muhammad Zeshan Afzal |
| 2025 | DocSemi: Efficient Document Layout Analysis with Guided Queries. | Tahira Shehzadi, Ifza, Didier Stricker, Muhammad Zeshan Afzal |
| 2025 | Efficient Additive Attention for Transformer-Based Semi-Supervised Document Layout Analysis. | Tahira Shehzadi, Ifza, Didier Stricker, Muhammad Zeshan Afzal |
| 2025 | STEP-DETR: Advancing DETR-based Semi-Supervised Object Detection with Super Teacher and Pseudo-Label Guided Text Queries. | Tahira Shehzadi, Khurram Azeem Hashmi, Shalini Sarode, Didier Stricker, Muhammad Zeshan Afzal |