| 2025 | Dynamic Group Detection using VLM-augmented Temporal Groupness Graph. | Kaname Yokoyama, Chihiro Nakatani, Norimichi Ukita |
| 2025 | Multiplicative Loss for Enhancing Semantic Segmentation in Medical and Cellular Images. | Yuto Yokoi, Kazuhiro Hotta |
| 2025 | LUT-Fuse: Towards Extremely Fast Infrared and Visible Image Fusion via Distillation to Learnable Look-Up Tables. | Xunpeng Yi, Yibing Zhang, Xinyu Xiang, Qinglong Yan, Han Xu, Jiayi Ma |
| 2025 | Federated Representation Angle Learning. | Liping Yi, Han Yu, Gang Wang, Xiaoguang Liu, Xiaoxiao Li |
| 2025 | ArchiSet: Benchmarking Editable and Consistent Single-View 3D Reconstruction of Buildings with Specific Window-to-Wall Ratios. | Jun Yin, Pengyu Zeng, Licheng Shen, Miao Zhang, Jing Zhong, Yuxing Han, Shuai Lu |
| 2025 | Information-Bottleneck Driven Binary Neural Network for Change Detection. | Kaijie Yin, Zhiyuan Zhang, Shu Kong, Tian Gao, Cheng-Zhong Xu, Hui Kong |
| 2025 | ProGait: A Multi-Purpose Video Dataset and Benchmark for Transfemoral Prosthesis Users. | Xiangyu Yin, Boyuan Yang, Weichen Liu, Qiyao Xue, Abrar Alamri, Goeran Fiedler, Wei Gao |
| 2025 | The Best of Both Worlds: Integrating Language Models and Diffusion Models for Video Generation. | Aoxiong Yin, Xu Tan, Kai Shen, Yichong Leng, Xinyu Zhou, Juncheng Li, Siliang Tang |
| 2025 | FaceCraft4D: Animated 3D Facial Avatar Generation from a Single Image. | Fei Yin, Mallikarjun B. R., Chun-Han Yao, Rafal K. Mantiuk, Varun Jampani |
| 2025 | Progressive Homeostatic and Plastic Prompt Tuning for Audio-Visual Multi-Task Incremental Learning. | Jiong Yin, Liang Li, Jiehua Zhang, Yuhan Gao, Chenggang Yan, Xichun Sheng |
| 2025 | ToolVQA: A Dataset for Multi-Step Reasoning VQA with External Tools. | Shaofeng Yin, Ting Lei, Yang Liu |
| 2025 | MAP: End-to-End Autonomous Driving with Map-Assisted Planning. | Huilin Yin, Yiming Kan, Daniel Watzenig |
| 2025 | SketchSplat: 3D Edge Reconstruction Via Differentiable Multi-View Sketch Splatting. | Haiyang Ying, Matthias Zwicker |
| 2025 | FusionPhys: A Flexible Framework for Fusing Complementary Sensing Modalities in Remote Physiological Measurement. | Chenhang Ying, Huiyu Yang, Jieyi Ge, Zhaodong Sun, Xu Cheng, Kui Ren, Xiaobai Li |
| 2025 | MOVE: Motion-Guided Few-Shot Video Object Segmentation. | Kaining Ying, Hengrui Hu, Henghui Ding |
| 2025 | LDPose: Towards Inclusive Human Pose Estimation for Limb-Deficient Individuals in the Wild. | Jiaying Ying, Heming Du, Kaihao Zhang, Lincheng Li, Xin Yu |
| 2025 | Towards Omnimodal Expressions and Reasoning in Referring Audio-Visual Segmentation. | Kaining Ying, Henghui Ding, Guangquan Jie, Yu-Gang Jiang |
| 2025 | Fine-Structure Preserved Real-World Image Super-Resolution Via Transfer Vae Training. | Qiaosi Yi, Shuai Liu, Rongyuan Wu, Lingchen Sun, Yuhui Wu, Lei Zhang |
| 2025 | Adapt Foundational Segmentation Models with Heterogeneous Searching Space. | Li Yi, Jie Hu, Songan Zhang, Guannan Jiang |
| 2025 | Learning Generalizable Diabetic Retinopathy Grading by Decoupled State Space Decoding. | Jingjun Yi, Qi Bi, Hao Zheng, Haolan Zhan, Wei Ji, Huimin Huang, Yuexiang Li, Xian Wu, Yefeng Zheng |
| 2025 | Hi3dgen: High-Fidelity 3D Geometry Generation From Images Via Normal Bridging. | Chongjie Ye, Yushuang Wu, Ziteng Lu, Jiahao Chang, Xiaoyang Guo, Jiaqing Zhou, Hao Zhao, Xiaoguang Han |
| 2025 | UltraNBA Neural Bundle Adjustment for Pose Refinement in 3D Freehand Ultrasound. | Vahit Bugra Yesilkaynak, Vanessa Gonzalez Duque, Magdalena Wysocki, Mohammad Farid Azampour, Nassir Navab, Diana Mateus |
| 2025 | ExCap3d: Expressive 3D Scene Understanding via Object Captioning with Varying Detail. | Chandan Yeshwanth, Dvid Rozenberszki, Angela Dai |
| 2025 | GS-Occ3D: Scaling Vision-Only Occupancy Reconstruction with Gaussian Splatting. | Baijun Ye, Minghui Qin, Saining Zhang, Moonjun Goon, Shaoting Zhu, Hao Zhao, Hang Zhao |
| 2025 | Statistical Confidence Rescoring for Robust 3D Scene Graph Generation from Multi-View Images. | Qi Xun Yeo, Yanyan Li, Gim Hee Lee |