| 2025 | QRALadder: QoE and Resource Consumption-Aware Encoding Ladder Optimization for Live Video Streaming. | Yingqian Zhu, Guanyu Gao |
| 2025 | GWUNet: A UNet with Gated Attention and Improved Wavelet Transform for Thyroid Nodules Segmentation. | Shuijing Zheng, Suxi Yu, Yi Wang, Jing Wen |
| 2025 | SSCDUF: Spatial-Spectral Correlation Transformer Based on Deep Unfolding Framework for Hyperspectral Image Reconstruction. | Hui Zhao, Na Qi, Qing Zhu, Xiumin Lin |
| 2025 | MKSNet: Advanced Small Object Detection in Remote Sensing Imagery with Multi-Kernel and Dual Attention Mechanisms. | Jiahao Zhang, Xiao Zhao, Guangyu Gao |
| 2025 | Progressive Neural Architecture Generation with Weaker Predictors. | Zhengzhuo Zhang, Liansheng Zhuang |
| 2025 | SMG-Diff: Adversarial Attack Method Based on Semantic Mask-Guided Diffusion. | Yongliang Zhang, Jing Liu |
| 2025 | LIESA: Low-Light Image Enhancement with Semantic Awareness. | Jingyao Zhang, Shijie Hao, Fuming Sun, Yuan Rao |
| 2025 | ESC-MISR: Enhancing Spatial Correlations for Multi-image Super-Resolution in Remote Sensing. | Zhihui Zhang, Xiaoshuai Hao, Jianan Li, Jinhui Pang |
| 2025 | DistillSleep: Leverage Self-distillation to Improve Performance After Representation Learning for Sleep Staging. | Le Yu, Xianchao Zhang, Shuxia Qian, Hong Sun |
| 2025 | PA2Net: Pyramid Attention Aggregation Network for Saliency Detection. | Jizhe Yu, Yu Liu, Xiaoshuai Wu, Kaiping Xu, Jiangquan Li |
| 2025 | SceneTextStyler: Editing Text with Style Transformation. | Honghui Yuan, Keiji Yanai |
| 2025 | KuzushijiFontDiff: Diffusion Model for Japanese Kuzushiji Font Generation. | Honghui Yuan, Keiji Yanai |
| 2025 | KuzushijiDiffuser: Japanese Kuzushiji Font Generation with FontDiffuser. | Honghui Yuan, Keiji Yanai |
| 2025 | What Should Autonomous Robots Verbalize and What Should They Not? | Daichi Yoshihara, Akishige Yuguchi, Seiya Kawano, Takamasa Iio, Koichiro Yoshino |
| 2025 | Music2MIDI: Pop Music to MIDI Piano Cover Generation. | Tin Yui Yip, Chuck-jee Chau |
| 2025 | SCLSTE: Semi-supervised Contrastive Learning-Guided Scene Text Editing. | Min Yin, Liang Xie, Haoran Liang, Xing Zhao, Ben Chen, Ronghua Liang |
| 2025 | MICAN: Multi-modal Inconsistency-Based Cooperation Attention Network for Fake News Detection. | Zepu Yi, Songfeng Lu, Xueming Tang, Jianxin Zhu, Junjun Wu |
| 2025 | Hybrid Scalable Video Coding with Neural Compression and Enhancement for Streaming Media. | Yuyao Ye, Jiayu Yang, Yang Zhao, Mengping Gao, Hongbin Cao, Ronggang Wang |
| 2025 | TPS-YOLO: The Efficient Tiny Person Detection Network Based on Improved YOLOv8 and Model Pruning. | Li Yao, Qianni Huang, Yan Wan |
| 2025 | MS-SAM: Multi-scale SAM Based on Dynamic Weighted Agent Attention. | Enhui Yang, Zhibin Zhang |
| 2025 | SCANet: Semantic Coherence Attention Network for Clothing Change Person Re-identification. | Dajiang Yang, Wei Wu, Yuxing Lee |
| 2025 | Integrating S1 &S2 Framework for Enhanced Semantic Match in Person Re-identification. | Xiukang Yang, Jingguo Ge, Hui Li, Liangxiong Li, Bingzhen Wu |
| 2025 | MDT-Net: A Mask Decoder Tuning Strategy for CLIP-Based Zero-Shot 3D Classification. | Hao Yan, Jing Bai |
| 2025 | Temporal Closeness for Enhanced Cross-Modal Retrieval of Sensor and Image Data. | Shuhei Yamamoto, Noriko Kando |
| 2025 | Towards Inclusive Education: Multimodal Classification of Textbook Images for Accessibility. | Saumya Yadav, lise Lincker, Caroline Huron, Stphanie Martin, Camille Guinaudeau, Shin'ichi Satoh, Jainendra Shukla |