| 2025 | Latent Space Stability vs. Perceptual Sensitivity: A Study of Visual Encoders under Distortion. | Abderrezzaq Sendjasni, Mohamed-Chaker Larabi |
| 2025 | S-LAM3D: Segmentation-Guided Monocular 3D Object Detection via Feature Space Fusion. | Diana-Alexandra Sas, Florin Oniga |
| 2025 | Blind Image Super-Resolution with Local and Global Dual-Guidance. | Yajun Qiu, Shuyuan Zhu, Lantao Yu, Bing Zeng |
| 2025 | D3Net: Dual-Path Decoupling-Distillation for Adaptive Fusion in Continual Egocentric Learning. | Chenghao Qi, Heqian Qiu, Zhaofeng Shi, Lanxiao Wang, Hanwen Zhang, Xinyu Chen, Hongliang Li |
| 2025 | Towards Volumetric Video: a Technical Overview of Immersive Media. | Shi Pan, Hongshuai Li, Zhengxian Yang, Le Wang, Cheng Su, Liqian Ma, Hua Du, Borong Lin, Tao Yu |
| 2025 | FPG-NAS: FLOPs-Aware Gated Differentiable Neural Architecture Search for Efficient 6DoF Pose Estimation. | Nassim Ali Ousalah, Peyman Rostami, Anis Kacem, Enjie Ghorbel, Emmanuel Koumandakis, Djamila Aouada |
| 2025 | Tackling Re-buffering in Adaptive Video Streaming over Dynamic Networks: A Generative AI Approach. | Duc V. Nguyen |
| 2025 | Frequency-Weighted Training Losses for Phoneme-Level DNN-based Speech Enhancement. | Nasser-Eddine Monir, Paul Magron, Romain Serizel |
| 2025 | Cross-Modal Thermal Image Compression via RGB Side Information. | Sayush Maharjan, Raghunath Sai Puttagunta, Zach Button, Zhu Li |
| 2025 | Lightweight Steel Surface Defect Detection via Knowledge Distillation. | Tao Lu, Gaochang Wu |
| 2025 | HGS_OFAT: High-fidelity Gaussian SLAM based on Optical Flow Assisted Tracking. | Zhenyong Li, Shanxin Zhang, Yuxiang Liu, Chuanfen Feng, Hui Ji, Jiande Sun |
| 2025 | MGFT: Multi-Geometric Fusion Transformer for Robust Point Cloud Registration. | Yuxiang Liu, Shanxin Zhang, Zhenyong Li, Chuanfen Feng, Hui Ji, Jiande Sun |
| 2025 | CG-SMFNet: Consensus-Guided Selective Multimodal Fusion for Weakly Supervised Temporal Action Localization. | Peng Liu, Zitai Jiang |
| 2025 | Rethinking Document Layout Analysis through Text Clustering via Multi-Modal Graph Convolution Networks. | Wenxi Li, Chenyang Lyu, Wei Ji, Liting Zhou, Cathal Gurrin, Yuchen Guo |
| 2025 | Learning 3D mesh saliency from spiral patch features. | Olivier Lzoray, Anass Nouri |
| 2025 | Secure protection of 3D content through reversible geometric deformation. | Khlian Larvet, Jean-Pierre Pedeboy, William Puech |
| 2025 | Exploring Cross-Stage Adversarial Transferability in Class-Incremental Continual Learning. | Jungwoo Kim, Jong-Seok Lee |
| 2025 | Adapting Image-to-Video Diffusion Models for Large-Motion Frame Interpolation. | Luoxu Jin, Hiroshi Watanabe |
| 2025 | Towards Low-Latency Tracking of Multiple Speakers With Short-Context Speaker Embeddings. | Taous Iatariene, Alexandre Gurin, Romain Serizel |
| 2025 | Flexibly Constrained Tucker Decomposition for High-Order Spectral Analysis. | Fei He, Houji Du, Nipon Theera-Umpon, Yipeng Liu, Ce Zhu |
| 2025 | Structure-Preserving Patch Decoding for Efficient Neural Video Representation. | Taiga Hayami, Kakeru Koizumi, Hiroshi Watanabe |
| 2025 | EPINET-Lite: Rethinking Mixed Convolutions for Efficient Light Field Disparity Estimation Network. | Ali Hassan, Tingting Zhang, Karen Egiazarian, Mrten Sjstrm |
| 2025 | HyperDiff: Hypergraph Guided Diffusion Model for 3D Human Pose Estimation. | Bing Han, Yuhua Huang, Pan Gao |
| 2025 | SpatialGeo: Boosting Spatial Reasoning in Multimodal LLMs via Geometry-Semantics Fusion. | Jiajie Guo, Qingpeng Zhu, Jin Zeng, Xiaolong Wu, Changyong He, Weida Wang |
| 2025 | FPGA Accelerated One-Sided Box Filter for Edge-Preserving Image Processing. | Yongfei Guo, Xudong Niu, Chizhi Zhang, Yuanhao Gong |