Skip to content

International Conference on Multimedia Modelling

MMM

B

CORE rank

CORE rank (raw)

B

Fields of research

Computer Vision and Multimedia Computation

Papers indexed

2,550

1993–2026

Papers per year

1993176 peak2026

MMM papers

2,550 records sourced from DBLP. Search titles, filter by year, sort by recency.

YearTitleAuthors
2026Surface Defect Detection of Photovoltaic Panels Based on Deep Learning and Electroluminescent Images.Xiaoqiang Wang, Liurui Zhao, Yanjie Wang
2026Stereo3D-NeRF: Generating 3D Visualizations with Paired Stereoscopic Views.Yongxiang Wang, Gang Zhou, Wei Liu, Yang Zhou
2026RHaoyang Wang, Liming Liu, Xinggong Zhang
2026HCFFPN: Hierarchical Cross-Scale Feature Fusion Pyramid Network for Small Target Detection in Unmanned Aerial Vehicle Images.Lin Wang, Tiansong Li, Guofen Wang, Shaoguo Cui, Hongkui Wang, Li Yu
2026RIDA: Detection of Adversarial Examples Through Image Adaptive Local Reconstruction.Xiaoyu Wang, Jing Liu
2026MedFuse-GRM: Multi-scale Feature Extraction and Medically-Guided Graph Relation Modeling for Multimodal Skin Lesion Classification.Zhangyi Wang, Zongze Li
2026Enhancing Image Generation of Diffusion Models with Structural Image Guidance.Wei Wang, JiaYi Hu
2026VENUS: Visual Editing with Noise Inversion Using Scene Graphs.Thanh-Nhan Vo, Trong-Thuan Nguyen, Tam V. Nguyen, Minh-Triet Tran
2026DPERC: Direct Parameter Estimation for Mixed Data with Random Missingness.Tuan L. Vo, Uyen Dang, Thu Nguyen, Pl Halvorsen, Michael A. Riegler, Binh T. Nguyen
2026STEP-MR: A Subjective Testing and Eye-Tracking Platform for Dynamic Point Clouds in Mixed Reality.Shivi Vats, Christian Timmerer, Hermann Hellwagner
2026U-Cker at VBS2026: A Web-Based Interactive Video Retrieval System with Multimodal Query Support.Kazuya Ueki, Ryo Mutou, Takuya Wada, Ryota Akaba, Guannan Zhang
2026Integrating Symbolic and Waveform Music Into Large Language Models.Teng Tu, Xiaohao Liu, Yunshan Ma, Ji Qi, Tat-Seng Chua
2026A Case Study of a Transparent and Controllable Music Recommender System with Multi-relational Layers.Kosetsu Tsukuda, Keisuke Ishida, Takumi Takahashi, Masahiro Hamasaki, Masataka Goto
2026PreBERT-Rec: Improving Topic Modeling in Recommendation Systems via Effective Data Preprocessing and BERT.Dang Hoang Minh Triet, Tran Hoang Anh, Nguyen Hoang Hai, Tran Nguyen Minh Quang, Tran Cong Hieu, Thu Nguyen, Binh Thanh Nguyen
2026On the Brittleness of CLIP Text Encoders.Allie Tran, Luca Rossetto
2026NII-UIT at VBS2026: Towards Effective Visual Question Answering for Interactive and Multimodal Video Retrieval.Bao Tran, Tien Do, Thanh Duc Ngo, Duy-Dinh Le, Shin'ichi Satoh
2026Small Object Detection via Frequency-Based Multi-modal Fusion.Shangzhi Teng, Yekai Li, Xi Gong, Xueqiang Lv
2026Multimodal Video Summarization with Mamba and Bayesian Approach.Adane Nega Tarekegn, Fazle Rabbi, Andreas L. Opdahl, Bjrnar Tessem
2026A Multimedia Pipeline for Interactive Game Archaeology on the Example of Wolfenstein 3D in Godot Engine.Berenika Nawoja Kostka de Sztemberg, Patryk Zywica
2026WildfireX-SLAM: A Large-Scale Low-Altitude RGB-D Dataset for Wildfire SLAM and Beyond.Zhicong Sun, Jacqueline Ty Lo, Jinxing Hu
2026Illumination-Prior Guided Hybrid Network for Low-Light Image Enhancement.Ao Sun, Shijie Hao, Yanrong Guo
2026Efficient Reasoning Distillation: Small Video-Language Models via Synthetic CoT and Difficulty-Aware Fine-Tuning.Mantek Singh, Jeshwanth Challagundla, Siddharth Raina, Jasmin Jarsania
2026Splat-Portrait: Generalizing Talking Heads with Gaussian Splatting.Tong Shi, Melonie de Almeida, Daniela Ivanova, Nicolas Pugeault, Paul Henderson
2026PRSM: A Measure to Evaluate CLIP's Robustness Against Paraphrases.Udo Schlegel, Franziska Weeber, Jian Lan, Thomas Seidl
2026Applications of Multimodal Knowledge Graphs in Modeling Multimedia.Florian Ruosch, Luca Rossetto
2650 of 2,550← PreviousNext →

Comparable venues

Other A*/A conferences filed under the same field of research.