| 2025 | ASRU | Adaptive Audio-Visual Speech Recognition via Matryoshka-Based Multimodal LLMs. | Umberto Cappellazzo, Minsu Kim, Stavros Petridis |
| 2025 | ICASSP | Large Language Models are Strong Audio-Visual Speech Recognition Learners. | Umberto Cappellazzo, Minsu Kim, Honglie Chen, Pingchuan Ma, Stavros Petridis, Daniele Falavigna, Alessio Brutti, Maja Pantic |
| 2025 | Interspeech | Scaling and Enhancing LLM-based AVSR: A Sparse Mixture of Projectors Approach. | Umberto Cappellazzo, Minsu Kim, Stavros Petridis, Daniele Falavigna, Alessio Brutti |
| 2024 | ACL | Continual Contrastive Spoken Language Understanding. | Umberto Cappellazzo, Enrico Fini, Muqiao Yang, Daniele Falavigna, Alessio Brutti, Bhiksha Raj |
| 2024 | ICASSP | Training Early-Exit Architectures for Automatic Speech Recognition: Fine-Tuning Pre-Trained Models or Training from Scratch. | George August Wright, Umberto Cappellazzo, Salah Zaiem, Desh Raj, Lucas Ondel Yang, Daniele Falavigna, Mohamed Nabih Ali, Alessio Brutti |
| 2024 | ICASSP | Improving Continual Learning of Acoustic Scene Classification via Mutual Information Optimization. | Muqiao Yang, Umberto Cappellazzo, Xiang Li, Bhiksha Raj |
| 2024 | Interspeech | Efficient Fine-tuning of Audio Spectrogram Transformers via Soft Mixture of Adapters. | Umberto Cappellazzo, Daniele Falavigna, Alessio Brutti |
| 2023 | Interspeech | An Investigation of the Combination of Rehearsal and Knowledge Distillation in Continual Learning for Spoken Language Understanding. | Umberto Cappellazzo, Daniele Falavigna, Alessio Brutti |
| 2023 | Interspeech | Sequence-Level Knowledge Distillation for Class-Incremental End-to-End Spoken Language Understanding. | Umberto Cappellazzo, Muqiao Yang, Daniele Falavigna, Alessio Brutti |