| 2022 | HCI | Applying Generative Adversarial Networks and Vision Transformers in Speech Emotion Recognition. | Panikos Heracleous, Satoru Fukayama, Jun Ogata, Yasser Mohammad |
| 2022 | Interspeech | Exploiting Fine-tuning of Self-supervised Learning Models for Improving Bi-modal Sentiment Analysis and Emotion Recognition. | Wei Yang, Satoru Fukayama, Panikos Heracleous, Jun Ogata |
| 2021 | HCI | Speech Emotion Recognition Using Combined Multiple Pairwise Classifiers. | Panikos Heracleous, Yasser Mohammad, Akio Yoneyama |
| 2021 | HCI | A Hierarchical Classification Scheme for Efficient Speech Emotion Recognition. | Panikos Heracleous, Kohichi Takai, Keiji Yasuda, Akio Yoneyama |
| 2020 | HCI | Integrating Language and Emotion Features for Multilingual Speech Emotion Recognition. | Panikos Heracleous, Yasser Mohammad, Akio Yoneyama |
| 2020 | HCI | An Empirical Study on Feature Extraction in DNN-Based Speech Emotion Recognition. | Panikos Heracleous, Kohichi Takai, Yanan Wang, Keiji Yasuda, Akio Yoneyama, Yasser Mohammad |
| 2020 | HCI | Automatic Spoken Language Identification Using Emotional Speech. | Panikos Heracleous, Akio Yoneyama, Kohichi Takai, Keiji Yasuda |
| 2020 | HCI | Deep Learning-Based Automatic Pronunciation Assessment for Second Language Learners. | Kohichi Takai, Panikos Heracleous, Keiji Yasuda, Akio Yoneyama |
| 2020 | ICMI | Implicit Knowledge Injectable Cross Attention Audiovisual Model for Group Emotion Recognition. | Yanan Wang, Jianming Wu, Panikos Heracleous, Shinya Wada, Rui Kimura, Satoshi Kurihara |
| 2019 | CICLING | Speech Emotion Recognition Using Spontaneous Children's Corpus. | Panikos Heracleous, Yasser Mohammad, Keiji Yasuda, Akio Yoneyama |
| 2019 | CICLING | Multilingual Speech Emotion Recognition on Japanese, English, and German. | Panikos Heracleous, Keiji Yasuda, Akio Yoneyama |
| 2019 | HCI | Deep Convolutional Neural Networks for Feature Extraction in Speech Emotion Recognition. | Panikos Heracleous, Yasser Mohammad, Akio Yoneyama |
| 2018 | CICLING | I-vectors and Deep Convolutional Neural Networks for Language Identification in Clean and Reverberant Environments. | Panikos Heracleous, Yasser Mohammad, Kohichi Takai, Keiji Yasuda, Akio Yoneyama |
| 2018 | CICLING | A Study on Far-Field Emotion Recognition Based on Deep Convolutional Neural Networks. | Panikos Heracleous, Yasser Mohammad, Koichi Takai, Keiji Yasuda, Akio Yoneyama, Fumiaki Sugaya |
| 2018 | CICLING | Automatic Method to Build a Dictionary for Class-Based Translation Systems. | Kohichi Takai, Gen Hattori, Keiji Yasuda, Panikos Heracleous, Akio Ishikawa, Kazunori Matsumoto, Fumiaki Sugaya |
| 2018 | IWCMC | Spoken Language Identification Based on I-vectors and Conditional Random Fields. | Panikos Heracleous, Yasser Mohammad, Kohichi Takai, Keiji Yasuda, Akio Yoneyama |
| 2017 | ACII | Speech emotion recognition in noisy and reverberant environments. | Panikos Heracleous, Keiji Yasuda, Fumiaki Sugaya, Akio Yoneyama, Masayuki Hashimoto |
| 2017 | CICLING | Machine Learning Approaches for Speech Emotion Recognition: Classic and Novel Advances. | Panikos Heracleous, Akio Ishikawa, Keiji Yasuda, Hiroyuki Kawashima, Fumiaki Sugaya, Masayuki Hashimoto |
| 2017 | CICLING | Building a Location Dependent Dictionary for Speech Translation Systems. | Keiji Yasuda, Panikos Heracleous, Akio Ishikawa, Masayuki Hashimoto, Kazunori Matsumoto, Fumiaki Sugaya |
| 2014 | ICASSP | Stochastic modeling and disaggregation of energy-consumption behavior. | Panikos Heracleous, Pongtep Angkititrakul, Kazuya Takeda |
| 2012 | BIBE | The role of the Lombard reflex in parkinson's disease. | Panikos Heracleous, Jani Even, Carlos Toshinori Ishi, Takahiro Miyashita, Norihiro Hagita, Masaki Kondo, Kyoko Takanohara |
| 2012 | ICASSP | Fusion of standard and alternative acoustic sensors for robust automatic speech recognition. | Panikos Heracleous, Jani Even, Carlos Toshinori Ishi, Takahiro Miyashita, Norihiro Hagita |
| 2012 | IROS | Combining laser range finders and local steered response power for audio monitoring. | Jani Even, Carlos Toshinori Ishi, Panikos Heracleous, Takahiro Miyashita, Norihiro Hagita |
| 2012 | LREC | Body-conductive acoustic sensors in human-robot communication. | Panikos Heracleous, Carlos Toshinori Ishi, Takahiro Miyashita, Norihiro Hagita |
| 2011 | ICASSP | Automatic recognition of speech without any audio information. | Panikos Heracleous, Norihiro Hagita |
| 2011 | Interspeech | Range Based Multi Microphone Array Fusion for Speaker Activity Detection in Small Meetings. | Jani Even, Panikos Heracleous, Carlos Toshinori Ishi, Norihiro Hagita |
| 2011 | IROS | Multi-modal front-end for speaker activity detection in small meetings. | Jani Even, Panikos Heracleous, Carlos Toshinori Ishi, Norihiro Hagita |
| 2010 | ICPR | Gestures and Lip Shape Integration for Cued Speech Recognition. | Panikos Heracleous, Norihiro Hagita, Denis Beautemps |
| 2010 | Interspeech | Non-audible murmur recognition based on fusion of audio and visual streams. | Panikos Heracleous, Norihiro Hagita |
| 2009 | Interspeech | Cued speech recognition for augmentative communication in normal-hearing and hearing-impaired subjects. | Panikos Heracleous, Denis Beautemps, Noureddine Aboutabit |
| 2009 | Interspeech | Acoustic-to-articulatory inversion using speech recognition and trajectory formation based on phoneme hidden Markov models. | Atef Ben Youssef, Pierre Badin, Grard Bailly, Panikos Heracleous |
| 2005 | Interspeech | Investigating the role of the Lombard reflex in non-audible murmur (NAM) recognition. | Panikos Heracleous, Tomomi Kaino, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2005 | Interspeech | Applications of NAM microphones in speech recognition for privacy in human-machine communication. | Panikos Heracleous, Tomomi Kaino, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2004 | Interspeech | Non-audible murmur (NAM) speech recognition using a stethoscopic NAM microphone. | Panikos Heracleous, Yoshitaka Nakajima, Akinobu Lee, Hiroshi Saruwatari, Kiyohiro Shikano |
| 2003 | Interspeech | A semi-blind source separation method for hands-free speech recognition of multiple talkers. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 2003 | Interspeech | An efficient keyword spotting technique using a complementary language for filler models training. | Panikos Heracleous, Tohru Shimizu |
| 2002 | ICMI | 3-D N-Best Search for Simultaneous Recognition of Distant-Talking Speech of Multiple Talkers. | Satoshi Nakamura, Panikos Heracleous |
| 2001 | ICASSP | A microphone array-based 3-D N-best search algorithm for the simultaneous recognition of multiple sound sources in real environments. | Panikos Heracleous, Satoshi Nakamura, Kiyohiro Shikano |
| 1999 | Interspeech | Simultaneous recognition of multiple sound sources based on 3-d n-best search using microphone array. | Panikos Heracleous, Takeshi Yamada, Satoshi Nakamura, Kiyohiro Shikano |