Skip to content

Alexander Richard

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

38

Venues

11

Active years

2011–2025

Best venue rank

A*

Where they publish

Papers

38 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRSoundVista: Novel-View Ambient Sound Synthesis via Visual-Acoustic Binding.Mingfei Chen, Israel D. Gebru, Ishwarya Ananthabhotla, Christian Richardt, Dejan Markovic, Jake Sandakly, Steven Krenn, Todd Keebler, Eli Shlizerman, Alexander Richard
2025CVPRREWIND: Real-Time Egocentric Whole-Body Motion Diffusion with Exemplar-Based Identity Conditioning.Jihyun Lee, Weipeng Xu, Alexander Richard, Shih-En Wei, Shunsuke Saito, Shaojie Bai, Te-Li Wang, Minhyuk Sung, Tae-Kyun Kim, Jason M. Saragih
2025ICASSPA2B: Neural Rendering of Ambisonic Recordings to Binaural.Israel D. Gebru, Todd Keebler, Jake Sandakly, Steven Krenn, Dejan Markovic, Julia Buffalini, Samuel Hassel, Alexander Richard
2025ICASSPComplexDec: A Domain-robust High-fidelity Neural Audio Codec with Complex Spectrum Modeling.Yi-Chiao Wu, Dejan Markovic, Steven Krenn, Israel D. Gebru, Alexander Richard
2025ICCVAV-Flow: Transforming Text to Audio-Visual Human-Like Interactions.Aggelina Chatziagapi, Louis-Philippe Morency, Hongyu Gong, Michael Zollhfer, Dimitris Samaras, Alexander Richard
2025ICLRFlowDec: A flow-based full-band general audio codec with high perceptual quality.Simon Welker, Matthew Le, Ricky T. Q. Chen, Wei-Ning Hsu, Timo Gerkmann, Alexander Richard, Yi-Chiao Wu
2025ICMLBinauralFlow: A Causal and Streamable Approach for High-Quality Binaural Speech Synthesis with Flow Matching Models.Susan Liang, Dejan Markovic, Israel D. Gebru, Steven Krenn, Todd Keebler, Jacob Sandakly, Frank Yu, Samuel Hassel, Chenliang Xu, Alexander Richard
2025SiggraphAAudio Driven Real-Time Facial Animation for Social Telepresence.Jiye Lee, Chenghui Li, Linh Tran, Shih-En Wei, Jason M. Saragih, Alexander Richard, Hanbyul Joo, Shaojie Bai
2024CVPRReal Acoustic Fields: An Audio-Visual Room Acoustics Dataset and Benchmark.Ziyang Chen, Israel D. Gebru, Christian Richardt, Anurag Kumar, William Laney, Andrew Owens, Alexander Richard
2024CVPRFrom Audio to Photoreal Embodiment: Synthesizing Humans in Conversations.Evonne Ng, Javier Romero, Timur M. Bagautdinov, Shaojie Bai, Trevor Darrell, Angjoo Kanazawa, Alexander Richard
2024ECCVModeling and Driving Human Body Soundfields Through Acoustic Primitives.Chao Huang, Dejan Markovic, Chenliang Xu, Alexander Richard
2024ICASSPScoreDec: A Phase-Preserving High-Fidelity Audio Codec with a Generalized Score-Based Diffusion Post-Filter.Yi-Chiao Wu, Dejan Markovic, Steven Krenn, Israel D. Gebru, Alexander Richard
2024InterspeechEARS: An Anechoic Fullband Speech Dataset Benchmarked for Speech Enhancement and Dereverberation.Julius Richter, Yi-Chiao Wu, Steven Krenn, Simon Welker, Bunlong Lay, Shinji Watanabe, Alexander Richard, Timo Gerkmann
2023CVPRNovel-View Acoustic Synthesis.Changan Chen, Alexander Richard, Roman Shapovalov, Vamsi Krishna Ithapu, Natalia Neverova, Kristen Grauman, Andrea Vedaldi
2023ICASSPNord: Non-Matching Reference Based Relative Depth Estimation from Binaural Speech.Pranay Manocha, Israel D. Gebru, Anurag Kumar, Dejan Markovic, Alexander Richard
2023ICASSPAudiodec: An Open-Source Streaming High-Fidelity Neural Audio Codec.Yi-Chiao Wu, Israel D. Gebru, Dejan Markovic, Alexander Richard
2023InterspeechSpatialization Quality Metric for Binaural Speech.Pranay Manocha, Israel Dejene Gebru, Anurag Kumar, Dejan Markovic, Alexander Richard
2022CVPRAudio-Visual Speech Codecs: Rethinking Audio-Visual Speech Enhancement by Re-Synthesis.Karren Yang, Dejan Markovic, Steven Krenn, Vasu Agrawal, Alexander Richard
2022ECCVLiP-Flow: Learning Inference-Time Priors for Codec Avatars via Normalizing Flows in Latent Space.Emre Aksan, Shugao Ma, Akin Caliskan, Stanislav Pidhorskyi, Alexander Richard, Shih-En Wei, Jason M. Saragih, Otmar Hilliges
2022ICASSPConditional Diffusion Probabilistic Model for Speech Enhancement.Yen-Ju Lu, Zhong-Qiu Wang, Shinji Watanabe, Alexander Richard, Cheng Yu, Yu Tsao
2022ICASSPDeep Impulse Responses: Estimating and Parameterizing Filters with Deep Networks.Alexander Richard, Peter Sheridan Dodds, Vamsi Krishna Ithapu
2022InterspeechEnd-to-End Binaural Speech Synthesis.Wen-Chin Huang, Dejan Markovic, Alexander Richard, Israel Dejene Gebru, Anjali Menon
2022InterspeechImplicit Neural Spatial Filtering for Multichannel Source Separation in the Waveform Domain.Dejan Markovic, Alexandre Dfossez, Alexander Richard
2021EDUCONBasic Distributed Algorithms Visual Simulations for Distributed Systems Students.Alexander Richard, Jesse Francis, Jalal Kawash
2021ICASSPImplicit HRTF Modeling Using Temporal Convolutional Networks.Israel D. Gebru, Dejan Markovic, Alexander Richard, Steven Krenn, Gladstone Alexander Butler, Fernando De la Torre, Yaser Sheikh
2021ICCVMeshTalk: 3D Face Animation from Speech using Cross-Modality Disentanglement.Alexander Richard, Michael Zollhfer, Yandong Wen, Fernando De la Torre, Yaser Sheikh
2021ICLRNeural Synthesis of Binaural Speech From Mono Audio.Alexander Richard, Dejan Markovic, Israel D. Gebru, Steven Krenn, Gladstone Alexander Butler, Fernando De la Torre, Yaser Sheikh
2021WACVAudio- and Gaze-driven Facial Animation of Codec Avatars.Alexander Richard, Colin Lea, Shugao Ma, Juergen Gall, Fernando De la Torre, Yaser Sheikh
2018CVPRWhen Will You Do What? - Anticipating Temporal Occurrences of Activities.Yazan Abu Farha, Alexander Richard, Juergen Gall
2018CVPRAction Sets: Weakly Supervised Action Segmentation Without Ordering Constraints.Alexander Richard, Hilde Kuehne, Juergen Gall
2018CVPRNeuralNetwork-Viterbi: A Framework for Weakly Supervised Video Learning.Alexander Richard, Hilde Kuehne, Ahsan Iqbal, Juergen Gall
2017CVPRWeakly Supervised Action Learning with RNN Based Fine-to-Coarse Modeling.Alexander Richard, Hilde Kuehne, Juergen Gall
2016CVPRTemporal Action Detection Using a Statistical Language Model.Alexander Richard, Juergen Gall
2015BMVCA BoW-equivalent Recurrent Neural Network for Action Recognition.Alexander Richard, Juergen Gall
2014ICASSPRASR/NN: The RWTH neural network toolkit for speech recognition.Simon Wiesler, Alexander Richard, Pavel Golik, Ralf Schlter, Hermann Ney
2014ICASSPMean-normalized stochastic gradient for large-scale deep learning.Simon Wiesler, Alexander Richard, Ralf Schlter, Hermann Ney
2013ICASSPA critical evaluation of stochastic algorithms for convex optimization.Simon Wiesler, Alexander Richard, Ralf Schlter, Hermann Ney
2011ICASSPFeature selection for log-linear acoustic models.Simon Wiesler, Alexander Richard, Yotaro Kubo, Ralf Schlter, Hermann Ney