Skip to content

Hilde Kuehne

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

48

Venues

10

Active years

2014–2026

Best venue rank

A*

Where they publish

Papers

48 indexed papers, newest first.

YearVenueTitleAuthors
2026WACVMM-TS: Multi-Modal Temperature and Margin Schedules for Contrastive Learning with Long-Tail Data.Siarhei Sheludzko, Dhimitrios Duka, Bernt Schiele, Hilde Kuehne, Anna Kukleva
2025ASRUOmni-R1: Do You Really Need Audio to Fine-Tune Your Audio LLM?Andrew Rouditchenko, Saurabhchand Bhati, Edson Araujo, Samuel Thomas, Hilde Kuehne, Rogrio Feris, James R. Glass
2025CVPRCAV-MAE Sync: Improving Contrastive Audio-Visual Mask Autoencoders via Fine-Grained Alignment.Edson Araujo, Andrew Rouditchenko, Yuan Gong, Saurabhchand Bhati, Samuel Thomas, Brian Kingsbury, Leonid Karlinsky, Rogrio Feris, James R. Glass, Hilde Kuehne
2025CVPRUnbiasing through Textual Descriptions: Mitigating Representation Bias in Video Benchmarks.Nina Shvetsova, Arsha Nagrani, Bernt Schiele, Hilde Kuehne, Christian Rupprecht
2025CVPRVideoGEM: Training-free Action Grounding in Videos.Felix Vogel, Walid Bousselham, Anna Kukleva, Nina Shvetsova, Hilde Kuehne
2025ICCVLeGrad: An Explainability Method for Vision Transformers via Feature Formation Sensitivity.Walid Bousselham, Angie W. Boggust, Sofian Chaybouti, Hendrik Strobelt, Hilde Kuehne
2025ICCVTeaching VLMs to Localize Specific Objects from In-Context Examples.Sivan Doveh, Nimrod Shabtay, Eli Schwartz, Hilde Kuehne, Raja Giryes, Rogrio Feris, Leonid Karlinsky, James R. Glass, Assaf Arbelle, Shimon Ullman, Muhammad Jehanzeb Mirza
2025ICLRFrchet Wavelet Distance: A Domain-Agnostic Metric for Image Generation.Lokesh Veeramacheneni, Moritz Wolter, Hilde Kuehne, Juergen Gall
2025ICMLCanonical Rank Adaptation: An Efficient Fine-Tuning Strategy for Vision Transformers.Lokesh Veeramacheneni, Moritz Wolter, Hilde Kuehne, Juergen Gall
2024CVPRWhat, When, and Where? Self-Supervised Spatio- Temporal Grounding in Untrimmed Multi-Action Videos from Narrated Instructions.Brian Chen, Nina Shvetsova, Andrew Rouditchenko, Daniel Kondermann, Samuel Thomas, Shih-Fu Chang, Rogrio Feris, James R. Glass, Hilde Kuehne
2024CVPRGrounding Everything: Emerging Localization Properties in Vision-Language Transformers.Walid Bousselham, Felix Petersen, Vittorio Ferrari, Hilde Kuehne
2024ECCVMeta-prompting for Automating Zero-Shot Visual Recognition with LLMs.Muhammad Jehanzeb Mirza, Leonid Karlinsky, Wei Lin, Sivan Doveh, Jakub Micorek, Mateusz Kozinski, Hilde Kuehne, Horst Possegger
2024ECCVHowToCaption: Prompting LLMs to Transform Video Annotations at Scale.Nina Shvetsova, Anna Kukleva, Xudong Hong, Christian Rupprecht, Bernt Schiele, Hilde Kuehne
2024ICLRUncertainty Quantification via Stable Distribution Propagation.Felix Petersen, Aashwin Ananda Mishra, Hilde Kuehne, Christian Borgelt, Oliver Deussen, Mikhail Yurochkin
2024InterspeechWhisper-Flamingo: Integrating Visual Features into Whisper for Audio-Visual Speech Recognition and Translation.Andrew Rouditchenko, Yuan Gong, Samuel Thomas, Leonid Karlinsky, Hilde Kuehne, Rogrio Feris, James Glass
2023CVPRLearning Situation Hyper-Graphs for Video Question Answering.Aisha Urooj Khan, Hilde Kuehne, Bo Wu, Kim Chheu, Walid Bousselham, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2023CVPRVideo Test-Time Adaptation for Action Recognition.Wei Lin, Muhammad Jehanzeb Mirza, Mateusz Kozinski, Horst Possegger, Hilde Kuehne, Horst Bischof
2023ICASSPC2KD: Cross-Lingual Cross-Modal Knowledge Distillation for Multilingual Text-Video Retrieval.Andrew Rouditchenko, Yung-Sung Chuang, Nina Shvetsova, Samuel Thomas, Rogrio Feris, Brian Kingsbury, Leonid Karlinsky, David Harwath, Hilde Kuehne, James R. Glass
2023ICCVMAtch, eXpand and Improve: Unsupervised Finetuning for Zero-Shot Action Recognition with Language Knowledge.Wei Lin, Leonid Karlinsky, Nina Shvetsova, Horst Possegger, Mateusz Kozinski, Rameswar Panda, Rogrio Feris, Hilde Kuehne, Horst Bischof
2023ICCVIn-Style: Bridging Text and Uncurated Videos with Style Transfer for Text-Video Retrieval.Nina Shvetsova, Anna Kukleva, Bernt Schiele, Hilde Kuehne
2023ICCVLearning by Sorting: Self-supervised Learning with Group Ordering Constraints.Nina Shvetsova, Felix Petersen, Anna Kukleva, Bernt Schiele, Hilde Kuehne
2023ICCVPreserving Modality Structure Improves Multi-Modal Learning.Sirnam Swetha, Mamshad Nayeem Rizve, Nina Shvetsova, Hilde Kuehne, Mubarak Shah
2023ICLRContrastive Audio-Visual Masked Autoencoder.Yuan Gong, Andrew Rouditchenko, Alexander H. Liu, David Harwath, Leonid Karlinsky, Hilde Kuehne, James R. Glass
2023ICLRTemperature Schedules for self-supervised contrastive methods on long-tail data.Anna Kukleva, Moritz Bhle, Bernt Schiele, Hilde Kuehne, Christian Rupprecht
2023ICLRISAAC Newton: Input-based Approximate Curvature for Newton's Method.Felix Petersen, Tobias Sutter, Christian Borgelt, Dongsung Huh, Hilde Kuehne, Yuekai Sun, Oliver Deussen
2023InterspeechComparison of Multilingual Self-Supervised and Weakly-Supervised Speech Pre-Training for Adaptation to Unseen Languages.Andrew Rouditchenko, Sameer Khurana, Samuel Thomas, Rogrio Feris, Leonid Karlinsky, Hilde Kuehne, David Harwath, Brian Kingsbury, James R. Glass
2022CVPRUnsupervised Domain Generalization by Learning a Bridge Across Domains.Sivan Harary, Eli Schwartz, Assaf Arbelle, Peter W. J. Staar, Shady Abu-Hussein, Elad Amrani, Roei Herzig, Amit Alfassy, Raja Giryes, Hilde Kuehne, Dina Katabi, Kate Saenko, Rogrio Feris, Leonid Karlinsky
2022CVPREverything at Once - Multi-modal Fusion Transformer for Video Retrieval.Nina Shvetsova, Brian Chen, Andrew Rouditchenko, Samuel Thomas, Brian Kingsbury, Rogrio Feris, David Harwath, James R. Glass, Hilde Kuehne
2022ECCVWeakly Supervised Grounding for VQA in Vision-Language Transformers.Aisha Urooj Khan, Hilde Kuehne, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2022ECCVCycDA: Unsupervised Cycle Domain Adaptation to Learn from Image to Video.Wei Lin, Anna Kukleva, Kunyang Sun, Horst Possegger, Hilde Kuehne, Horst Bischof
2022ICLRMonotonic Differentiable Sorting Networks.Felix Petersen, Christian Borgelt, Hilde Kuehne, Oliver Deussen
2022ICMLDifferentiable Top-k Classification Learning.Felix Petersen, Hilde Kuehne, Christian Borgelt, Oliver Deussen
2022WACVStyle Agnostic 3D Reconstruction via Adversarial Style Transfer.Felix Petersen, Bastian Goldluecke, Oliver Deussen, Hilde Kuehne
2021CVPRFound a Reason for me? Weakly-supervised Grounded Visual Question Answering using Capsules.Aisha Urooj Khan, Hilde Kuehne, Kevin Duarte, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2021ICCVDetector-Free Weakly Supervised Grounding by Separation.Assaf Arbelle, Sivan Doveh, Amit Alfassy, Joseph Shtok, Guy Lev, Eli Schwartz, Hilde Kuehne, Hila Barak Levi, Prasanna Sattigeri, Rameswar Panda, Chun-Fu Chen, Alex M. Bronstein, Kate Saenko, Shimon Ullman, Raja Giryes, Rogrio Feris, Leonid Karlinsky
2021ICCVMultimodal Clustering Networks for Self-supervised Learning from Unlabeled Videos.Brian Chen, Andrew Rouditchenko, Kevin Duarte, Hilde Kuehne, Samuel Thomas, Angie W. Boggust, Rameswar Panda, Brian Kingsbury, Rogrio Feris, David Harwath, James R. Glass, Michael Picheny, Shih-Fu Chang
2021ICCVGeneralized and Incremental Few-Shot Learning by Explicit Learning and Calibration without Forgetting.Anna Kukleva, Hilde Kuehne, Bernt Schiele
2021ICIPUnsupervised Discriminative Embedding For Sub-Action Learning in Complex Activities.Sirnam Swetha, Hilde Kuehne, Yogesh S. Rawat, Mubarak Shah
2021ICMLDifferentiable Sorting Networks for Scalable Sorting and Ranking Supervision.Felix Petersen, Christian Borgelt, Hilde Kuehne, Oliver Deussen
2021InterspeechCascaded Multilingual Audio-Visual Learning from Videos.Andrew Rouditchenko, Angie W. Boggust, David Harwath, Samuel Thomas, Hilde Kuehne, Brian Chen, Rameswar Panda, Rogrio Feris, Brian Kingsbury, Michael Picheny, James R. Glass
2021InterspeechAVLnet: Learning Audio-Visual Language Representations from Instructional Videos.Andrew Rouditchenko, Angie W. Boggust, David Harwath, Brian Chen, Dhiraj Joshi, Samuel Thomas, Kartik Audhkhasi, Hilde Kuehne, Rameswar Panda, Rogrio Schmidt Feris, Brian Kingsbury, Michael Picheny, Antonio Torralba, James R. Glass
2021WACVJoint Visual-Temporal Embedding for Unsupervised Learning of Actions in Untrimmed Sequences.Rosaura G. VidalMata, Walter J. Scheirer, Anna Kukleva, David D. Cox, Hilde Kuehne
2019CVPRUnsupervised Learning of Action Classes With Continuous Temporal Embedding.Anna Kukleva, Hilde Kuehne, Fadime Sener, Jrgen Gall
2018CVPRAction Sets: Weakly Supervised Action Segmentation Without Ordering Constraints.Alexander Richard, Hilde Kuehne, Juergen Gall
2018CVPRNeuralNetwork-Viterbi: A Framework for Weakly Supervised Video Learning.Alexander Richard, Hilde Kuehne, Ahsan Iqbal, Juergen Gall
2017CVPRWeakly Supervised Action Learning with RNN Based Fine-to-Coarse Modeling.Alexander Richard, Hilde Kuehne, Juergen Gall
2016WACVAn end-to-end generative framework for video segmentation and recognition.Hilde Kuehne, Juergen Gall, Thomas Serre
2014CVPRThe Language of Actions: Recovering the Syntax and Semantics of Goal-Directed Human Activities.Hilde Kuehne, Ali Bilgin Arslan, Thomas Serre