Hilde Kuehne
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
48
Venues
10
Active years
2014–2026
Best venue rank
A*
Where they publish
Papers
48 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | WACV | MM-TS: Multi-Modal Temperature and Margin Schedules for Contrastive Learning with Long-Tail Data. | Siarhei Sheludzko, Dhimitrios Duka, Bernt Schiele, Hilde Kuehne, Anna Kukleva |
| 2025 | ASRU | Omni-R1: Do You Really Need Audio to Fine-Tune Your Audio LLM? | Andrew Rouditchenko, Saurabhchand Bhati, Edson Araujo, Samuel Thomas, Hilde Kuehne, Rogrio Feris, James R. Glass |
| 2025 | CVPR | CAV-MAE Sync: Improving Contrastive Audio-Visual Mask Autoencoders via Fine-Grained Alignment. | Edson Araujo, Andrew Rouditchenko, Yuan Gong, Saurabhchand Bhati, Samuel Thomas, Brian Kingsbury, Leonid Karlinsky, Rogrio Feris, James R. Glass, Hilde Kuehne |
| 2025 | CVPR | Unbiasing through Textual Descriptions: Mitigating Representation Bias in Video Benchmarks. | Nina Shvetsova, Arsha Nagrani, Bernt Schiele, Hilde Kuehne, Christian Rupprecht |
| 2025 | CVPR | VideoGEM: Training-free Action Grounding in Videos. | Felix Vogel, Walid Bousselham, Anna Kukleva, Nina Shvetsova, Hilde Kuehne |
| 2025 | ICCV | LeGrad: An Explainability Method for Vision Transformers via Feature Formation Sensitivity. | Walid Bousselham, Angie W. Boggust, Sofian Chaybouti, Hendrik Strobelt, Hilde Kuehne |
| 2025 | ICCV | Teaching VLMs to Localize Specific Objects from In-Context Examples. | Sivan Doveh, Nimrod Shabtay, Eli Schwartz, Hilde Kuehne, Raja Giryes, Rogrio Feris, Leonid Karlinsky, James R. Glass, Assaf Arbelle, Shimon Ullman, Muhammad Jehanzeb Mirza |
| 2025 | ICLR | Frchet Wavelet Distance: A Domain-Agnostic Metric for Image Generation. | Lokesh Veeramacheneni, Moritz Wolter, Hilde Kuehne, Juergen Gall |
| 2025 | ICML | Canonical Rank Adaptation: An Efficient Fine-Tuning Strategy for Vision Transformers. | Lokesh Veeramacheneni, Moritz Wolter, Hilde Kuehne, Juergen Gall |
| 2024 | CVPR | What, When, and Where? Self-Supervised Spatio- Temporal Grounding in Untrimmed Multi-Action Videos from Narrated Instructions. | Brian Chen, Nina Shvetsova, Andrew Rouditchenko, Daniel Kondermann, Samuel Thomas, Shih-Fu Chang, Rogrio Feris, James R. Glass, Hilde Kuehne |
| 2024 | CVPR | Grounding Everything: Emerging Localization Properties in Vision-Language Transformers. | Walid Bousselham, Felix Petersen, Vittorio Ferrari, Hilde Kuehne |
| 2024 | ECCV | Meta-prompting for Automating Zero-Shot Visual Recognition with LLMs. | Muhammad Jehanzeb Mirza, Leonid Karlinsky, Wei Lin, Sivan Doveh, Jakub Micorek, Mateusz Kozinski, Hilde Kuehne, Horst Possegger |
| 2024 | ECCV | HowToCaption: Prompting LLMs to Transform Video Annotations at Scale. | Nina Shvetsova, Anna Kukleva, Xudong Hong, Christian Rupprecht, Bernt Schiele, Hilde Kuehne |
| 2024 | ICLR | Uncertainty Quantification via Stable Distribution Propagation. | Felix Petersen, Aashwin Ananda Mishra, Hilde Kuehne, Christian Borgelt, Oliver Deussen, Mikhail Yurochkin |
| 2024 | Interspeech | Whisper-Flamingo: Integrating Visual Features into Whisper for Audio-Visual Speech Recognition and Translation. | Andrew Rouditchenko, Yuan Gong, Samuel Thomas, Leonid Karlinsky, Hilde Kuehne, Rogrio Feris, James Glass |
| 2023 | CVPR | Learning Situation Hyper-Graphs for Video Question Answering. | Aisha Urooj Khan, Hilde Kuehne, Bo Wu, Kim Chheu, Walid Bousselham, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah |
| 2023 | CVPR | Video Test-Time Adaptation for Action Recognition. | Wei Lin, Muhammad Jehanzeb Mirza, Mateusz Kozinski, Horst Possegger, Hilde Kuehne, Horst Bischof |
| 2023 | ICASSP | C2KD: Cross-Lingual Cross-Modal Knowledge Distillation for Multilingual Text-Video Retrieval. | Andrew Rouditchenko, Yung-Sung Chuang, Nina Shvetsova, Samuel Thomas, Rogrio Feris, Brian Kingsbury, Leonid Karlinsky, David Harwath, Hilde Kuehne, James R. Glass |
| 2023 | ICCV | MAtch, eXpand and Improve: Unsupervised Finetuning for Zero-Shot Action Recognition with Language Knowledge. | Wei Lin, Leonid Karlinsky, Nina Shvetsova, Horst Possegger, Mateusz Kozinski, Rameswar Panda, Rogrio Feris, Hilde Kuehne, Horst Bischof |
| 2023 | ICCV | In-Style: Bridging Text and Uncurated Videos with Style Transfer for Text-Video Retrieval. | Nina Shvetsova, Anna Kukleva, Bernt Schiele, Hilde Kuehne |
| 2023 | ICCV | Learning by Sorting: Self-supervised Learning with Group Ordering Constraints. | Nina Shvetsova, Felix Petersen, Anna Kukleva, Bernt Schiele, Hilde Kuehne |
| 2023 | ICCV | Preserving Modality Structure Improves Multi-Modal Learning. | Sirnam Swetha, Mamshad Nayeem Rizve, Nina Shvetsova, Hilde Kuehne, Mubarak Shah |
| 2023 | ICLR | Contrastive Audio-Visual Masked Autoencoder. | Yuan Gong, Andrew Rouditchenko, Alexander H. Liu, David Harwath, Leonid Karlinsky, Hilde Kuehne, James R. Glass |
| 2023 | ICLR | Temperature Schedules for self-supervised contrastive methods on long-tail data. | Anna Kukleva, Moritz Bhle, Bernt Schiele, Hilde Kuehne, Christian Rupprecht |
| 2023 | ICLR | ISAAC Newton: Input-based Approximate Curvature for Newton's Method. | Felix Petersen, Tobias Sutter, Christian Borgelt, Dongsung Huh, Hilde Kuehne, Yuekai Sun, Oliver Deussen |
| 2023 | Interspeech | Comparison of Multilingual Self-Supervised and Weakly-Supervised Speech Pre-Training for Adaptation to Unseen Languages. | Andrew Rouditchenko, Sameer Khurana, Samuel Thomas, Rogrio Feris, Leonid Karlinsky, Hilde Kuehne, David Harwath, Brian Kingsbury, James R. Glass |
| 2022 | CVPR | Unsupervised Domain Generalization by Learning a Bridge Across Domains. | Sivan Harary, Eli Schwartz, Assaf Arbelle, Peter W. J. Staar, Shady Abu-Hussein, Elad Amrani, Roei Herzig, Amit Alfassy, Raja Giryes, Hilde Kuehne, Dina Katabi, Kate Saenko, Rogrio Feris, Leonid Karlinsky |
| 2022 | CVPR | Everything at Once - Multi-modal Fusion Transformer for Video Retrieval. | Nina Shvetsova, Brian Chen, Andrew Rouditchenko, Samuel Thomas, Brian Kingsbury, Rogrio Feris, David Harwath, James R. Glass, Hilde Kuehne |
| 2022 | ECCV | Weakly Supervised Grounding for VQA in Vision-Language Transformers. | Aisha Urooj Khan, Hilde Kuehne, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah |
| 2022 | ECCV | CycDA: Unsupervised Cycle Domain Adaptation to Learn from Image to Video. | Wei Lin, Anna Kukleva, Kunyang Sun, Horst Possegger, Hilde Kuehne, Horst Bischof |
| 2022 | ICLR | Monotonic Differentiable Sorting Networks. | Felix Petersen, Christian Borgelt, Hilde Kuehne, Oliver Deussen |
| 2022 | ICML | Differentiable Top-k Classification Learning. | Felix Petersen, Hilde Kuehne, Christian Borgelt, Oliver Deussen |
| 2022 | WACV | Style Agnostic 3D Reconstruction via Adversarial Style Transfer. | Felix Petersen, Bastian Goldluecke, Oliver Deussen, Hilde Kuehne |
| 2021 | CVPR | Found a Reason for me? Weakly-supervised Grounded Visual Question Answering using Capsules. | Aisha Urooj Khan, Hilde Kuehne, Kevin Duarte, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah |
| 2021 | ICCV | Detector-Free Weakly Supervised Grounding by Separation. | Assaf Arbelle, Sivan Doveh, Amit Alfassy, Joseph Shtok, Guy Lev, Eli Schwartz, Hilde Kuehne, Hila Barak Levi, Prasanna Sattigeri, Rameswar Panda, Chun-Fu Chen, Alex M. Bronstein, Kate Saenko, Shimon Ullman, Raja Giryes, Rogrio Feris, Leonid Karlinsky |
| 2021 | ICCV | Multimodal Clustering Networks for Self-supervised Learning from Unlabeled Videos. | Brian Chen, Andrew Rouditchenko, Kevin Duarte, Hilde Kuehne, Samuel Thomas, Angie W. Boggust, Rameswar Panda, Brian Kingsbury, Rogrio Feris, David Harwath, James R. Glass, Michael Picheny, Shih-Fu Chang |
| 2021 | ICCV | Generalized and Incremental Few-Shot Learning by Explicit Learning and Calibration without Forgetting. | Anna Kukleva, Hilde Kuehne, Bernt Schiele |
| 2021 | ICIP | Unsupervised Discriminative Embedding For Sub-Action Learning in Complex Activities. | Sirnam Swetha, Hilde Kuehne, Yogesh S. Rawat, Mubarak Shah |
| 2021 | ICML | Differentiable Sorting Networks for Scalable Sorting and Ranking Supervision. | Felix Petersen, Christian Borgelt, Hilde Kuehne, Oliver Deussen |
| 2021 | Interspeech | Cascaded Multilingual Audio-Visual Learning from Videos. | Andrew Rouditchenko, Angie W. Boggust, David Harwath, Samuel Thomas, Hilde Kuehne, Brian Chen, Rameswar Panda, Rogrio Feris, Brian Kingsbury, Michael Picheny, James R. Glass |
| 2021 | Interspeech | AVLnet: Learning Audio-Visual Language Representations from Instructional Videos. | Andrew Rouditchenko, Angie W. Boggust, David Harwath, Brian Chen, Dhiraj Joshi, Samuel Thomas, Kartik Audhkhasi, Hilde Kuehne, Rameswar Panda, Rogrio Schmidt Feris, Brian Kingsbury, Michael Picheny, Antonio Torralba, James R. Glass |
| 2021 | WACV | Joint Visual-Temporal Embedding for Unsupervised Learning of Actions in Untrimmed Sequences. | Rosaura G. VidalMata, Walter J. Scheirer, Anna Kukleva, David D. Cox, Hilde Kuehne |
| 2019 | CVPR | Unsupervised Learning of Action Classes With Continuous Temporal Embedding. | Anna Kukleva, Hilde Kuehne, Fadime Sener, Jrgen Gall |
| 2018 | CVPR | Action Sets: Weakly Supervised Action Segmentation Without Ordering Constraints. | Alexander Richard, Hilde Kuehne, Juergen Gall |
| 2018 | CVPR | NeuralNetwork-Viterbi: A Framework for Weakly Supervised Video Learning. | Alexander Richard, Hilde Kuehne, Ahsan Iqbal, Juergen Gall |
| 2017 | CVPR | Weakly Supervised Action Learning with RNN Based Fine-to-Coarse Modeling. | Alexander Richard, Hilde Kuehne, Juergen Gall |
| 2016 | WACV | An end-to-end generative framework for video segmentation and recognition. | Hilde Kuehne, Juergen Gall, Thomas Serre |
| 2014 | CVPR | The Language of Actions: Recovering the Syntax and Semantics of Goal-Directed Human Activities. | Hilde Kuehne, Ali Bilgin Arslan, Thomas Serre |