Ruohan Gao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
40
Venues
13
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
40 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | NSDI | FlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees. | Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia |
| 2025 | AAAI | Multisensory Machine Intelligence. | Ruohan Gao |
| 2025 | CVPR | Learning to Highlight Audio by Watching Movies. | Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh |
| 2025 | CVPR | Hearing Anywhere in Any Environment. | Xiulong Liu, Anurag Kumar, Paul Calamia, Sebasti Vicenc Amengual Gar, Calvin Murdock, Ishwarya Ananthabhotla, Philip W. Robinson, Eli Shlizerman, Vamsi Krishna Ithapu, Ruohan Gao |
| 2025 | ICCV | EgoAdapt: Adaptive Multisensory Distillation and Policy Learning for Efficient Egocentric Perception. | Sanjoy Chowdhury, Subrata Biswas, Sayan Nag, Tushar Nagarajan, Calvin Murdock, Ishwarya Ananthabhotla, Yijun Qian, Vamsi Krishna Ithapu, Dinesh Manocha, Ruohan Gao |
| 2025 | ICCV | Aurelia: Test-Time Reasoning Distillation in Audio-Visual LLMs. | Sanjoy Chowdhury, Hanan Gani, Nishit Anand, Sayan Nag, Ruohan Gao, Mohamed Elhoseiny, Salman Khan, Dinesh Manocha |
| 2025 | ICCV | AVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs. | Sanjoy Chowdhury, Sayan Nag, Subhrajyoti Dasgupta, Yaoting Wang, Mohamed Elhoseiny, Ruohan Gao, Dinesh Manocha |
| 2025 | ICCV | Differentiable Room Acoustic Rendering with Multi-View Vision Priors. | Derong Jin, Ruohan Gao |
| 2025 | ICCV | GenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning. | Kelin Yu, Sheng Zhang, Harshit Soora, Furong Huang, Heng Huang, Pratap Tokekar, Ruohan Gao |
| 2024 | CVPR | The Audio-Visual Conversational Graph: From an Egocentric-Exocentric Perspective. | Wenqi Jia, Miao Liu, Hao Jiang, Ishwarya Ananthabhotla, James M. Rehg, Vamsi Krishna Ithapu, Ruohan Gao |
| 2024 | CVPR | Hearing Anything Anywhere. | Mason Long Wang, Ryosuke Sawata, Samuel Clarke, Ruohan Gao, Shangzhe Wu, Jiajun Wu |
| 2024 | ECAI | VMFTransformer: An Angle-Preserving and Auto-Scaling Machine for Multi-Horizon Probabilistic Forecasting. | Yunyi Zhou, Ruohan Gao, Xinping Zheng, Yuchen Huang, Zhixuan Chu |
| 2024 | ECCV | MEERKAT: Audio-Visual Large Language Model for Grounding in Space and Time. | Sanjoy Chowdhury, Sayan Nag, Subhrajyoti Dasgupta, Jun Chen, Mohamed Elhoseiny, Ruohan Gao, Dinesh Manocha |
| 2024 | ECCV | Spherical World-Locking for Audio-Visual Localization in Egocentric Videos. | Heeseung Yun, Ruohan Gao, Ishwarya Ananthabhotla, Anurag Kumar, Jacob Donley, Chao Li, Gunhee Kim, Vamsi Krishna Ithapu, Calvin Murdock |
| 2024 | SIGGRAPH | DiffSound: Differentiable Modal Sound Rendering and Inverse Rendering for Diverse Inference Tasks. | Xutong Jin, Chenxi Xu, Ruohan Gao, Jiajun Wu, Guoping Wang, Sheng Li |
| 2023 | CoRL | NOIR: Neural Signal Operated Intelligent Robots for Everyday Activities. | Ruohan Zhang, Sharon Lee, Minjune Hwang, Ayano Hiranaka, Chen Wang, Wensi Ai, Jin Jie Ryan Tan, Shreya Gupta, Yilun Hao, Gabrael Levine, Ruohan Gao, Anthony Norcia, Li Fei-Fei, Jiajun Wu |
| 2023 | CVPR | REALIMPACT: A Dataset of Impact Sound Fields for Real Objects. | Samuel Clarke, Ruohan Gao, Mason L. Wang, Mark Rau, Julia Xu, Jui-Hsien Wang, Doug L. James, Jiajun Wu |
| 2023 | CVPR | The Object Folder Benchmark : Multisensory Learning with Neural and Real Objects. | Ruohan Gao, Yiming Dou, Hao Li, Tanmay Agarwal, Jeannette Bohg, Yunzhu Li, Li Fei-Fei, Jiajun Wu |
| 2023 | ICLR | An Extensible Multi-modal Multi-task Object Dataset with Materials. | Trevor Scott Standley, Ruohan Gao, Dawn Chen, Jiajun Wu, Silvio Savarese |
| 2023 | ICRA | Sonicverse: A Multisensory Simulation Platform for Embodied Household Agents that See and Hear. | Ruohan Gao, Hao Li, Gokul Dharan, Zhuzhu Wang, Chengshu Li, Fei Xia, Silvio Savarese, Li Fei-Fei, Jiajun Wu |
| 2022 | CoRL | See, Hear, and Feel: Smart Sensory Fusion for Robotic Manipulation. | Hao Li, Yizhi Zhang, Junzhe Zhu, Shaoxiong Wang, Michelle A. Lee, Huazhe Xu, Edward H. Adelson, Li Fei-Fei, Ruohan Gao, Jiajun Wu |
| 2022 | CVPR | Visual Acoustic Matching. | Changan Chen, Ruohan Gao, Paul Calamia, Kristen Grauman |
| 2022 | CVPR | ObjectFolder 2.0: A Multisensory Object Dataset for Sim2Real Transfer. | Ruohan Gao, Zilin Si, Yen-Yu Chang, Samuel Clarke, Jeannette Bohg, Li Fei-Fei, Wenzhen Yuan, Jiajun Wu |
| 2021 | BMVC | Geometry-Aware Multi-Task Learning for Binaural Audio Generation from Video. | Rishabh Garg, Ruohan Gao, Kristen Grauman |
| 2021 | CoRL | DiffImpact: Differentiable Rendering and Identification of Impact Sounds. | Samuel Clarke, Negin Heravi, Mark Rau, Ruohan Gao, Jiajun Wu, Doug L. James, Jeannette Bohg |
| 2021 | CoRL | ObjectFolder: A Dataset of Objects with Implicit Visual, Auditory, and Tactile Representations. | Ruohan Gao, Yen-Yu Chang, Shivani Mall, Li Fei-Fei, Jiajun Wu |
| 2021 | CVPR | VisualVoice: Audio-Visual Speech Separation With Cross-Modal Consistency. | Ruohan Gao, Kristen Grauman |
| 2021 | ICLR | Learning to Set Waypoints for Audio-Visual Navigation. | Changan Chen, Sagnik Majumder, Ziad Al-Halah, Ruohan Gao, Santhosh Kumar Ramakrishnan, Kristen Grauman |
| 2020 | CVPR | Listen to Look: Action Recognition by Previewing Audio. | Ruohan Gao, Tae-Hyun Oh, Kristen Grauman, Lorenzo Torresani |
| 2020 | ECCV | VisualEchoes: Spatial Image Representation Learning Through Echolocation. | Ruohan Gao, Changan Chen, Ziad Al-Halah, Carl Schissler, Kristen Grauman |
| 2019 | CVPR | 2.5D Visual Sound. | Ruohan Gao, Kristen Grauman |
| 2019 | CVPR | 2.5D Visual Sound. | Ruohan Gao, Kristen Grauman |
| 2019 | ICCV | Co-Separating Sounds of Visual Objects. | Ruohan Gao, Kristen Grauman |
| 2018 | CVPR | Learning to Separate Object Sounds by Watching Unlabeled Video. | Ruohan Gao, Rogrio Schmidt Feris, Kristen Grauman |
| 2018 | CVPR | Im2Flow: Motion Hallucination From Static Images for Action Recognition. | Ruohan Gao, Bo Xiong, Kristen Grauman |
| 2018 | ECCV | Learning to Separate Object Sounds by Watching Unlabeled Video. | Ruohan Gao, Rogrio Schmidt Feris, Kristen Grauman |
| 2018 | ECCV | ShapeCodes: Self-supervised Feature Learning by Lifting Views to Viewgrids. | Dinesh Jayaraman, Ruohan Gao, Kristen Grauman |
| 2017 | ICCV | On-demand Learning for Deep Image Restoration. | Ruohan Gao, Kristen Grauman |
| 2016 | ACCV | Object-Centric Representation Learning from Unlabeled Videos. | Ruohan Gao, Dinesh Jayaraman, Kristen Grauman |
| 2015 | GLOBECOM | Graph Property Preservation under Community-Based Sampling. | Ruohan Gao, Pili Hu, Wing Cheong Lau |