Skip to content

Ruohan Gao

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

40

Venues

13

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

40 indexed papers, newest first.

YearVenueTitleAuthors
2026NSDIFlexLLM: Token-Level Co-Serving of LLM Inference and Finetuning with SLO Guarantees.Gabriele Oliaro, Xupeng Miao, Xinhao Cheng, Vineeth Kada, Mengdi Wu, Ruohan Gao, Yingyi Huang, Remi Delacourt, April Yang, Yingcheng Wang, Colin Unger, Zhihao Jia
2025AAAIMultisensory Machine Intelligence.Ruohan Gao
2025CVPRLearning to Highlight Audio by Watching Movies.Chao Huang, Ruohan Gao, J. M. F. Tsang, Jan Kurcius, Cagdas Bilen, Chenliang Xu, Anurag Kumar, Sanjeel Parekh
2025CVPRHearing Anywhere in Any Environment.Xiulong Liu, Anurag Kumar, Paul Calamia, Sebasti Vicenc Amengual Gar, Calvin Murdock, Ishwarya Ananthabhotla, Philip W. Robinson, Eli Shlizerman, Vamsi Krishna Ithapu, Ruohan Gao
2025ICCVEgoAdapt: Adaptive Multisensory Distillation and Policy Learning for Efficient Egocentric Perception.Sanjoy Chowdhury, Subrata Biswas, Sayan Nag, Tushar Nagarajan, Calvin Murdock, Ishwarya Ananthabhotla, Yijun Qian, Vamsi Krishna Ithapu, Dinesh Manocha, Ruohan Gao
2025ICCVAurelia: Test-Time Reasoning Distillation in Audio-Visual LLMs.Sanjoy Chowdhury, Hanan Gani, Nishit Anand, Sayan Nag, Ruohan Gao, Mohamed Elhoseiny, Salman Khan, Dinesh Manocha
2025ICCVAVTrustBench: Assessing and Enhancing Reliability and Robustness in Audio-Visual LLMs.Sanjoy Chowdhury, Sayan Nag, Subhrajyoti Dasgupta, Yaoting Wang, Mohamed Elhoseiny, Ruohan Gao, Dinesh Manocha
2025ICCVDifferentiable Room Acoustic Rendering with Multi-View Vision Priors.Derong Jin, Ruohan Gao
2025ICCVGenFlowRL: Shaping Rewards with Generative Object-Centric Flow in Visual Reinforcement Learning.Kelin Yu, Sheng Zhang, Harshit Soora, Furong Huang, Heng Huang, Pratap Tokekar, Ruohan Gao
2024CVPRThe Audio-Visual Conversational Graph: From an Egocentric-Exocentric Perspective.Wenqi Jia, Miao Liu, Hao Jiang, Ishwarya Ananthabhotla, James M. Rehg, Vamsi Krishna Ithapu, Ruohan Gao
2024CVPRHearing Anything Anywhere.Mason Long Wang, Ryosuke Sawata, Samuel Clarke, Ruohan Gao, Shangzhe Wu, Jiajun Wu
2024ECAIVMFTransformer: An Angle-Preserving and Auto-Scaling Machine for Multi-Horizon Probabilistic Forecasting.Yunyi Zhou, Ruohan Gao, Xinping Zheng, Yuchen Huang, Zhixuan Chu
2024ECCVMEERKAT: Audio-Visual Large Language Model for Grounding in Space and Time.Sanjoy Chowdhury, Sayan Nag, Subhrajyoti Dasgupta, Jun Chen, Mohamed Elhoseiny, Ruohan Gao, Dinesh Manocha
2024ECCVSpherical World-Locking for Audio-Visual Localization in Egocentric Videos.Heeseung Yun, Ruohan Gao, Ishwarya Ananthabhotla, Anurag Kumar, Jacob Donley, Chao Li, Gunhee Kim, Vamsi Krishna Ithapu, Calvin Murdock
2024SIGGRAPHDiffSound: Differentiable Modal Sound Rendering and Inverse Rendering for Diverse Inference Tasks.Xutong Jin, Chenxi Xu, Ruohan Gao, Jiajun Wu, Guoping Wang, Sheng Li
2023CoRLNOIR: Neural Signal Operated Intelligent Robots for Everyday Activities.Ruohan Zhang, Sharon Lee, Minjune Hwang, Ayano Hiranaka, Chen Wang, Wensi Ai, Jin Jie Ryan Tan, Shreya Gupta, Yilun Hao, Gabrael Levine, Ruohan Gao, Anthony Norcia, Li Fei-Fei, Jiajun Wu
2023CVPRREALIMPACT: A Dataset of Impact Sound Fields for Real Objects.Samuel Clarke, Ruohan Gao, Mason L. Wang, Mark Rau, Julia Xu, Jui-Hsien Wang, Doug L. James, Jiajun Wu
2023CVPRThe Object Folder Benchmark : Multisensory Learning with Neural and Real Objects.Ruohan Gao, Yiming Dou, Hao Li, Tanmay Agarwal, Jeannette Bohg, Yunzhu Li, Li Fei-Fei, Jiajun Wu
2023ICLRAn Extensible Multi-modal Multi-task Object Dataset with Materials.Trevor Scott Standley, Ruohan Gao, Dawn Chen, Jiajun Wu, Silvio Savarese
2023ICRASonicverse: A Multisensory Simulation Platform for Embodied Household Agents that See and Hear.Ruohan Gao, Hao Li, Gokul Dharan, Zhuzhu Wang, Chengshu Li, Fei Xia, Silvio Savarese, Li Fei-Fei, Jiajun Wu
2022CoRLSee, Hear, and Feel: Smart Sensory Fusion for Robotic Manipulation.Hao Li, Yizhi Zhang, Junzhe Zhu, Shaoxiong Wang, Michelle A. Lee, Huazhe Xu, Edward H. Adelson, Li Fei-Fei, Ruohan Gao, Jiajun Wu
2022CVPRVisual Acoustic Matching.Changan Chen, Ruohan Gao, Paul Calamia, Kristen Grauman
2022CVPRObjectFolder 2.0: A Multisensory Object Dataset for Sim2Real Transfer.Ruohan Gao, Zilin Si, Yen-Yu Chang, Samuel Clarke, Jeannette Bohg, Li Fei-Fei, Wenzhen Yuan, Jiajun Wu
2021BMVCGeometry-Aware Multi-Task Learning for Binaural Audio Generation from Video.Rishabh Garg, Ruohan Gao, Kristen Grauman
2021CoRLDiffImpact: Differentiable Rendering and Identification of Impact Sounds.Samuel Clarke, Negin Heravi, Mark Rau, Ruohan Gao, Jiajun Wu, Doug L. James, Jeannette Bohg
2021CoRLObjectFolder: A Dataset of Objects with Implicit Visual, Auditory, and Tactile Representations.Ruohan Gao, Yen-Yu Chang, Shivani Mall, Li Fei-Fei, Jiajun Wu
2021CVPRVisualVoice: Audio-Visual Speech Separation With Cross-Modal Consistency.Ruohan Gao, Kristen Grauman
2021ICLRLearning to Set Waypoints for Audio-Visual Navigation.Changan Chen, Sagnik Majumder, Ziad Al-Halah, Ruohan Gao, Santhosh Kumar Ramakrishnan, Kristen Grauman
2020CVPRListen to Look: Action Recognition by Previewing Audio.Ruohan Gao, Tae-Hyun Oh, Kristen Grauman, Lorenzo Torresani
2020ECCVVisualEchoes: Spatial Image Representation Learning Through Echolocation.Ruohan Gao, Changan Chen, Ziad Al-Halah, Carl Schissler, Kristen Grauman
2019CVPR2.5D Visual Sound.Ruohan Gao, Kristen Grauman
2019CVPR2.5D Visual Sound.Ruohan Gao, Kristen Grauman
2019ICCVCo-Separating Sounds of Visual Objects.Ruohan Gao, Kristen Grauman
2018CVPRLearning to Separate Object Sounds by Watching Unlabeled Video.Ruohan Gao, Rogrio Schmidt Feris, Kristen Grauman
2018CVPRIm2Flow: Motion Hallucination From Static Images for Action Recognition.Ruohan Gao, Bo Xiong, Kristen Grauman
2018ECCVLearning to Separate Object Sounds by Watching Unlabeled Video.Ruohan Gao, Rogrio Schmidt Feris, Kristen Grauman
2018ECCVShapeCodes: Self-supervised Feature Learning by Lifting Views to Viewgrids.Dinesh Jayaraman, Ruohan Gao, Kristen Grauman
2017ICCVOn-demand Learning for Deep Image Restoration.Ruohan Gao, Kristen Grauman
2016ACCVObject-Centric Representation Learning from Unlabeled Videos.Ruohan Gao, Dinesh Jayaraman, Kristen Grauman
2015GLOBECOMGraph Property Preservation under Community-Based Sampling.Ruohan Gao, Pili Hu, Wing Cheong Lau