Juan Carlos Niebles
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
89
Venues
16
Active years
2006–2025
Best venue rank
A*
Where they publish
Papers
89 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | ACL | LAM SIMULATOR: Advancing Data Generation for Large Action Model Training via Online Exploration and Trajectory Feedback. | Thai Quoc Hoang, Kung-Hsiang Huang, Shirley Kokane, Jianguo Zhang, Zuxin Liu, Ming Zhu, Jake Grigsby, Tian Lan, Michael S. Ryoo, Chien-Sheng Wu, Shelby Heinecke, Huan Wang, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2025 | CVPR | ViUniT: Visual Unit Tests for More Robust Visual Programming. | Artemis Panagopoulou, Honglu Zhou, Silvio Savarese, Caiming Xiong, Chris Callison-Burch, Mark Yatskar, Juan Carlos Niebles |
| 2025 | CVPR | AdaVid: Adaptive Video-Language Pretraining. | Chaitanya Patel, Juan Carlos Niebles, Ehsan Adeli |
| 2025 | CVPR | Re-thinking Temporal Search for Long-Form Video Understanding. | Jinhui Ye, Zihan Wang, Haosen Sun, Keshigeyan Chandrasegaran, Zane Durante, Cristbal Eyzaguirre, Yonatan Bisk, Juan Carlos Niebles, Ehsan Adeli, Li Fei-Fei, Jiajun Wu, Manling Li |
| 2025 | EMNLP | LATTE: Learning to Think with Vision Specialists. | Zixian Ma, Jianguo Zhang, Zhiwei Liu, Jieyu Zhang, Juntao Tan, Manli Shu, Juan Carlos Niebles, Shelby Heinecke, Huan Wang, Caiming Xiong, Ranjay Krishna, Silvio Savarese |
| 2025 | EMNLP | Contra4: Evaluating Contrastive Cross-Modal Reasoning in Audio, Video, Image, and 3D. | Artemis Panagopoulou, Le Xue, Honglu Zhou, Silvio Savarese, Ran Xu, Caiming Xiong, Chris Callison-Burch, Mark Yatskar, Juan Carlos Niebles |
| 2025 | EMNLP | ActionStudio: A Lightweight Framework for Data and Training of Large Action Models. | Jianguo Zhang, Thai Hoang, Ming Zhu, Zuxin Liu, Shiyu Wang, Tulika Awalgaonkar, Akshara Prabhakar, Haolin Chen, Weiran Yao, Zhiwei Liu, Juntao Tan, Juan Carlos Niebles, Shelby Heinecke, Huan Wang, Silvio Savarese, Caiming Xiong |
| 2025 | ICCV | UniEgoMotion: A Unified Model for Egocentric Motion Reconstruction, Forecasting, and Generation. | Chaitanya Patel, Hiroki Nakamura, Yuta Kyuragi, Kazuki Kozuka, Juan Carlos Niebles, Ehsan Adeli |
| 2025 | ICCV | BLIP-3: A Family of Open Large Multimodal Models. | Le Xue, Manli Shu, Anas Awadalla, Jun Wang, An Yan, Senthil Purushwalkam, Honglu Zhou, Viraj Prabhu, Yutong Dai, Michael S. Ryoo, Shrikant Kendre, Jieyu Zhang, Shao-Yen Tseng, Gustavo A. Lujan-Moreno, Matthew L. Olson, Musashi Hinck, David Cobbley, Vasudev Lal, Can Qin, Shu Zhang, Chia-Chih Chen, Ning Yu, Juntao Tan, Tulika Manoj Awalgaonkar, Shelby Heinecke, Huan Wang, Yejin Choi, Ludwig Schmidt, Zeyuan Chen, Silvio Savarese, Juan Carlos Niebles, Caiming Xiong, Ran Xu |
| 2025 | ICCV | Strefer: Empowering Video LLMs with Space-Time Referring and Reasoning via Synthetic Instruction Data. | Honglu Zhou, Xiangyu Peng, Shrikant Kendre, Michael S. Ryoo, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2025 | ICML | Why Is Spatial Reasoning Hard for VLMs? An Attention Mechanism Perspective on Focus Areas. | Shiqi Chen, Tongyao Zhu, Ruochen Zhou, Jinghan Zhang, Siyang Gao, Juan Carlos Niebles, Mor Geva, Junxian He, Jiajun Wu, Manling Li |
| 2025 | ICML | Unifying Specialized Visual Encoders for Video Language Models. | Jihoon Chung, Tyler Zhu, Max Gonzalez Saez-Diez, Juan Carlos Niebles, Honglu Zhou, Olga Russakovsky |
| 2025 | ICML | Understanding Complexity in VideoQA via Visual Program Generation. | Cristbal Eyzaguirre, Igor Vasiljevic, Achal Dave, Jiajun Wu, Rares Andrei Ambrus, Thomas Kollar, Juan Carlos Niebles, Pavel Tokmakov |
| 2025 | NAACL | xLAM: A Family of Large Action Models to Empower AI Agent Systems. | Jianguo Zhang, Tian Lan, Ming Zhu, Zuxin Liu, Thai Hoang, Shirley Kokane, Weiran Yao, Juntao Tan, Akshara Prabhakar, Haolin Chen, Zhiwei Liu, Yihao Feng, Tulika Manoj Awalgaonkar, Rithesh R. N., Zeyuan Chen, Ran Xu, Juan Carlos Niebles, Shelby Heinecke, Huan Wang, Silvio Savarese, Caiming Xiong |
| 2024 | CVPR | ULIP-2: Towards Scalable Multimodal Pre-Training for 3D Understanding. | Le Xue, Ning Yu, Shu Zhang, Artemis Panagopoulou, Junnan Li, Roberto Martn-Martn, Jiajun Wu, Caiming Xiong, Ran Xu, Juan Carlos Niebles, Silvio Savarese |
| 2024 | ECCV | X-InstructBLIP: A Framework for Aligning Image, 3D, Audio, Video to LLMs and its Emergent Cross-Modal Reasoning. | Artemis Panagopoulou, Le Xue, Ning Yu, Junnan Li, Dongxu Li, Shafiq Joty, Ran Xu, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2024 | ECCV | xGen-VideoSyn-1: High-Fidelity Text-to-Video Synthesis with Compressed Representations. | Can Qin, Congying Xia, Krithika Ramakrishnan, Michael S. Ryoo, Lifu Tu, Yihao Feng, Manli Shu, Honglu Zhou, Anas Awadalla, Jun Wang, Senthil Purushwalkam, Le Xue, Yingbo Zhou, Huan Wang, Silvio Savarese, Juan Carlos Niebles, Zeyuan Chen, Ran Xu, Caiming Xiong |
| 2024 | ECCV | LayoutDETR: Detection Transformer Is a Good Multimodal Layout Designer. | Ning Yu, Chia-Chih Chen, Zeyuan Chen, Rui Meng, Gang Wu, Paul Josel, Juan Carlos Niebles, Caiming Xiong, Ran Xu |
| 2024 | ICLR | Retroformer: Retrospective Large Language Agents with Policy Gradient Optimization. | Weiran Yao, Shelby Heinecke, Juan Carlos Niebles, Zhiwei Liu, Yihao Feng, Le Xue, Rithesh R. N., Zeyuan Chen, Jianguo Zhang, Devansh Arpit, Ran Xu, Phil Mui, Huan Wang, Caiming Xiong, Silvio Savarese |
| 2024 | ICRA | Hierarchical Point Attention for Indoor 3D Object Detection. | Manli Shu, Le Xue, Ning Yu, Roberto Martn-Martn, Caiming Xiong, Tom Goldstein, Juan Carlos Niebles, Ran Xu |
| 2023 | CVPR | Mask-Free OVIS: Open-Vocabulary Instance Segmentation without Manual Mask Annotations. | Vibashan VS, Ning Yu, Chen Xing, Can Qin, Mingfei Gao, Juan Carlos Niebles, Vishal M. Patel, Ran Xu |
| 2023 | CVPR | ULIP: Learning a Unified Representation of Language, Images, and Point Clouds for 3D Understanding. | Le Xue, Mingfei Gao, Chen Xing, Roberto Martn-Martn, Jiajun Wu, Caiming Xiong, Ran Xu, Juan Carlos Niebles, Silvio Savarese |
| 2023 | CVPR | Procedure-Aware Pretraining for Instructional Video Understanding. | Honglu Zhou, Roberto Martn-Martn, Mubbasir Kapadia, Silvio Savarese, Juan Carlos Niebles |
| 2023 | ICCV | Deformer: Dynamic Fusion Transformer for Robust Hand Pose Estimation. | Qichen Fu, Xingyu Liu, Ran Xu, Juan Carlos Niebles, Kris M. Kitani |
| 2023 | WACV | PreViTS: Contrastive Pretraining with Video Tracking Supervision. | Brian Chen, Ramprasaath R. Selvaraju, Shih-Fu Chang, Juan Carlos Niebles, Nikhil Naik |
| 2022 | CVPR | Revisiting the "Video" in Video-Language Understanding. | Shyamal Buch, Cristbal Eyzaguirre, Adrien Gaidon, Jiajun Wu, Li Fei-Fei, Juan Carlos Niebles |
| 2022 | CVPR | Align and Prompt: Video-and-Language Pre-training with Entity Prompts. | Dongxu Li, Junnan Li, Hongdong Li, Juan Carlos Niebles, Steven C. H. Hoi |
| 2022 | ECCV | Open Vocabulary Object Detection with Pseudo Bounding-Box Labels. | Mingfei Gao, Chen Xing, Juan Carlos Niebles, Junnan Li, Ran Xu, Wenhao Liu, Caiming Xiong |
| 2022 | ECCV | PrivHAR: Recognizing Human Actions from Privacy-Preserving Lens. | Carlos Hinojosa, Miguel Marquez, Henry Arguello, Ehsan Adeli, Li Fei-Fei, Juan Carlos Niebles |
| 2022 | ECCV | Identifying Auxiliary or Adversarial Tasks Using Necessary Condition Analysis for Adversarial Multi-task Video Understanding. | Stephen Su, Samuel Kwong, Qingyu Zhao, De-An Huang, Juan Carlos Niebles, Ehsan Adeli |
| 2021 | BMVC | TNT: Text-Conditioned Network with Transductive Inference for Few-Shot Video Classification. | Andrs Villa, Juan-Manuel Prez-Ra, Vladimir Araujo, Juan Carlos Niebles, Victor Escorcia, Alvaro Soto |
| 2021 | CVPR | Metadata Normalization. | Mandy Lu, Qingyu Zhao, Jiequan Zhang, Kilian M. Pohl, Li Fei-Fei, Juan Carlos Niebles, Ehsan Adeli |
| 2021 | CVPR | CoCon: Cooperative-Contrastive Learning. | Nishant Rai, Ehsan Adeli, Kuan-Hui Lee, Adrien Gaidon, Juan Carlos Niebles |
| 2021 | CVPR | Home Action Genome: Cooperative Compositional Action Understanding. | Nishant Rai, Haofeng Chen, Jingwei Ji, Rishi Desai, Kazuki Kozuka, Shun Ishizaka, Ehsan Adeli, Juan Carlos Niebles |
| 2021 | ICCV | TRiPOD: Human Trajectory and Pose Dynamics Forecasting in the Wild. | Vida Adeli, Mahsa Ehsanpour, Ian D. Reid, Juan Carlos Niebles, Silvio Savarese, Ehsan Adeli, Hamid Rezatofighi |
| 2021 | ICCV | Learning Privacy-preserving Optics for Human Pose Estimation. | Carlos Hinojosa, Juan Carlos Niebles, Henry Arguello |
| 2021 | ICCV | Detecting Human-Object Relationships in Videos. | Jingwei Ji, Rishi Desai, Juan Carlos Niebles |
| 2021 | WACV | Representation Learning with Statistical Independence to Mitigate Bias. | Ehsan Adeli-Mosabbeb, Qingyu Zhao, Adolf Pfefferbaum, Edith V. Sullivan, Li Fei-Fei, Juan Carlos Niebles, Kilian M. Pohl |
| 2020 | AAAI | Adversarial Cross-Domain Action Recognition with Co-Attention. | Boxiao Pan, Zhangjie Cao, Ehsan Adeli, Juan Carlos Niebles |
| 2020 | CVPR | Few-Shot Video Classification via Temporal Alignment. | Kaidi Cao, Jingwei Ji, Zhangjie Cao, Chien-Yi Chang, Juan Carlos Niebles |
| 2020 | CVPR | Action Genome: Actions As Compositions of Spatio-Temporal Scene Graphs. | Jingwei Ji, Ranjay Krishna, Li Fei-Fei, Juan Carlos Niebles |
| 2020 | CVPR | Spatio-Temporal Graph for Video Captioning With Knowledge Distillation. | Boxiao Pan, Haoye Cai, De-An Huang, Kuan-Hui Lee, Adrien Gaidon, Ehsan Adeli, Juan Carlos Niebles |
| 2020 | ECCV | Procedure Planning in Instructional Videos. | Chien-Yi Chang, De-An Huang, Danfei Xu, Ehsan Adeli, Li Fei-Fei, Juan Carlos Niebles |
| 2020 | ECCV | RubiksNet: Learnable 3D-Shift for Efficient Video Action Recognition. | Linxi Fan, Shyamal Buch, Guanzhi Wang, Ryan Cao, Yuke Zhu, Juan Carlos Niebles, Li Fei-Fei |
| 2020 | ICRA | Motion Reasoning for Goal-Based Imitation Learning. | De-An Huang, Yu-Wei Chao, Chris Paxton, Xinke Deng, Li Fei-Fei, Juan Carlos Niebles, Animesh Garg, Dieter Fox |
| 2020 | MICCAI | Vision-Based Estimation of MDS-UPDRS Gait Scores for Assessing Parkinson's Disease Motor Severity. | Mandy Lu, Kathleen L. Poston, Adolf Pfefferbaum, Edith V. Sullivan, Li Fei-Fei, Kilian M. Pohl, Juan Carlos Niebles, Ehsan Adeli |
| 2020 | WACV | Disentangling Human Dynamics for Pedestrian Locomotion Forecasting with Noisy Supervision. | Karttikeya Mangalam, Ehsan Adeli, Kuan-Hui Lee, Adrien Gaidon, Juan Carlos Niebles |
| 2019 | CVPR | D3TW: Discriminative Differentiable Dynamic Time Warping for Weakly Supervised Action Alignment and Segmentation. | Chien-Yi Chang, De-An Huang, Yanan Sui, Li Fei-Fei, Juan Carlos Niebles |
| 2019 | CVPR | Neural Task Graphs: Generalizing to Unseen Tasks From a Single Video Demonstration. | De-An Huang, Suraj Nair, Danfei Xu, Yuke Zhu, Animesh Garg, Li Fei-Fei, Silvio Savarese, Juan Carlos Niebles |
| 2019 | CVPR | Peeking Into the Future: Predicting Future Person Activities and Locations in Videos. | Junwei Liang, Lu Jiang, Juan Carlos Niebles, Alexander G. Hauptmann, Li Fei-Fei |
| 2019 | CVPR | Peeking Into the Future: Predicting Future Person Activities and Locations in Videos. | Junwei Liang, Lu Jiang, Juan Carlos Niebles, Alexander G. Hauptmann, Li Fei-Fei |
| 2019 | ICCV | Learning Temporal Action Proposals With Fewer Labels. | Jingwei Ji, Kaidi Cao, Juan Carlos Niebles |
| 2019 | ICCV | Imitation Learning for Human Pose Prediction. | Borui Wang, Ehsan Adeli, Hsu-Kuang Chiu, De-An Huang, Juan Carlos Niebles |
| 2019 | IROS | Continuous Relaxation of Symbolic Planner for One-Shot Imitation Learning. | De-An Huang, Danfei Xu, Yuke Zhu, Animesh Garg, Silvio Savarese, Li Fei-Fei, Juan Carlos Niebles |
| 2019 | WACV | Action-Agnostic Human Pose Forecasting. | Hsu-Kuang Chiu, Ehsan Adeli, Borui Wang, De-An Huang, Juan Carlos Niebles |
| 2019 | WACV | Interpretable Visual Question Answering by Visual Grounding From Attention Supervision Mining. | Yundong Zhang, Juan Carlos Niebles, Alvaro Soto |
| 2018 | CVPR | Finding "It": Weakly-Supervised Reference-Aware Visual Grounding in Instructional Videos. | De-An Huang, Shyamal Buch, Lucio M. Dery, Animesh Garg, Li Fei-Fei, Juan Carlos Niebles |
| 2018 | CVPR | What Makes a Video a Video: Analyzing Temporal Information in Video Understanding Models and Datasets. | De-An Huang, Vignesh Ramanathan, Dhruv Mahajan, Lorenzo Torresani, Manohar Paluri, Li Fei-Fei, Juan Carlos Niebles |
| 2018 | ECCV | End-to-End Joint Semantic Segmentation of Actors and Actions in Video. | Jingwei Ji, Shyamal Buch, Alvaro Soto, Juan Carlos Niebles |
| 2018 | ECCV | Temporal Modular Networks for Retrieving Complex Compositional Activities in Videos. | Bingbin Liu, Serena Yeung, Edward Chou, De-An Huang, Li Fei-Fei, Juan Carlos Niebles |
| 2018 | ECCV | Graph Distillation for Action Detection with Privileged Modalities. | Zelun Luo, Jun-Ting Hsieh, Lu Jiang, Juan Carlos Niebles, Li Fei-Fei |
| 2018 | ECCV | Liquid Pouring Monitoring via Rich Sensory Inputs. | Tz-Ying Wu, Juan-Ting Lin, Tsun-Hsuan Wang, Chan-Wei Hu, Juan Carlos Niebles, Min Sun |
| 2018 | EMNLP | Translating Navigation Instructions in Natural Language to a High-Level Plan for Behavioral Robot Navigation. | Xiaoxue Zang, Ashwini Pokle, Marynel Vzquez, Kevin Chen, Juan Carlos Niebles, Alvaro Soto, Silvio Savarese |
| 2018 | HRI | Behavioral Indoor Navigation With Natural Language Directions. | Xiaoxue Zang, Marynel Vzquez, Juan Carlos Niebles, Alvaro Soto, Silvio Savarese |
| 2018 | ICRA | A Deep Learning Based Behavioral Approach to Indoor Autonomous Navigation. | Gabriel Sepulveda, Juan Carlos Niebles, Alvaro Soto |
| 2017 | AAAI | Leveraging Video Descriptions to Learn Video Question Answering. | Kuo-Hao Zeng, Tseng-Hung Chen, Ching-Yao Chuang, Yuan-Hong Liao, Juan Carlos Niebles, Min Sun |
| 2017 | BMVC | End-to-End, Single-Stream Temporal Action Detection in Untrimmed Videos. | Shyamal Buch, Victor Escorcia, Bernard Ghanem, Li Fei-Fei, Juan Carlos Niebles |
| 2017 | CVPR | SST: Single-Stream Temporal Action Proposals. | Shyamal Buch, Victor Escorcia, Chuanqi Shen, Bernard Ghanem, Juan Carlos Niebles |
| 2017 | CVPR | Unsupervised Visual-Linguistic Reference Resolution in Instructional Videos. | De-An Huang, Joseph J. Lim, Li Fei-Fei, Juan Carlos Niebles |
| 2017 | CVPR | Agent-Centric Risk Assessment: Accident Anticipation and Risky Region Localization. | Kuo-Hao Zeng, Shih-Han Chou, Fu-Hsiang Chan, Juan Carlos Niebles, Min Sun |
| 2017 | ICCV | Dense-Captioning Events in Videos. | Ranjay Krishna, Kenji Hata, Frederic Ren, Li Fei-Fei, Juan Carlos Niebles |
| 2017 | ICCV | Visual Forecasting by Imitating Dynamics in Natural Sequences. | Kuo-Hao Zeng, William B. Shen, De-An Huang, Min Sun, Juan Carlos Niebles |
| 2016 | CVPR | Fast Temporal Activity Proposals for Efficient Detection of Human Actions in Untrimmed Videos. | Fabian Caba Heilbron, Juan Carlos Niebles, Bernard Ghanem |
| 2016 | CVPR | A Hierarchical Pose-Based Approach to Complex Action Understanding Using Dictionaries of Actionlets and Motion Poselets. | Ivan Lillo, Juan Carlos Niebles, Alvaro Soto |
| 2016 | ECCV | DAPs: Deep Action Proposals for Action Understanding. | Victor Escorcia, Fabian Caba Heilbron, Juan Carlos Niebles, Bernard Ghanem |
| 2016 | ECCV | Connectionist Temporal Modeling for Weakly Supervised Action Labeling. | De-An Huang, Li Fei-Fei, Juan Carlos Niebles |
| 2016 | ECCV | Title Generation for User Generated Videos. | Kuo-Hao Zeng, Tseng-Hung Chen, Juan Carlos Niebles, Min Sun |
| 2015 | CVPR | On the relationship between visual attributes and convolutional networks. | Victor Escorcia, Juan Carlos Niebles, Bernard Ghanem |
| 2015 | CVPR | Robust Manhattan Frame estimation from a single RGB-D image. | Bernard Ghanem, Ali K. Thabet, Juan Carlos Niebles, Fabian Caba Heilbron |
| 2015 | CVPR | ActivityNet: A large-scale video benchmark for human activity understanding. | Fabian Caba Heilbron, Victor Escorcia, Bernard Ghanem, Juan Carlos Niebles |
| 2014 | ACCV | Camera Motion and Surrounding Scene Appearance as Context for Action Recognition. | Fabian Caba Heilbron, Ali K. Thabet, Juan Carlos Niebles, Bernard Ghanem |
| 2014 | CVPR | Discriminative Hierarchical Modeling of Spatio-temporally Composable Human Activities. | Ivan Lillo, Alvaro Soto, Juan Carlos Niebles |
| 2010 | CVPR | Efficient extraction of human motion volumes by tracking. | Juan Carlos Niebles, Bohyung Han, Li Fei-Fei |
| 2010 | ECCV | Modeling Temporal Structure of Decomposable Motion Segments for Activity Classification. | Juan Carlos Niebles, Chih-Wei Chen, Li Fei-Fei |
| 2009 | CVPR | Mining discriminative adjectives and prepositions for natural scene recognition. | Bangpeng Yao, Juan Carlos Niebles, Li Fei-Fei |
| 2008 | ECCV | Extracting Moving People from Internet Videos. | Juan Carlos Niebles, Bohyung Han, Andras Ferencz, Li Fei-Fei |
| 2007 | AAAI | OPTIMOL: A Framework for Online Picture Collection via Incremental Model Learning. | Li-Jia Li, Juan Carlos Niebles, Li Fei-Fei |
| 2007 | CVPR | A Hierarchical Model of Shape and Appearance for Human Action Classification. | Juan Carlos Niebles, Li Fei-Fei |
| 2006 | BMVC | Unsupervised Learning of Human Action Categories Using Spatial-Temporal Words. | Juan Carlos Niebles, Hongcheng Wang, Li Fei-Fei |