| 2026 | ACL | Beyond 'Aha!': Toward Systematic Meta-Abilities Alignment in Large Reasoning Models. | Zhiyuan Hu, Yibo Wang, Hanze Dong, Yuhui Xu, Amrita Saha, Caiming Xiong, Bryan Hooi, Junnan Li |
| 2025 | ACL | ProBench: Judging Multimodal Foundation Models on Open-ended Multi-domain Expert Tasks. | Yan Yang, Dongxu Li, Haoning Wu, Bei Chen, Liu Liu, Liyuan Pan, Junnan Li |
| 2025 | ACL | Aria-UI: Visual Grounding for GUI Instructions. | Yuhao Yang, Yue Wang, Dongxu Li, Ziyang Luo, Bei Chen, Chao Huang, Junnan Li |
| 2025 | ACL | Generative Frame Sampler for Long Video Understanding. | Linli Yao, Haoning Wu, Kun Ouyang, Yuanxing Zhang, Caiming Xiong, Bei Chen, Xu Sun, Junnan Li |
| 2025 | CVPR | VideoAutoArena: An Automated Arena for Evaluating Large Multimodal Models in Video Analysis through User Simulation. | Ziyang Luo, Haoning Wu, Dongxu Li, Jing Ma, Mohan S. Kankanhalli, Junnan Li |
| 2025 | ICML | Moirai-MoE: Empowering Time Series Foundation Models with Sparse Mixture of Experts. | Xu Liu, Juncheng Liu, Gerald Woo, Taha Aksu, Yuxuan Liang, Roger Zimmermann, Chenghao Liu, Junnan Li, Silvio Savarese, Caiming Xiong, Doyen Sahoo |
| 2025 | ICML | Reward-Guided Speculative Decoding for Efficient LLM Reasoning. | Baohao Liao, Yuhui Xu, Hanze Dong, Junnan Li, Christof Monz, Silvio Savarese, Doyen Sahoo, Caiming Xiong |
| 2024 | CVPR | ULIP-2: Towards Scalable Multimodal Pre-Training for 3D Understanding. | Le Xue, Ning Yu, Shu Zhang, Artemis Panagopoulou, Junnan Li, Roberto Martn-Martn, Jiajun Wu, Caiming Xiong, Ran Xu, Juan Carlos Niebles, Silvio Savarese |
| 2024 | ECCV | X-InstructBLIP: A Framework for Aligning Image, 3D, Audio, Video to LLMs and its Emergent Cross-Modal Reasoning. | Artemis Panagopoulou, Le Xue, Ning Yu, Junnan Li, Dongxu Li, Shafiq Joty, Ran Xu, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2024 | IROS | Identification and validation of the dynamic model of a tendon-driven anthropomorphic finger. | Junnan Li, Lingyun Chen, Johannes Ringwald, Edmundo Pozo Fortunic, Amartya Ganguly, Sami Haddadin |
| 2024 | IROS | Optimizing Interaction Space: Enlarging the Capture Volume for Multiple Portable Motion Capture Devices. | Muhammad Hilman Fatoni, Christopher Herneth, Junnan Li, Fajar Budiman, Amartya Ganguly, Sami Haddadin |
| 2024 | IROS | Object Augmentation Algorithm: Computing virtual object motion and object induced interaction wrench from optical markers. | Christopher Herneth, Junnan Li, Muhammad Hilman Fatoni, Amartya Ganguly, Sami Haddadin |
| 2024 | NAACL | What Are We Measuring When We Evaluate Large Vision-Language Models? An Analysis of Latent Factors and Biases. | Anthony Meng Huat Tiong, Junqi Zhao, Boyang Li, Junnan Li, Steven C. H. Hoi, Caiming Xiong |
| 2023 | AAAI | Tackling Data Heterogeneity in Federated Learning with Class Prototypes. | Yutong Dai, Zeyuan Chen, Junnan Li, Shelby Heinecke, Lichao Sun, Ran Xu |
| 2023 | ACL | LAVIS: A One-stop Library for Language-Vision Intelligence. | Dongxu Li, Junnan Li, Hung Le, Guangsen Wang, Silvio Savarese, Steven C. H. Hoi |
| 2023 | CVPR | From Images to Textual Prompts: Zero-shot Visual Question Answering with Frozen Large Language Models. | Jiaxian Guo, Junnan Li, Dongxu Li, Anthony Meng Huat Tiong, Boyang Li, Dacheng Tao, Steven C. H. Hoi |
| 2023 | EMNLP | CodeT5+: Open Code Large Language Models for Code Understanding and Generation. | Yue Wang, Hung Le, Akhilesh Gotmare, Nghi D. Q. Bui, Junnan Li, Steven C. H. Hoi |
| 2023 | ICLR | Masked Unsupervised Self-training for Label-free Image Classification. | Junnan Li, Silvio Savarese, Steven C. H. Hoi |
| 2023 | ICML | BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models. | Junnan Li, Dongxu Li, Silvio Savarese, Steven C. H. Hoi |
| 2023 | IWQoS | DRA: Ultra-Low Latency Network I/O for TSN Embedded End-Systems. | Chenglong Li, Tao Li, Junnan Li, Wenwen Fu, Baosheng Wang |
| 2022 | CVPR | Align and Prompt: Video-and-Language Pre-training with Entity Prompts. | Dongxu Li, Junnan Li, Hongdong Li, Juan Carlos Niebles, Steven C. H. Hoi |
| 2022 | ECCV | Open Vocabulary Object Detection with Pseudo Bounding-Box Labels. | Mingfei Gao, Chen Xing, Juan Carlos Niebles, Junnan Li, Ran Xu, Wenhao Liu, Caiming Xiong |
| 2022 | EMNLP | Plug-and-Play VQA: Zero-shot VQA by Conjoining Large Pretrained Models with Zero Training. | Anthony Meng Huat Tiong, Junnan Li, Boyang Li, Silvio Savarese, Steven C. H. Hoi |
| 2022 | ICML | BLIP: Bootstrapping Language-Image Pre-training for Unified Vision-Language Understanding and Generation. | Junnan Li, Dongxu Li, Caiming Xiong, Steven C. H. Hoi |
| 2022 | ICPP | SHE: A Generic Framework for Data Stream Mining over Sliding Windows. | Yuhan Wu, Zhuochen Fan, Qilong Shi, Yixin Zhang, Tong Yang, Cheng Chen, Zheng Zhong, Junnan Li, Ariel Shtul, Yaofeng Tu |
| 2022 | PAKDD | A Novel Clustering Algorithm with Dynamic Boundary Extraction Strategy Based on Local Gravitation. | Jiangmei Luo, Qingsheng Zhu, Junnan Li, Dongdong Cheng, Mingqiang Zhou |
| 2021 | COMPSAC | Hierarchical Clustering Based on Local Cores and Sharing Concept. | Jinxin Shi, Qingsheng Zhu, Junnan Li, Ji Liu, Dongdong Cheng |
| 2021 | ICCV | CoMatch: Semi-supervised Learning with Contrastive Graph Regularization. | Junnan Li, Caiming Xiong, Steven C. H. Hoi |
| 2021 | ICCV | Learning from Noisy Data with Robust Representation Learning. | Junnan Li, Caiming Xiong, Steven C. H. Hoi |
| 2021 | ICLR | MoPro: Webly Supervised Learning with Momentum Prototypes. | Junnan Li, Caiming Xiong, Steven C. H. Hoi |
| 2021 | ICLR | Prototypical Contrastive Learning of Unsupervised Representations. | Junnan Li, Pan Zhou, Caiming Xiong, Steven C. H. Hoi |
| 2020 | ECCV | The Devil Is in Classification: A Simple Framework for Long-Tail Instance Segmentation. | Tao Wang, Yu Li, Bingyi Kang, Junnan Li, Jun Hao Liew, Sheng Tang, Steven C. H. Hoi, Jiashi Feng |
| 2020 | FCCM | Update Latency Optimization of Packet Classification for SDN Switch on FPGA. | Chenglong Li, Tao Li, Junnan Li, Zilin Shi, Baosheng Wang |
| 2020 | ICLR | DivideMix: Learning with Noisy Labels as Semi-supervised Learning. | Junnan Li, Richard Socher, Steven C. H. Hoi |
| 2020 | WACV | Weakly-Supervised Multi-Person Action Recognition in 360° Videos. | Junnan Li, Jianquan Liu, Yongkang Wang, Shoji Nishimura, Mohan S. Kankanhalli |
| 2020 | WACV | GradMix: Multi-source Transfer across Domains and Tasks. | Junnan Li, Ziwei Xu, Yongkang Wang, Qi Zhao, Mohan S. Kankanhalli |
| 2019 | CVPR | Learning to Learn From Noisy Labeled Data. | Junnan Li, Yongkang Wong, Qi Zhao, Mohan S. Kankanhalli |
| 2019 | CVPR | Learning to Detect Human-Object Interactions With Knowledge. | Bingjie Xu, Yongkang Wong, Junnan Li, Qi Zhao, Mohan S. Kankanhalli |
| 2019 | IWQoS | FAST: enabling fast software/hardware prototype for network experimentation. | Xiangrui Yang, Zhigang Sun, Junnan Li, Jinli Yan, Tao Li, Wei Quan, Donglai Xu, Gianni Antichi |
| 2019 | SPAA | A Memory Optimized Architecture for Multi-Field Packet Classification (Brief Announcement). | Chenglong Li, Tao Li, Junnan Li, Hui Yang, Baosheng Wang |
| 2017 | HPCC | EffiView: Trigger-Based Monitoring Approach with Low Cost in SDN. | Binfeng Wang, Jinshu Su, Junnan Li, Biao Han |
| 2017 | ICCV | Dual-Glance Model for Deciphering Social Relationships. | Junnan Li, Yongkang Wong, Qi Zhao, Mohan S. Kankanhalli |
| 2016 | ISM | Multi-stream Deep Learning Framework for Automated Presentation Assessment. | Junnan Li, Yongkang Wong, Mohan S. Kankanhalli |
| 2016 | ISM | Demo Paper: PreSense - An Assistive Presentation Self-Quantification System. | Junnan Li, Yongkang Wong, Mohan S. Kankanhalli |