| 2026 | AAAI | DreamRunner: Fine-Grained Compositional Story-to-Video Generation with Retrieval-Augmented Motion Adaptation. | Zun Wang, Jialu Li, Han Lin, Jaehong Yoon, Mohit Bansal |
| 2025 | CHASE | Automatic Chest X-ray Image Caption for Report Generation. | Jialu Li, Youshan Zhang |
| 2025 | CHASE | Leapfrog Latent Consistency Model (LLCM) for Medical Images Generation. | Lakshmikar R. Polamreddy, Kalyan Roy, Sheng-Han Yueh, Youshan Zhang, Shilpa Kuppili, Jialu Li, Deepshikha Mahato |
| 2025 | ICLR | Unbounded: A Generative Infinite Game of Character Life Simulation. | Jialu Li, Yuanzhen Li, Neal Wadhwa, Yael Pritch, David E. Jacobs, Michael Rubinstein, Mohit Bansal, Nataniel Ruiz |
| 2025 | ICLR | Bootstrapping Language-Guided Navigation Learning with Self-Refining Data Flywheel. | Zun Wang, Jialu Li, Yicong Hong, Songze Li, Kunchang Li, Shoubin Yu, Yi Wang, Yu Qiao, Yali Wang, Mohit Bansal, Limin Wang |
| 2025 | Interspeech | Band-Split Self-supervised Mamba for Infant-centered Audio Analysis. | Xulin Fan, Jialu Li, Mark Hasegawa-Johnson, Nancy L. McElwain |
| 2025 | MICCAI | Source-Free Active Domain Adaptation for Efficient Medical Video Polyp Segmentation. | Jialu Li, Hongqiu Wang, Weiming Wang, Jing Qin, Qiong Wang, Lei Zhu |
| 2025 | MICCAI | Towards Efficient and Privacy-Preserving Medical Image Segmentation: A Point-Driven Source-Free Active Adaptation Framework. | Hongqiu Wang, Jialu Li, Zhaohu Xing, Haipeng Zhou, Xiangde Luo, Lei Zhu |
| 2025 | WWW | Hyperbolic-Euclidean Deep Mutual Learning. | Haifang Cao, Yu Wang, Jialu Li, Pengfei Zhu, Qinghua Hu |
| 2025 | WACV | SST-EM: Advanced Metrics for Evaluating Semantic, Spatial and Temporal Aspects in Video Editing. | Varun Biyyala, Bharat Chanderprakash Kathuria, Jialu Li, Youshan Zhang |
| 2024 | AAAI | Every Node Is Different: Dynamically Fusing Self-Supervised Tasks for Attributed Graph Clustering. | Pengfei Zhu, Qian Wang, Yu Wang, Jialu Li, Qinghua Hu |
| 2024 | AAAI | VLN-Video: Utilizing Driving Videos for Outdoor Vision-and-Language Navigation. | Jialu Li, Aishwarya Padmakumar, Gaurav S. Sukhatme, Mohit Bansal |
| 2024 | CHASE | Sound Tagging in Infant-centric Home Soundscapes. | Mohammad Nur Hossain Khan, Jialu Li, Nancy L. McElwain, Mark Hasegawa-Johnson, Bashima Islam |
| 2024 | ICASSP | Analysis of Self-Supervised Speech Models on Children's Speech and Infant Vocalizations. | Jialu Li, Mark Hasegawa-Johnson, Nancy L. McElwain |
| 2024 | ICML | Socialized Learning: Making Each Other Better Through Multi-Agent Collaboration. | Xinjie Yao, Yu Wang, Pengfei Zhu, Wanyu Lin, Jialu Li, Weihao Li, Qinghua Hu |
| 2024 | Interspeech | Enhancing Child Vocalization Classification with Phonetically-Tuned Embeddings for Assisting Autism Diagnosis. | Jialu Li, Mark Hasegawa-Johnson, Karrie Karahalios |
| 2024 | Interspeech | Vision Transformer Segmentation for Visual Bird Sound Denoising. | Sahil Kumar, Jialu Li, Youshan Zhang |
| 2024 | Interspeech | Complex Image-Generative Diffusion Transformer for Audio Denoising. | Junhui Li, Pu Wang, Jialu Li, Youshan Zhang |
| 2024 | Interspeech | Diffusion Gaussian Mixture Audio Denoise. | Pu Wang, Junhui Li, Jialu Li, Liangdong Guo, Youshan Zhang |
| 2024 | IGARSS | On Feasibility of Cross-Satellite SAR Ship Re-Identification. | Jialu Li, Haitao Lang |
| 2024 | IGARSS | OFA-NET: Optical Flow Aligning Network for Time Series Change Detection. | Jialu Li, Chen Wu |
| 2023 | ACL | Listen, Decipher and Sign: Toward Unsupervised Speech-to-Sign Language Recognition. | Liming Wang, Junrui Ni, Heting Gao, Jialu Li, Kai Chieh Chang, Xulin Fan, Junkai Wu, Mark Hasegawa-Johnson, Chang Dong Yoo |
| 2023 | CVPR | Improving Vision-and-Language Navigation by Generating Future-View Image Semantics. | Jialu Li, Mohit Bansal |
| 2023 | ICCV | Scaling Data Generation in Vision-and-Language Navigation. | Zun Wang, Jialu Li, Yicong Hong, Yi Wang, Qi Wu, Mohit Bansal, Stephen Gould, Hao Tan, Yu Qiao |
| 2023 | Interspeech | Towards Robust Family-Infant Audio Analysis Based on Unsupervised Pretraining of Wav2vec 2.0 on Large-Scale Unlabeled Family Audio. | Jialu Li, Mark Hasegawa-Johnson, Nancy L. McElwain |
| 2023 | Interspeech | Complex Image Generation SwinTransformer Network for Audio Denoising. | Youshan Zhang, Jialu Li |
| 2023 | WACV | BirdSoundsDenoising: Deep Visual Audio Denoising for Bird Sounds. | Youshan Zhang, Jialu Li |
| 2022 | CVPR | Envedit: Environment Editing for Vision-and-Language Navigation. | Jialu Li, Hao Tan, Mohit Bansal |
| 2022 | MICCAI | Rethinking Breast Lesion Segmentation in Ultrasound: A New Video Dataset and A Baseline Network. | Jialu Li, Qingqing Zheng, Mingshuang Li, Ping Liu, Qiong Wang, Litao Sun, Lei Zhu |
| 2022 | NAACL | CLEAR: Improving Vision-Language Navigation with Cross-Lingual, Environment-Agnostic Representations. | Jialu Li, Hao Tan, Mohit Bansal |
| 2021 | EMNLP | NDH-Full: Learning and Evaluating Navigational Agents on Full-Length Dialogue. | Hyounghun Kim, Jialu Li, Mohit Bansal |
| 2021 | NAACL | Improving Cross-Modal Alignment in Vision Language Navigation via Syntactic Information. | Jialu Li, Hao Tan, Mohit Bansal |
| 2020 | DAC | Adaptive Layout Decomposition with Graph Embedding Neural Networks. | Wei Li, Jialu Xia, Yuzhe Ma, Jialu Li, Yibo Lin, Bei Yu |
| 2020 | EMNLP | Exploring the Role of Argument Structure in Online Debate Persuasion. | Jialu Li, Esin Durmus, Claire Cardie |
| 2020 | Interspeech | Autosegmental Neural Nets: Should Phones and Tones be Synchronous or Asynchronous? | Jialu Li, Mark Hasegawa-Johnson |