| 2026 | AAAI | Plot'n Polish: Zero-Shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models. | Kiymet Akdemir, Jing Shi, Kushal Kafle, Brian L. Price, Pinar Yanardag |
| 2025 | AAAI | Poplar: Efficient Scaling of Distributed DNN Training on Heterogeneous GPU Clusters. | WenZheng Zhang, Yang Hu, Jing Shi, Xiaoying Bai |
| 2025 | ACL | MAGNET: Augmenting Generative Decoders with Representation Learning and Infilling Capabilities. | Savya Khosla, Aditi Tiwari, Kushal Kafle, Simon Jenni, Handong Zhao, John P. Collomosse, Jing Shi |
| 2025 | ACL | GUI Agents: A Survey. | Dang Nguyen, Jian Chen, Yu Wang, Gang Wu, Namyong Park, Zhengmian Hu, Hanjia Lyu, Junda Wu, Ryan Aponte, Yu Xia, Xintong Li, Jing Shi, Hongjie Chen, Viet Dac Lai, Zhouhang Xie, Sungchul Kim, Ruiyi Zhang, Tong Yu, Md. Mehrab Tanjim, Nesreen K. Ahmed, Puneet Mathur, Seunghyun Yoon, Lina Yao, Branislav Kveton, Jihyung Kil, Thien Huu Nguyen, Trung Bui, Tianyi Zhou, Ryan A. Rossi, Franck Dernoncourt |
| 2025 | APSEC | BlockAlign: Fair Performance Testing for Blockchains based on Configuration Alignment. | Jing Shi, Chenglin Xie, Jianbo Gao, Peilun Li, Guoli Yang, Xiaoying Bai |
| 2025 | CHI | Collaborative Scene Authoring with Near Real-Time 3D Reconstruction. | Leon Cewei Foo, Nirmal Sukumaran Nair, Liuziyi Liu, Jeannie Su Ann Lee, Songjia Shen, Indriyati Atmosukarto, Alvin Chan, Jing Shi, Yong Joo Loh, Yih Yng Ng, Michael Chia, Chek Tien Tan |
| 2025 | CHI | Virtual Reality for HAZMAT Decontamination Facility Training: An Initial Case Study. | Benjamin Wei Jie Kwok, Jeannie Su Ann Lee, Jing Shi, Zhi Quan Chng, Nisha Jain, Norhaliim Putera Abdul Hamid, David Kuan Peng Teng, Kan Chen |
| 2025 | CVPR | FINECAPTION: Compositional Image Captioning Focusing on Wherever You Want at Any Granularity. | Hang Hua, Qing Liu, Lingzhi Zhang, Jing Shi, Soo Ye Kim, Zhifei Zhang, Yilin Wang, Jianming Zhang, Zhe Lin, Jiebo Luo |
| 2025 | CVPR | Visual Persona: Foundation Model for Full-Body Human Customization. | Jisu Nam, Soowon Son, Zhan Xu, Jing Shi, Difan Liu, Feng Liu, Seungryong Kim, Yang Zhou |
| 2025 | CVPR | Yo'Chameleon: Personalized Vision and Language Generation. | Thao Nguyen, Krishna Kumar Singh, Jing Shi, Trung Bui, Yong Jae Lee, Yuheng Li |
| 2025 | CVPR | The Photographer's Eye: Teaching Multimodal Large Language Models to See, and Critique Like Photographers. | Daiqing Qi, Handong Zhao, Jing Shi, Simon Jenni, Yifei Fan, Franck Dernoncourt, Scott Cohen, Sheng Li |
| 2025 | ICCV | DiffTell: A High-Quality Dataset for Describing Image Manipulation Changes. | Zonglin Di, Jing Shi, Yifei Fan, Hao Tan, Alexander Black, John P. Collomosse, Yang Liu |
| 2025 | ICCV | Improving Large Vision and Language Models by Learning from a Panel of Peers. | Jefferson Hernandez, Jing Shi, Simon Jenni, Vicente Ordonez, Kushal Kafle |
| 2025 | ICML | Toward Robust Hyper-Detailed Image Captioning: A Multiagent Approach and Dual Evaluation Metrics for Factuality and Coverage. | Saehyung Lee, Seunghyun Yoon, Trung Bui, Jing Shi, Sungroh Yoon |
| 2024 | AAAI | VIXEN: Visual Text Comparison Network for Image Difference Captioning. | Alexander Black, Jing Shi, Yifei Fan, Tu Bui, John P. Collomosse |
| 2024 | CVPR | InstantBooth: Personalized Text-to-Image Generation without Test-Time Finetuning. | Jing Shi, Wei Xiong, Zhe Lin, Hyun Joon Jung |
| 2024 | ECCV | FineMatch: Aspect-Based Fine-Grained Image and Text Mismatch Detection and Correction. | Hang Hua, Jing Shi, Kushal Kafle, Simon Jenni, Daoan Zhang, John P. Collomosse, Scott Cohen, Jiebo Luo |
| 2024 | ECCV | Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models. | Yixuan Ren, Yang Zhou, Jimei Yang, Jing Shi, Difan Liu, Feng Liu, Mingi Kwon, Abhinav Shrivastava |
| 2024 | ICASSP | ViLaS: Exploring the Effects of Vision and Language Context in Automatic Speech Recognition. | Ziyi Ni, Minglun Han, Feilong Chen, Linghui Meng, Jing Shi, Pin Lv, Bo Xu |
| 2024 | MICCAI | Topological GCN for Improving Detection of Hip Landmarks from B-Mode Ultrasound Images. | Tianxiang Huang, Jing Shi, Ge Jin, Juncheng Li, Jun Wang, Jun Du, Jun Shi |
| 2024 | WACV | Content-Aware Image Color Editing with Auxiliary Color Restoration Tasks. | Yixuan Ren, Jing Shi, Zhifei Zhang, Yifei Fan, Zhe Lin, Bo He, Abhinav Shrivastava |
| 2023 | ICASSP | Matching-Based Term Semantics Pre-Training for Spoken Patient Query Understanding. | Zefa Hu, Xiuyi Chen, Haoran Wu, Minglun Han, Ziyi Ni, Jing Shi, Shuang Xu, Bo Xu |
| 2023 | Interspeech | Enhancing Visual Question Answering via Deconstructing Questions and Explicating Answers. | Feilong Chen, Minglun Han, Jing Shi, Shuang Xu, Bo Xu |
| 2023 | Interspeech | Knowledge Transfer from Pre-trained Language Models to Cif-based Speech Recognizers via Hierarchical Distillation. | Minglun Han, Feilong Chen, Jing Shi, Shuang Xu, Bo Xu |
| 2022 | CVPR | SpaceEdit: Learning a Unified Editing Space for Open-Domain Image Color Editing. | Jing Shi, Ning Xu, Haitian Zheng, Alex Smith, Jiebo Luo, Chenliang Xu |
| 2021 | ASRU | An Exploration of Self-Supervised Pretrained Representations for End-to-End Speech Recognition. | Xuankai Chang, Takashi Maekaku, Pengcheng Guo, Jing Shi, Yen-Ju Lu, Aswin Shanmugam Subramanian, Tianzi Wang, Shu-Wen Yang, Yu Tsao, Hung-yi Lee, Shinji Watanabe |
| 2021 | CVPR | Learning by Planning: Language-Guided Global Image Editing. | Jing Shi, Ning Xu, Yihang Xu, Trung Bui, Franck Dernoncourt, Chenliang Xu |
| 2021 | ICASSP | Recent Developments on Espnet Toolkit Boosted By Conformer. | Pengcheng Guo, Florian Boyer, Xuankai Chang, Tomoki Hayashi, Yosuke Higuchi, Hirofumi Inaguma, Naoyuki Kamo, Chenda Li, Daniel Garcia-Romero, Jiatong Shi, Jing Shi, Shinji Watanabe, Kun Wei, Wangyou Zhang, Yuekai Zhang |
| 2021 | ICASSP | Training Noisy Single-Channel Speech Separation with Noisy Oracle Sources: A Large Gap and a Small Step. | Matthew Maciejewski, Jing Shi, Shinji Watanabe, Sanjeev Khudanpur |
| 2021 | ICCV | A Simple Baseline for Weakly-Supervised Scene Graph Generation. | Jing Shi, Yiwu Zhong, Ning Xu, Yin Li, Chenliang Xu |
| 2021 | ICCV | Language-Guided Global Image Editing via Cross-Modal Cyclic Mechanism. | Wentao Jiang, Ning Xu, Jiayun Wang, Chen Gao, Jing Shi, Zhe Lin, Si Liu |
| 2021 | ICCV | Learning to Generate Scene Graph from Natural Language Supervision. | Yiwu Zhong, Jing Shi, Jianwei Yang, Chenliang Xu, Yin Li |
| 2021 | ICONIP | Continuous-Time Stochastic Differential Networks for Irregular Time Series Modeling. | Yingru Liu, Yucheng Xing, Xuewen Yang, Xin Wang, Jing Shi, Di Jin, Zhaoyue Chen, Jacqueline Wu |
| 2021 | IJCNN | Audio-Visual Speech Separation with Visual Features Enhanced by Adversarial Training. | Peng Zhang, Jiaming Xu, Jing Shi, Yunzhe Hao, Lei Qin, Bo Xu |
| 2021 | WACV | How to Make a BLT Sandwich? Learning VQA towards Understanding Web Instructional Videos. | Shaojie Wang, Wentian Zhao, Ziyi Kou, Jing Shi, Chenliang Xu |
| 2020 | ACCV | A Benchmark and Baseline for Language-Driven Image Editing. | Jing Shi, Ning Xu, Trung Bui, Franck Dernoncourt, Zheng Wen, Chenliang Xu |
| 2020 | Interspeech | Speaker-Conditional Chain Model for Speech Separation and Extraction. | Jing Shi, Jiaming Xu, Yusuke Fujita, Shinji Watanabe, Bo Xu |
| 2020 | Interspeech | A Unified Framework for Low-Latency Speaker Extraction in Cocktail Party Environments. | Yunzhe Hao, Jiaming Xu, Jing Shi, Peng Zhang, Lei Qin, Bo Xu |
| 2019 | CVPR | Not All Frames Are Equal: Weakly-Supervised Video Grounding With Contextual Similarity and Visual Clustering Losses. | Jing Shi, Jia Xu, Boqing Gong, Chenliang Xu |
| 2019 | CVPR | Audio-Visual Event Localization in the Wild. | Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu |
| 2019 | IJCAI | GAN-EM: GAN Based EM Learning Framework. | Wentian Zhao, Shaojie Wang, Zhihuai Xie, Jing Shi, Chenliang Xu |
| 2019 | Interspeech | Which Ones Are Speaking? Speaker-Inferred Model for Multi-Talker Speech Separation. | Jing Shi, Jiaming Xu, Bo Xu |
| 2018 | AAAI | Modeling Attention and Memory for Auditory Selection in a Cocktail Party Environment. | Jiaming Xu, Jing Shi, Guangcan Liu, Xiuyi Chen, Bo Xu |
| 2018 | ECCV | Audio-Visual Event Localization in Unconstrained Videos. | Yapeng Tian, Jing Shi, Bochen Li, Zhiyao Duan, Chenliang Xu |
| 2018 | ICANN | DSL: Automatic Liver Segmentation with Faster R-CNN and DeepLab. | Wei Tang, Dongsheng Zou, Su Yang, Jing Shi |
| 2018 | IJCAI | Listen, Think and Listen Again: Capturing Top-down Auditory Attention for Speaker-independent Speech Separation. | Jing Shi, Jiaming Xu, Guangcan Liu, Bo Xu |
| 2018 | IJCNN | Distilled Binary Neural Network for Monaural Speech Separation. | Xiuyi Chen, Guangcan Liu, Jing Shi, Jiaming Xu, Bo Xu |
| 2018 | IJCNN | Improving Speech Separation with Adversarial Network and Reinforcement Learning. | Guangcan Liu, Jing Shi, Xiuyi Chen, Jiaming Xu, Bo Xu |
| 2017 | ICIG | Object Tracking Based on Multi-modality Dictionary Learning. | Jing Wang, Hong Zhu, Shan Xue, Jing Shi |
| 2017 | ICTAI | Personalized EntityRank-Based Entity Linking with DBpedia. | Huiying Li, Jing Shi |
| 2017 | IECON | A fast AGFD identification method and the resulting air-gap force analysis of cage induction motors with skewed rotor bars. | Dongdong Zhang, Jing Shi, Thomas Wu |
| 2017 | IECON | Loss characteristic analysis of small and medium-sized induction motors fed by PWM inverter based on the experiment measurements. | Dongdong Zhang, Jing Shi, Haisen Zhao, Thomas Wu |
| 2016 | COLING | Hierarchical Memory Networks for Answer Selection on Unknown Words. | Jiaming Xu, Jing Shi, Yiqun Yao, Suncong Zheng, Bo Xu, Bo Xu |
| 2016 | IDEAL | A Route Planning Method for Underwater Terrain Aided Positioning Based on Gray Wolf Optimization Algorithm. | Jian Shen, Jing Shi, Lu Xiong |
| 2014 | KDD | A Fast Distributed Stochastic Gradient Descent Algorithm for Matrix Factorization. | Fanglin Li, Bin Wu, Liutong Xu, Chuan Shi, Jing Shi |
| 2012 | ICNC | The gender difference in distraction of background music and noise on the cognitive task performance. | Jing Yang, Jing Shi, Huajian Cai, Chuangang Shen, Yan Lin |
| 2011 | PIMRC | Channel reciprocity of compact antenna array and the calibration. | Jing Shi, Qinglin Luo, Huan Sun |
| 2011 | WCNC | An efficient method for enhancing TDD over the air reciprocity calibration. | Jing Shi, Qinglin Luo, Mingli You |
| 2010 | INFOCOM | PriSense: Privacy-Preserving Data Aggregation in People-Centric Urban Sensing Systems. | Jing Shi, Rui Zhang, Yunzhong Liu, Yanchao Zhang |
| 2010 | INFOCOM | Verifiable Fine-Grained Top-k Queries in Tiered Sensor Networks. | Rui Zhang, Jing Shi, Yunzhong Liu, Yanchao Zhang |
| 2010 | SECON | Traffic Inference in Anonymous MANETs. | Yunzhong Liu, Rui Zhang, Jing Shi, Yanchao Zhang |
| 2009 | INFOCOM | Synchronized CSMA Contention: Model, Implementation and Evaluation. | Jing Shi, Ehsan Aryafar, Theodoros Salonidis, Edward W. Knightly |
| 2009 | INFOCOM | Secure Range Queries in Tiered Sensor Networks. | Jing Shi, Rui Zhang, Yanchao Zhang |
| 2009 | MOBIHOC | Secure multidimensional range queries in sensor networks. | Rui Zhang, Jing Shi, Yanchao Zhang |
| 2007 | WCNC | Partial Channel State Information Based Cooperative Relaying and Partner Selection. | Jing Shi, Guanding Yu, Zhaoyang Zhang, Yan Chen, Peiliang Qiu |
| 2006 | VTC | Utility Based Optimal Layering and Adaptive Transmission for Video Multicasting over Wireless Systems. | Daiming Qu, Jing Shi, Guangxi Zhu |
| 2006 | VTC | Resource Allocation in OFDM based Multihop Wireless Networks. | Jing Shi, Guanding Yu, Zhaoyang Zhang, Peiliang Qiu |
| 2006 | VTC | A Novel Resource Allocation Algorithm for Real-time Services in Multiuser OFDM Systems. | Guanding Yu, Zhaoyang Zhang, Yan Chen, Jing Shi, Peiliang Qiu |