| 2026 | AAAI | Scene-Aware Spatiotemporal Generalization: Towards Robust Temporal Action Detection Across Domains. | Fangming Feng, Sihang Cai, Zequn Xie, Yangyang Wu, Tao Jin |
| 2026 | ACL | Rectifying the Emotional Flow: Aligning Priors and Dynamic Guidance for High-Arousal Text-to-Speech. | Fangming Feng, Dongjie Fu, Zequn Xie, Yu Zhang, Yangyang Wu, Zhou Zhao, Tao Jin |
| 2026 | ACL | View-R1: Asymmetric Policy Optimization for Difficulty-Aware Multimodal Reinforcement Learning. | Minjie Hong, Zirun Guo, Jiabao Zhang, Zehan Wang, Ziang Zhang, Tao Jin, Zhou Zhao |
| 2026 | ACL | DPDV: Dual-Pathway and Dual-View Representation Learning for Bridging Information Asymmetry in Text-Video Retrieval. | Zequn Xie, Xin Liu, Fangming Feng, Boyun Zhang, Tao Jin |
| 2026 | ACL | Bridging the Pose-Semantic Gap: A Cascade Framework for Text-Based Person Anomaly Search. | Zequn Xie, Guijin Luo, Chuxin Wang, Sihang Cai, Tao Jin, Zhou Zhao, Yixuan Tang |
| 2026 | ACL | SAME: Signer-Aware Mixture-of-Experts for Test-Time Adaptation in Sign Language Translation. | Lujia Yang, Weicai Yan, Yongbo He, Qifei Zhang, Tao Jin, Jinshan Zhang, Meng Xi, Jianwei Yin |
| 2026 | ACL | Text-Guided Multi-Scale Frequency Representation Adaptation. | Weicai Yan, Xinhua Ma, Wang Lin, Tao Jin |
| 2026 | ACL | Generative-to-Discriminative Test-Time Adaptation via Manifold-Aware Diffusion and Bayesian Distillation. | Boyun Zhang, Zequn Xie, Fangming Feng, Zihan Zhang, Yongbo He, Chuxin Wang, Sihang Cai, Tao Jin, Qifei Zhang |
| 2026 | IWCMC | MSFFNet: A Multi-Scale Spatiotemporal Feature Fusion Network for Ocean Subsurface Temperature and Salinity Reconstruction. | Tao Jin, Wenkai Zou, Da Geng, Caizhi Xing, Hongjuan Zhou, Yingjie Mei, Chenxu Wang, Zhiquan Zhou |
| 2025 | AAAI | Bridging the Gap for Test-Time Multimodal Sentiment Analysis. | Zirun Guo, Tao Jin, Wenlong Xu, Wang Lin, Yangyang Wu |
| 2025 | AAAI | A Wander Through the Multimodal Landscape: Efficient Transfer Learning via Low-rank Sequence Multimodal Adapter. | Zirun Guo, Xize Cheng, Yangyang Wu, Tao Jin |
| 2025 | AAAI | Speech Watermarking with Discrete Intermediate Representations. | Shengpeng Ji, Ziyue Jiang, Jialong Zuo, Minghui Fang, Yifu Chen, Tao Jin, Zhou Zhao |
| 2025 | ACL | T2A-Feedback: Improving Basic Capabilities of Text-to-Audio Generation via Fine-grained AI Feedback. | Zehan Wang, Ke Lei, Chen Zhu, Jiawei Huang, Sashuai Zhou, Luping Liu, Xize Cheng, Shengpeng Ji, Zhenhui Ye, Tao Jin, Zhou Zhao |
| 2025 | ACL | TCSinger 2: Customizable Multilingual Zero-shot Singing Voice Synthesis. | Yu Zhang, Wenxiang Guo, Changhao Pan, Dongyu Yao, Zhiyuan Zhu, Ziyue Jiang, Yuhan Wang, Tao Jin, Zhou Zhao |
| 2025 | CVPR | SpatialCLIP: Learning 3D-aware Image Representations from Spatially Discriminative Language. | Zehan Wang, Sashuai Zhou, Shaoxuan He, Haifeng Huang, Lihe Yang, Ziang Zhang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao |
| 2025 | CVPR | ConceptGuard: Continual Personalized Text-to-Image Generation with Forgetting and Confusion Mitigation. | Zirun Guo, Tao Jin |
| 2025 | CVPR | Non-Natural Image Understanding with Advancing Frequency-based Vision Encoders. | Wang Lin, Qingsong Wang, Yueying Feng, Shulei Wang, Tao Jin, Zhou Zhao, Fei Wu, Chang Yao, Jingyuan Chen |
| 2025 | CVPR | Towards Transformer-Based Aligned Generation with Self-Coherence Guidance. | Shulei Wang, Wang Lin, Hai Huang, Hanting Wang, Sihang Cai, WenKang Han, Tao Jin, Jingyuan Chen, Jiacheng Sun, Jieming Zhu, Zhou Zhao |
| 2025 | EMNLP | PACHAT: Persona-Aware Speech Assistant for Multi-party Dialogue. | Dongjie Fu, Xize Cheng, Linjun Li, Xiaoda Yang, Lujia Yang, Tao Jin |
| 2025 | EMNLP | Chat-Driven Text Generation and Interaction for Person Retrieval. | Zequn Xie, Chuxin Wang, Yeqiang Wang, Sihang Cai, Shulei Wang, Tao Jin |
| 2025 | ICASSP | Spatio-Temporal Mapping Generative Adversarial Network for Functional Connectivity Network Reconstruction across Brain Atlases. | Hongzheng Guan, Tao Jin, Li Xiao, Gang Qu, Yu-Ping Wang |
| 2025 | ICASSP | A Graph-Based Generative Adversarial Network Model for Inferring Task-State from Resting-State Functional Connectivity Networks. | Tao Jin, Hongzheng Guan, Li Xiao, Gang Qu, Yu-Ping Wang |
| 2025 | ICASSP | Curriculum Learning aided Audio-Visual Speech Recognition with Arbitrary Speaker Number. | Yuxiao Lin, Tao Jin, Xize Cheng, Zhou Zhao, Fei Wu |
| 2025 | ICCV | Open-Set Cross Modal Generalization via Multimodal Unified Representation. | Hai Huang, Yan Xia, Shulei Wang, Hanting Wang, Minghui Fang, Shengpeng Ji, Sashuai Zhou, Tao Jin, Zhou Zhao |
| 2025 | ICLR | OmniBind: Large-scale Omni Multimodal Representation via Binding Spaces. | Zehan Wang, Ziang Zhang, Minjie Hong, Hang Zhang, Luping Liu, Rongjie Huang, Xize Cheng, Shengpeng Ji, Tao Jin, Hengshuang Zhao, Zhou Zhao |
| 2025 | ICLR | VoxDialogue: Can Spoken Dialogue Systems Understand Information Beyond Words? | Xize Cheng, Ruofan Hu, Xiaoda Yang, Jingyu Lu, Dongjie Fu, Zehan Wang, Shengpeng Ji, Rongjie Huang, Boyang Zhang, Tao Jin, Zhou Zhao |
| 2025 | ICLR | OmniSep: Unified Omni-Modality Sound Separation with Query-Mixup. | Xize Cheng, Siqi Zheng, Zehan Wang, Minghui Fang, Ziang Zhang, Rongjie Huang, Shengpeng Ji, Jialong Zuo, Tao Jin, Zhou Zhao |
| 2025 | ICLR | Smoothing the Shift: Towards Stable Test-Time Adaptation under Complex Multimodal Noises. | Zirun Guo, Tao Jin |
| 2025 | ICLR | Diff-Prompt: Diffusion-Driven Prompt Generator with Mask Supervision. | Weicai Yan, Wang Lin, Zirun Guo, Ye Wang, Fangming Feng, Xiaoda Yang, Zehan Wang, Tao Jin |
| 2025 | ICML | Ranking with Multiple Oracles: From Weak to Strong Stochastic Transitivity. | Tao Jin, Yue Wu, Quanquan Gu, Farzad Farnoud |
| 2025 | ICML | IRBridge: Solving Image Restoration Bridge with Pre-trained Generative Diffusion Models. | Hanting Wang, Tao Jin, Wang Lin, Shulei Wang, Hai Huang, Shengpeng Ji, Zhou Zhao |
| 2025 | IJCNN | STGNet: Spatio-Temporal aware GCN-Based Model for Autism Prediction in Brain fMRI Data. | Hongyan Li, Tao Jin, Li Xiao |
| 2025 | Interspeech | Vela: Scalable Embeddings with Voice Large Language Models for Multimodal Retrieval. | Ruofan Hu, Yan Xia, Minjie Hong, Jieming Zhu, Bo Chen, Xiaoda Yang, Minghui Fang, Tao Jin |
| 2025 | ISMAR | OpenFLAME: Federated Visual Positioning System to Enable Large-Scale Augmented Reality Applications. | Sagar Bharadwaj, Harrison Williams, Luke Wang, Michael Liang, Tao Jin, Srinivasan Seshan, Anthony Rowe |
| 2025 | KDD | Multimodal Conditional Retrieval with High Controllability. | Xiaoda Yang, Xize Cheng, Minghui Fang, Hongshun Qiu, Yuhang Ma, Junyu Lu, Jiaqi Duan, Sihang Cai, Zehan Wang, Ruofan Hu, Dongjie Fu, Zhou Zhao, Tao Jin |
| 2025 | MICCAI | Hypergraph-Guided Federated Distillation Learning for Efficient and Robust Multi-center fMRI Data Analysis. | Tao Jin, Yidan Xu, Yuhan Gao, Xichun Sheng, Chenggang Yan, Yaoqi Sun, Xiangmin Han, Yue Gao |
| 2025 | NAACL | Efficient Prompting for Continual Adaptation to Missing Modalities. | Zirun Guo, Shulei Wang, Wang Lin, Weicai Yan, Yangyang Wu, Tao Jin |
| 2025 | NAACL | Data-Efficiently Learn Large Language Model for Universal 3D Scene Perception. | Zehan Wang, Haifeng Huang, Yang Zhao, Ziang Zhang, Tao Jin, Zhou Zhao |
| 2025 | NAACL | Omni-Chart-600K: A Comprehensive Dataset of Chart Types for Chart Understanding. | Shulei Wang, Shuai Yang, Wang Lin, Zirun Guo, Sihang Cai, Hai Huang, Ye Wang, Jingyuan Chen, Tao Jin |
| 2024 | ACL | TransFace: Unit-Based Audio-Visual Speech Synthesizer for Talking Head Translation. | Xize Cheng, Rongjie Huang, Linjun Li, Zehan Wang, Tao Jin, Aoxiong Yin, Feiyang Chen, Xinyu Duan, Baoxing Huai, Zhou Zhao |
| 2024 | ACL | Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition. | Zirun Guo, Tao Jin, Zhou Zhao |
| 2024 | ACL | Rethinking the Multimodal Correlation of Multimodal Sequential Learning via Generalizable Attentional Results Alignment. | Tao Jin, Wang Lin, Ye Wang, Linjun Li, Xize Cheng, Zhou Zhao |
| 2024 | ACL | Uni-Dubbing: Zero-Shot Speech Synthesis from Visual Articulation. | Songju Lei, Xize Cheng, Mengjiao Lyu, Jianqiao Hu, Jintao Tan, Runlin Liu, Lingyu Xiong, Tao Jin, Xiandong Li, Zhou Zhao |
| 2024 | COLING | Find-the-Common: A Benchmark for Explaining Visual Patterns from Images. | Yuting Shi, Naoya Inoue, Houjing Wei, Yufeng Zhao, Tao Jin |
| 2024 | CVPR | DART: Implicit Doppler Tomography for Radar Novel View Synthesis. | Tianshu Huang, John Miller, Akarsh Prabhakara, Tao Jin, Tarana Laroia, Zico Kolter, Anthony Rowe |
| 2024 | CVPR | MPOD123: One Image to 3D Content Generation Using Mask-Enhanced Progressive Outline-to-Detail Optimization. | Jimin Xu, Tianbao Wang, Tao Jin, Shengyu Zhang, Dongjie Fu, Zhe Wang, Jiangjing Lyu, Chengfei Lv, Chaoyue Niu, Zhou Yu, Zhou Zhao, Fei Wu |
| 2024 | EMNLP | AudioVSR: Enhancing Video Speech Recognition with Audio Data. | Xiaoda Yang, Xize Cheng, Jiaqi Duan, Hongshun Qiu, Minjie Hong, Minghui Fang, Shengpeng Ji, Jialong Zuo, Zhiqing Hong, Zhimeng Zhang, Tao Jin |
| 2024 | ICLR | Variance-aware Regret Bounds for Stochastic Contextual Dueling Bandits. | Qiwei Di, Tao Jin, Yue Wu, Heyang Zhao, Farzad Farnoud, Quanquan Gu |
| 2024 | ICML | FreeBind: Free Lunch in Unified Multimodal Space via Knowledge Fusion. | Zehan Wang, Ziang Zhang, Xize Cheng, Rongjie Huang, Luping Liu, Zhenhui Ye, Haifeng Huang, Yang Zhao, Tao Jin, Peng Gao, Zhou Zhao |
| 2024 | ICML | Non-confusing Generation of Customized Concepts in Diffusion Models. | Wang Lin, Jingyuan Chen, Jiaxin Shi, Yichen Zhu, Chen Liang, Junzhong Miao, Tao Jin, Zhou Zhao, Fei Wu, Shuicheng Yan, Hanwang Zhang |
| 2024 | ICML | Borda Regret Minimization for Generalized Linear Dueling Bandits. | Yue Wu, Tao Jin, Qiwei Di, Hao Lou, Farzad Farnoud, Quanquan Gu |
| 2024 | IGARSS | A Novel Trajectory Extraction Method for High-Speed Weak Targets Based on High-Temporal Spaceborne SAR. | Tao Jin, Wei Yang, Jie Chen, Hongcheng Zeng, Yamin Wang |
| 2024 | KDD | EAGER: Two-Stream Generative Recommender with Behavior-Semantic Collaboration. | Ye Wang, Jiahao Xun, Minjie Hong, Jieming Zhu, Tao Jin, Wang Lin, Haoyuan Li, Linjun Li, Yan Xia, Zhou Zhao, Zhenhua Dong |
| 2024 | NAACL | Prompt-Singer: Controllable Singing-Voice-Synthesis with Natural Language Prompt. | Yongqi Wang, Ruofan Hu, Rongjie Huang, Zhiqing Hong, Ruiqi Li, Wenrui Liu, Fuming You, Tao Jin, Zhou Zhao |
| 2024 | VR | MeshReduce: Scalable and Bandwidth Efficient 3D Scene Capture. | Tao Jin, Mallesham Dasari, Connor Smith, Kittipat Apicharttrisorn, Srinivasan Seshan, Anthony Rowe |
| 2024 | VR | MeshReduce: Split Rendering of Live 3D Scene for Virtual Teleportation. | Tao Jin, Edward Lu, Mallesham Dasari, Kittipat Apicharttrisorn, Srinivasan Seshan, Anthony Rowe |
| 2024 | VR | StageAR: Markerless Mobile Phone Localization for AR in Live Events. | Tao Jin, Shengxi Wu, Mallesham Dasari, Kittipat Apicharttrisorn, Anthony Rowe |
| 2023 | ACIIDS | NegT5: A Cross-Task Text-to-Text Framework for Negation in Question Answering. | Tao Jin, Teeradaj Racharak, Le Minh Nguyen |
| 2023 | ACL | OpenSR: Open-Modality Speech Recognition via Maintaining Multi-Modality Alignment. | Xize Cheng, Tao Jin, Linjun Li, Wang Lin, Xinyu Duan, Zhou Zhao |
| 2023 | ACL | Contrastive Token-Wise Meta-Learning for Unseen Performer Visual Temporal-Aligned Translation. | Linjun Li, Tao Jin, Xize Cheng, Ye Wang, Wang Lin, Rongjie Huang, Zhou Zhao |
| 2023 | ACL | TAVT: Towards Transferable Audio-Visual Text Generation. | Wang Lin, Tao Jin, Wenwen Pan, Linjun Li, Xize Cheng, Ye Wang, Zhou Zhao |
| 2023 | ACL | Semantic-conditioned Dual Adaptation for Cross-domain Query-based Visual Segmentation. | Ye Wang, Tao Jin, Wang Lin, Xize Cheng, Linjun Li, Zhou Zhao |
| 2023 | ACL | Weakly-Supervised Spoken Video Grounding via Semantic Interaction Learning. | Ye Wang, Wang Lin, Shengyu Zhang, Tao Jin, Linjun Li, Xize Cheng, Zhou Zhao |
| 2023 | CVPR | DATE: Domain Adaptive Product Seeker for E-Commerce. | Haoyuan Li, Hao Jiang, Tao Jin, Mengyan Li, Yan Chen, Zhijie Lin, Yang Zhao, Zhou Zhao |
| 2023 | CVPR | Gloss Attention for Gloss-free Sign Language Translation. | Aoxiong Yin, Tianyun Zhong, Li Tang, Weike Jin, Tao Jin, Zhou Zhao |
| 2023 | ICCV | MixSpeech: Cross-Modality Self-Learning with Audio-Visual Stream Mixup for Visual Speech Translation and Recognition. | Xize Cheng, Tao Jin, Rongjie Huang, Linjun Li, Wang Lin, Zehan Wang, Ye Wang, Huadai Liu, Aoxiong Yin, Zhou Zhao |
| 2023 | ICCV | Exploring Group Video Captioning with Efficient Relational Approximation. | Wang Lin, Tao Jin, Ye Wang, Wenwen Pan, Linjun Li, Xize Cheng, Zhou Zhao |
| 2023 | ICRA | High Resolution Point Clouds from mmWave Radar. | Akarsh Prabhakara, Tao Jin, Arnav Das, Gantavya Bhatt, Lilly Kumari, Elahe Soltanaghai, Jeff A. Bilmes, Swarun Kumar, Anthony Rowe |
| 2023 | MOBICOM | RadarHD: Demonstrating Lidar-like Point Clouds from mmWave Radar. | Akarsh Prabhakara, Tao Jin, Arnav Das, Gantavya Bhatt, Lilly Kumari, Elahe Soltanaghai, Jeff A. Bilmes, Swarun Kumar, Anthony Rowe |
| 2022 | ACL | Prior Knowledge and Memory Enriched Transformer for Sign Language Translation. | Tao Jin, Zhou Zhao, Meng Zhang, Xingshan Zeng |
| 2022 | AISTATS | Adaptive Sampling for Heterogeneous Rank Aggregation from Noisy Pairwise Comparisons. | Yue Wu, Tao Jin, Hao Lou, Pan Xu, Farzad Farnoud, Quanquan Gu |
| 2022 | ICRA | LADC: Learning-Based Anti-Disturbance Control for Washing Drone. | Jian Di, Shaofeng Chen, Han Yan, Xinghu Wang, Hepeng Zhang, Haibo Ji, Tao Jin |
| 2022 | ICRA | Collision Avoidance for Multiple Quadrotors Using Elastic Safety Clearance Based Model Predictive Control. | Tao Jin, Xinghu Wang, Haibo Ji, Jian Di, Han Yan |
| 2022 | IWQoS | FABMon: Enabling Fast and Accurate Network Available Bandwidth Estimation. | Tao Jin, Weichao Li, Qing Li, Qianyi Huang, Yong Jiang, Shutao Xia |
| 2022 | SENSYS | Live 3D Scene Capture for Virtual Teleportation. | Tao Jin, Mallesham Dasari, Connor Smith, Kittipat Apicharttrisorn, Anthony Rowe, Srinivasan Seshan |
| 2020 | AAAI | Rank Aggregation via Heterogeneous Thurstone Preference Models. | Tao Jin, Pan Xu, Quanquan Gu, Farzad Farnoud |
| 2020 | EMNLP | Dual Low-Rank Multimodal Fusion. | Tao Jin, Siyu Huang, Yingming Li, Zhongfei Zhang |
| 2020 | IJCAI | SBAT: Video Captioning with Sparse Boundary-Aware Transformer. | Tao Jin, Siyu Huang, Ming Chen, Yingming Li, Zhongfei Zhang |
| 2020 | IWQoS | Towards the Construction of Global IPv6 Hitlist and Efficient Probing of IPv6 Address Space. | Guanglei Song, Lin He, Zhiliang Wang, Jiahai Yang, Tao Jin, Jieling Liu, Guo Li |
| 2019 | EMNLP | Low-Rank HOCA: Efficient High-Order Cross-Modal Attention for Video Captioning. | Tao Jin, Siyu Huang, Yingming Li, Zhongfei Zhang |
| 2019 | PIMRC | Optimization of Computation Resource for Container-Based Multi-MEC Collaboration System. | Tao Jin, Wei Zheng, Xiangming Wen, Xin Chen, Luhan Wang |
| 2018 | DASFAA | Learning the Representation of Medical Features for Clinical Pathway Analysis. | Xiao Xu, Ying Wang, Tao Jin, Jianmin Wang |
| 2017 | HCI | Digital Interface Brain Computer Interaction Method Based on Icon Control. | Yafeng Niu, Chengqi Xue, Haiyan Wang, Wenzhe Tang, Xinyu Zhang, Tao Jin, Yingjie Victor Chen |
| 2016 | CHASE | TCPM: Topic-Based Clinical Pathway Mining. | Xiao Xu, Tao Jin, Zhijie Wei, Cheng Lv, Jianmin Wang |
| 2016 | HCI | Event-Related Potential Study on Visual Selective Attention to Icon Navigation Bar of Digital Interface. | Yafeng Niu, Chengqi Xue, Haiyan Wang, Lei Zhou, Jing Zhang, Ningyue Peng, Tao Jin |
| 2016 | HCI | Cognitive Relevance Mechanism Analysis of DHCI Structure and Composition. | Lei Zhou, Chengqi Xue, Haiyan Wang, Jing Zhang, Xiaojiao Chen, Xiaozhou Zhou, Yafeng Niu, Tao Jin |
| 2016 | HealthCom | Summarizing patient daily activities for clinical pathway mining. | Xiao Xu, Tao Jin, Jianmin Wang |
| 2013 | SIGCOMM | Application-awareness in SDN. | Zafar Ayyub Qazi, Jeongkeun Lee, Tao Jin, Gowtham Bellala, Manfred Arndt, Guevara Noubir |
| 2012 | APWEB | Efficient Retrieval of Similar Workflow Models Based on Behavior. | Tao Jin, Jianmin Wang, Lijie Wen |
| 2012 | DATE | Low power aging-aware register file design by duty cycle balancing. | Shuai Wang, Tao Jin, Chuanlei Zheng, Guangshan Duan |
| 2011 | BPM | Efficiently Querying Business Process Models with BeehiveZ. | Tao Jin, Jianmin Wang, Lijie Wen |
| 2011 | DASFAA | Querying Business Process Models Based on Semantics. | Tao Jin, Jianmin Wang, Lijie Wen |
| 2011 | INFOCOM | WiZi-Cloud: Application-transparent dual ZigBee-WiFi radios for low power internet access. | Tao Jin, Guevara Noubir, Bo Sheng |
| 2011 | Mobisys | Demo: SNEAP: a social network-enabled EAP method no more open hotspots. | Aldo Cassola, Tao Jin, Harsh Kumar, Guevara Noubir, Kamal Sharma |
| 2009 | IAAI | Automatic Generation of Personal Chinese Handwriting by Capturing the Characteristics of Personal Handwriting. | Songhua Xu, Tao Jin, Hao Jiang, Francis C. M. Lau |
| 2009 | MOBIHOC | Zero pre-shared secret key establishment in the presence of jammers. | Tao Jin, Guevara Noubir, Bishal Thapa |
| 2009 | WSDM | A new visual search interface for web browsing. | Songhua Xu, Tao Jin, Francis Chi-Moon Lau |
| 2008 | ISM | Automatic Generation of Music Slide Show Using Personal Photos. | Songhua Xu, Tao Jin, Francis Chi-Moon Lau |
| 2008 | VTC | User Plane Protocol Optimization in Cellular Networks with Decode-and-Forward Type of Relay. | Yikang Xiang, Tao Jin, Jijun Luo, Egon Schulz, Carmelita Grg |
| 2008 | SMC | A sequential group decision process for emergency response. | Huizhang Shen, Wayne W. Huang, Jidi Zhao, Tao Jin |
| 2006 | GLOBECOM | Game-theoretic Distributed Spectrum Sharing for Wireless Cognitive Networks with Heterogeneous QoS. | Tao Jin, Chunxiao Chigan, Zhi Tian |