| 2026 | EACL | Do Audio LLMs Really LISTEN, or Just Transcribe? Measuring Lexical vs. Acoustic Emotion Cues Reliance. | Jingyi Chen, Zhimeng Guo, Jiyun Chun, Pichao Wang, Andrew Perrault, Micha Elsner |
| 2025 | ACL | CRPO: Confidence-Reward Driven Preference Optimization for Machine Translation. | Guofeng Cui, Pichao Wang, Yang Liu, Zemian Ke, Zhu Liu, Vimal Bhat |
| 2025 | ICASSP | Beyond Speaker Identity: Text Guided Target Speech Extraction. | Mingyue Huo, Abhinav Jain, Cong Phuoc Huynh, Fanjie Kong, Pichao Wang, Zhu Liu, Vimal Bhat |
| 2025 | ICASSP | Learning Rich Speech Representations with Acoustic-Semantic Factorization. | Minxue Niu, Najmeh Sadoughi, Abhishek Yanamandra, Pichao Wang, Zhu Liu, Vimal Bhat, S. Elizabeth Norred |
| 2025 | ICCV | Training-Free Text-Guided Image Editing with Visual Autoregressive Model. | Yufei Wang, Lanqing Guo, Zhihao Li, Jiaxing Huang, Pichao Wang, Bihan Wen, Jian Wang |
| 2025 | ICLR | Bridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach. | Zechen Bai, Tianjun Xiao, Tong He, Pichao Wang, Zheng Zhang, Thomas Brox, Mike Zheng Shou |
| 2025 | Interspeech | Fine-Tuning Text-to-Speech Diffusion Models Using Reinforcement Learning with Human Feedback. | Jingyi Chen, Ju-Seung Byun, Micha Elsner, Pichao Wang, Andrew Perrault |
| 2024 | CVPR | Hourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation. | Wenhao Li, Mengyuan Liu, Hong Liu, Pichao Wang, Jialun Cai, Nicu Sebe |
| 2024 | CVPR | Text Is MASS: Modeling as Stochastic Embedding for Text-Video Retrieval. | Jiamian Wang, Pichao Wang, Guohao Sun, Dongfang Liu, Sohail A. Dianat, Raghuveer Rao, Majid Rabbani, Zhiqiang Tao |
| 2023 | AAAI | Head-Free Lightweight Semantic Segmentation with Linear Transformer. | Bo Dong, Pichao Wang, Fan Wang |
| 2023 | AAAI | Frequency Domain Disentanglement for Arbitrary Neural Style Transfer. | Dongyang Li, Hao Luo, Pichao Wang, Zhibin Wang, Shang Liu, Fan Wang |
| 2023 | CVPR | Making Vision Transformers Efficient from A Token Sparsification View. | Shuning Chang, Pichao Wang, Ming Lin, Fan Wang, David Junhao Zhang, Rong Jin, Mike Zheng Shou |
| 2023 | CVPR | DOAD: Decoupled One Stage Action Detection Network. | Shuning Chang, Pichao Wang, Fan Wang, Jiashi Feng, Mike Zheng Shou |
| 2023 | CVPR | Selective Structured State-Spaces for Long-Form Video Understanding. | Jue Wang, Wentao Zhu, Pichao Wang, Xiang Yu, Linda Liu, Mohamed Omar, Raffay Hamid |
| 2023 | CVPR | PoseFormerV2: Exploring Frequency Domain for Efficient and Robust 3D Human Pose Estimation. | Qitao Zhao, Ce Zheng, Mengyuan Liu, Pichao Wang, Chen Chen |
| 2023 | ICCV | Revisiting Vision Transformer from the View of Path Ensemble. | Shuning Chang, Pichao Wang, Hao Luo, Fan Wang, Mike Zheng Shou |
| 2023 | ICCV | Audio-Enhanced Text-to-Video Retrieval using Text-Conditioned Feature Alignment. | Sarah Ibrahimi, Xiaohang Sun, Pichao Wang, Amanmeet Garg, Ashutosh Sanan, Mohamed Omar |
| 2022 | AAAI | Scaled ReLU Matters for Training Vision Transformers. | Pichao Wang, Xue Wang, Hao Luo, Jingkai Zhou, Zhipeng Zhou, Fan Wang, Hao Li, Rong Jin |
| 2022 | ACCV | Focal and Global Spatial-Temporal Transformer for Skeleton-Based Action Recognition. | Zhimin Gao, Peitao Wang, Pei Lv, Xiaoheng Jiang, Qidong Liu, Pichao Wang, Mingliang Xu, Wanqing Li |
| 2022 | CVPR | EPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation. | Hansheng Chen, Pichao Wang, Fan Wang, Wei Tian, Lu Xiong, Hao Li |
| 2022 | CVPR | MHFormer: Multi-Hypothesis Transformer for 3D Human Pose Estimation. | Wenhao Li, Hong Liu, Hao Tang, Pichao Wang, Luc Van Gool |
| 2022 | CVPR | Decoupling and Recoupling Spatiotemporal Representation for RGB-D-based Motion Recognition. | Benjia Zhou, Pichao Wang, Jun Wan, Yanyan Liang, Fan Wang, Du Zhang, Zhen Lei, Hao Li, Rong Jin |
| 2022 | ECCV | KVT: k-NN Attention for Boosting Vision Transformers. | Pichao Wang, Xue Wang, Fan Wang, Ming Lin, Shuning Chang, Hao Li, Rong Jin |
| 2022 | ECCV | TransFGU: A Top-Down Approach to Fine-Grained Unsupervised Semantic Segmentation. | Zhaoyuan Yin, Pichao Wang, Fan Wang, Xianzhe Xu, Hanling Zhang, Hao Li, Rong Jin |
| 2022 | ICASSP | Image-to-Video Re-Identification via Mutual Discriminative Knowledge Transfer. | Pichao Wang, Fan Wang, Hao Li |
| 2022 | ICLR | CDTrans: Cross-domain Transformer for Unsupervised Domain Adaptation. | Tongkun Xu, Weihua Chen, Pichao Wang, Fan Wang, Hao Li, Rong Jin |
| 2021 | ICCV | TransReID: Transformer-based Object Re-Identification. | Shuting He, Hao Luo, Pichao Wang, Fan Wang, Hao Li, Wei Jiang |
| 2021 | ICCV | Zen-NAS: A Zero-Shot NAS for High-Performance Image Recognition. | Ming Lin, Pichao Wang, Zhenhong Sun, Hesen Chen, Xiuyu Sun, Qi Qian, Hao Li, Rong Jin |
| 2020 | AAAI | R²MRF: Defocus Blur Detection via Recurrently Refining Multi-Scale Residual Features. | Chang Tang, Xinwang Liu, Xinzhong Zhu, En Zhu, Kun Sun, Pichao Wang, Lizhe Wang, Albert Y. Zomaya |
| 2019 | VCIP | DVONet: Unsupervised Monocular Depth Estimation and Visual Odometry. | Xiangyu Li, Yonghong Hou, Qi Wu, Pichao Wang, Wanqing Li |
| 2018 | AAAI | Cooperative Training of Deep Aggregation Networks for RGB-D Action Recognition. | Pichao Wang, Wanqing Li, Jun Wan, Philip Ogunbona, Xinwang Liu |
| 2017 | CVPR | Scene Flow to Action Map: A New Representation for RGB-D Based Action Recognition with Convolutional Neural Networks. | Pichao Wang, Wanqing Li, Zhimin Gao, Yuyao Zhang, Chang Tang, Philip Ogunbona |
| 2016 | ICPR | Large-scale Isolated Gesture Recognition using Convolutional Neural Networks. | Pichao Wang, Wanqing Li, Song Liu, Zhimin Gao, Chang Tang, Philip Ogunbona |
| 2016 | ICPR | Large-scale Continuous Gesture Recognition Using Convolutional Neural Networks. | Pichao Wang, Wanqing Li, Song Liu, Yuyao Zhang, Zhimin Gao, Philip Ogunbona |
| 2016 | ICPR | A Large Scale RGB-D Dataset for Action Recognition. | Jing Zhang, Wanqing Li, Pichao Wang, Philip Ogunbona, Song Liu, Chang Tang |
| 2014 | DICTA | Mining Mid-Level Features for Action Recognition Based on Effective Skeleton Representation. | Pichao Wang, Wanqing Li, Philip Ogunbona, Zhimin Gao, Hanling Zhang |