Skip to content

Pichao Wang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

36

Venues

13

Active years

2014–2026

Best venue rank

A*

Where they publish

Papers

36 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLDo Audio LLMs Really LISTEN, or Just Transcribe? Measuring Lexical vs. Acoustic Emotion Cues Reliance.Jingyi Chen, Zhimeng Guo, Jiyun Chun, Pichao Wang, Andrew Perrault, Micha Elsner
2025ACLCRPO: Confidence-Reward Driven Preference Optimization for Machine Translation.Guofeng Cui, Pichao Wang, Yang Liu, Zemian Ke, Zhu Liu, Vimal Bhat
2025ICASSPBeyond Speaker Identity: Text Guided Target Speech Extraction.Mingyue Huo, Abhinav Jain, Cong Phuoc Huynh, Fanjie Kong, Pichao Wang, Zhu Liu, Vimal Bhat
2025ICASSPLearning Rich Speech Representations with Acoustic-Semantic Factorization.Minxue Niu, Najmeh Sadoughi, Abhishek Yanamandra, Pichao Wang, Zhu Liu, Vimal Bhat, S. Elizabeth Norred
2025ICCVTraining-Free Text-Guided Image Editing with Visual Autoregressive Model.Yufei Wang, Lanqing Guo, Zhihao Li, Jiaxing Huang, Pichao Wang, Bihan Wen, Jian Wang
2025ICLRBridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach.Zechen Bai, Tianjun Xiao, Tong He, Pichao Wang, Zheng Zhang, Thomas Brox, Mike Zheng Shou
2025InterspeechFine-Tuning Text-to-Speech Diffusion Models Using Reinforcement Learning with Human Feedback.Jingyi Chen, Ju-Seung Byun, Micha Elsner, Pichao Wang, Andrew Perrault
2024CVPRHourglass Tokenizer for Efficient Transformer-Based 3D Human Pose Estimation.Wenhao Li, Mengyuan Liu, Hong Liu, Pichao Wang, Jialun Cai, Nicu Sebe
2024CVPRText Is MASS: Modeling as Stochastic Embedding for Text-Video Retrieval.Jiamian Wang, Pichao Wang, Guohao Sun, Dongfang Liu, Sohail A. Dianat, Raghuveer Rao, Majid Rabbani, Zhiqiang Tao
2023AAAIHead-Free Lightweight Semantic Segmentation with Linear Transformer.Bo Dong, Pichao Wang, Fan Wang
2023AAAIFrequency Domain Disentanglement for Arbitrary Neural Style Transfer.Dongyang Li, Hao Luo, Pichao Wang, Zhibin Wang, Shang Liu, Fan Wang
2023CVPRMaking Vision Transformers Efficient from A Token Sparsification View.Shuning Chang, Pichao Wang, Ming Lin, Fan Wang, David Junhao Zhang, Rong Jin, Mike Zheng Shou
2023CVPRDOAD: Decoupled One Stage Action Detection Network.Shuning Chang, Pichao Wang, Fan Wang, Jiashi Feng, Mike Zheng Shou
2023CVPRSelective Structured State-Spaces for Long-Form Video Understanding.Jue Wang, Wentao Zhu, Pichao Wang, Xiang Yu, Linda Liu, Mohamed Omar, Raffay Hamid
2023CVPRPoseFormerV2: Exploring Frequency Domain for Efficient and Robust 3D Human Pose Estimation.Qitao Zhao, Ce Zheng, Mengyuan Liu, Pichao Wang, Chen Chen
2023ICCVRevisiting Vision Transformer from the View of Path Ensemble.Shuning Chang, Pichao Wang, Hao Luo, Fan Wang, Mike Zheng Shou
2023ICCVAudio-Enhanced Text-to-Video Retrieval using Text-Conditioned Feature Alignment.Sarah Ibrahimi, Xiaohang Sun, Pichao Wang, Amanmeet Garg, Ashutosh Sanan, Mohamed Omar
2022AAAIScaled ReLU Matters for Training Vision Transformers.Pichao Wang, Xue Wang, Hao Luo, Jingkai Zhou, Zhipeng Zhou, Fan Wang, Hao Li, Rong Jin
2022ACCVFocal and Global Spatial-Temporal Transformer for Skeleton-Based Action Recognition.Zhimin Gao, Peitao Wang, Pei Lv, Xiaoheng Jiang, Qidong Liu, Pichao Wang, Mingliang Xu, Wanqing Li
2022CVPREPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation.Hansheng Chen, Pichao Wang, Fan Wang, Wei Tian, Lu Xiong, Hao Li
2022CVPRMHFormer: Multi-Hypothesis Transformer for 3D Human Pose Estimation.Wenhao Li, Hong Liu, Hao Tang, Pichao Wang, Luc Van Gool
2022CVPRDecoupling and Recoupling Spatiotemporal Representation for RGB-D-based Motion Recognition.Benjia Zhou, Pichao Wang, Jun Wan, Yanyan Liang, Fan Wang, Du Zhang, Zhen Lei, Hao Li, Rong Jin
2022ECCVKVT: k-NN Attention for Boosting Vision Transformers.Pichao Wang, Xue Wang, Fan Wang, Ming Lin, Shuning Chang, Hao Li, Rong Jin
2022ECCVTransFGU: A Top-Down Approach to Fine-Grained Unsupervised Semantic Segmentation.Zhaoyuan Yin, Pichao Wang, Fan Wang, Xianzhe Xu, Hanling Zhang, Hao Li, Rong Jin
2022ICASSPImage-to-Video Re-Identification via Mutual Discriminative Knowledge Transfer.Pichao Wang, Fan Wang, Hao Li
2022ICLRCDTrans: Cross-domain Transformer for Unsupervised Domain Adaptation.Tongkun Xu, Weihua Chen, Pichao Wang, Fan Wang, Hao Li, Rong Jin
2021ICCVTransReID: Transformer-based Object Re-Identification.Shuting He, Hao Luo, Pichao Wang, Fan Wang, Hao Li, Wei Jiang
2021ICCVZen-NAS: A Zero-Shot NAS for High-Performance Image Recognition.Ming Lin, Pichao Wang, Zhenhong Sun, Hesen Chen, Xiuyu Sun, Qi Qian, Hao Li, Rong Jin
2020AAAIR²MRF: Defocus Blur Detection via Recurrently Refining Multi-Scale Residual Features.Chang Tang, Xinwang Liu, Xinzhong Zhu, En Zhu, Kun Sun, Pichao Wang, Lizhe Wang, Albert Y. Zomaya
2019VCIPDVONet: Unsupervised Monocular Depth Estimation and Visual Odometry.Xiangyu Li, Yonghong Hou, Qi Wu, Pichao Wang, Wanqing Li
2018AAAICooperative Training of Deep Aggregation Networks for RGB-D Action Recognition.Pichao Wang, Wanqing Li, Jun Wan, Philip Ogunbona, Xinwang Liu
2017CVPRScene Flow to Action Map: A New Representation for RGB-D Based Action Recognition with Convolutional Neural Networks.Pichao Wang, Wanqing Li, Zhimin Gao, Yuyao Zhang, Chang Tang, Philip Ogunbona
2016ICPRLarge-scale Isolated Gesture Recognition using Convolutional Neural Networks.Pichao Wang, Wanqing Li, Song Liu, Zhimin Gao, Chang Tang, Philip Ogunbona
2016ICPRLarge-scale Continuous Gesture Recognition Using Convolutional Neural Networks.Pichao Wang, Wanqing Li, Song Liu, Yuyao Zhang, Zhimin Gao, Philip Ogunbona
2016ICPRA Large Scale RGB-D Dataset for Action Recognition.Jing Zhang, Wanqing Li, Pichao Wang, Philip Ogunbona, Song Liu, Chang Tang
2014DICTAMining Mid-Level Features for Action Recognition Based on Effective Skeleton Representation.Pichao Wang, Wanqing Li, Philip Ogunbona, Zhimin Gao, Hanling Zhang