Skip to content

Bowen Shi

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

43

Venues

17

Active years

2015–2026

Best venue rank

A*

Where they publish

Papers

43 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLProfiling-Free Mixed-Precision Quantization for MoE LLMs via Fuzzy Rule Interpolation.Huachen Qi, Ruiyu Zhuo, Bowen Shi, Xiang Chang, Fei Chao, Changjing Shang, Qiang Shen
2026ACLCT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation.Ruifeng Yuan, Wanxing Chang, Weiwei Cao, Bowen Shi, Zhongyu Wei, Ling Zhang, Jianpeng Zhang
2026CHINoteFlow: Leveraging Charts as Sight Glasses for Consistent and Continuous Data Flow Tracing.Yuan Tian, Dazhen Deng, Sen Yang, Huawei Zheng, Bowen Shi, Kai Xiong, Xinjing Yi, Yingcai Wu
2025ACLMDCure: A Scalable Pipeline for Multi-Document Instruction-Following.Gabrielle Kaili-May Liu, Bowen Shi, Avi Caciularu, Idan Szpektor, Arman Cohan
2025ASRUMeta Audiobox Aesthetics: Unified Automatic Assessment for Speech, Music and Sound.Andros Tjandra, Yi-Chiao Wu, Baishan Guo, John Hoffman, Brian Ellis, Apoorv Vyas, Bowen Shi, Sanyuan Chen, Matt Le, Nick Zacharov, Carleigh Wood, Ann Lee, Wei-Ning Hsu
2025ICCVMETEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models.Yuchen Liu, Yaoming Wang, Bowen Shi, Xiaopeng Zhang, Wenrui Dai, Chenglin Li, Hongkai Xiong, Qi Tian
2025InterspeechAudiobox TTA-RAG: Improving Zero-Shot and Few-Shot Text-To-Audio with Retrieval-Augmented Generation.Mu Yang, Bowen Shi, Matthew Le, Wei-Ning Hsu, Andros Tjandra
2024ACLXLAVS-R: Cross-Lingual Audio-Visual Speech Representation Learning for Noise-Robust Speech Perception.HyoJung Han, Mohamed Anwar, Juan Pino, Wei-Ning Hsu, Marine Carpuat, Bowen Shi, Changhan Wang
2024ACLTowards Privacy-Aware Sign Language Translation at Scale.Phillip Rust, Bowen Shi, Skyler Wang, Necati Cihan Camgz, Jean Maillard
2024CIKMNCYue Hou, Xueyuan Chen, He Zhu, Ruomei Liu, Bowen Shi, Jiaheng Liu, Junran Wu, Ke Xu
2024ECCVUMG-CLIP: A Unified Multi-granularity Vision Generalist for Open-World Understanding.Bowen Shi, Peisen Zhao, Zichen Wang, Yuhang Zhang, Yaoming Wang, Jin Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian, Xiaopeng Zhang
2024ICASSPM2BART: Multilingual and Multimodal Encoder-Decoder Pre-Training for Any-to-Any Machine Translation.Peng-Jen Chen, Bowen Shi, Kelvin Niu, Ann Lee, Wei-Ning Hsu
2024ICLRGenerative Pre-training for Speech with Flow Matching.Alexander H. Liu, Matthew Le, Apoorv Vyas, Bowen Shi, Andros Tjandra, Wei-Ning Hsu
2024ICLRHybrid Distillation: Connecting Masked Autoencoders with Contrastive Learners.Bowen Shi, Xiaopeng Zhang, Yaoming Wang, Jin Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian
2024ICLRBarLeRIa: An Efficient Tuning Framework for Referring Image Segmentation.Yaoming Wang, Jin Li, Xiaopeng Zhang, Bowen Shi, Chenglin Li, Wenrui Dai, Hongkai Xiong, Qi Tian
2024ICMLMusicFlow: Cascaded Flow Matching for Text Guided Music Generation.K. R. Prajwal, Bowen Shi, Matthew Le, Apoorv Vyas, Andros Tjandra, Mahi Luthra, Baishan Guo, Huiyu Wang, Triantafyllos Afouras, David Kant, Wei-Ning Hsu
2024ICMLBootstrap AutoEncoders With Contrastive Paradigm for Self-supervised Gaze Estimation.Yaoming Wang, Jin Li, Wenrui Dai, Bowen Shi, Xiaopeng Zhang, Chenglin Li, Hongkai Xiong
2024InterspeechLearning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning.Chung-Ming Chien, Andros Tjandra, Apoorv Vyas, Matt Le, Bowen Shi, Wei-Ning Hsu
2023AAAIPose-Oriented Transformer with Uncertainty-Guided Refinement for 2D-to-3D Human Pose Estimation.Han Li, Bowen Shi, Wenrui Dai, Hongwei Zheng, Botao Wang, Yu Sun, Min Guo, Chenglin Li, Junni Zou, Hongkai Xiong
2023CVPRReVISE: Self-Supervised Speech Resynthesis with Visual Input for Universal and Generalized Speech Regeneration.Wei-Ning Hsu, Tal Remez, Bowen Shi, Jacob Donley, Yossi Adi
2023CVPRAdapting Shortcut with Normalizing Flow: An Efficient Tuning Framework for Visual Recognition.Yaoming Wang, Bowen Shi, Xiaopeng Zhang, Jin Li, Yuchen Liu, Wenrui Dai, Chenglin Li, Hongkai Xiong, Qi Tian
2023ICASSPComparative Layer-Wise Analysis of Self-Supervised Speech Models.Ankita Pasad, Bowen Shi, Karen Livescu
2023ICMLSEGA: Structural Entropy Guided Anchor View for Graph Contrastive Learning.Junran Wu, Xueyuan Chen, Bowen Shi, Shangzhe Li, Ke Xu
2023InterspeechMuAViC: A Multilingual Audio-Visual Corpus for Robust Speech Recognition and Robust Speech-to-Text Translation.Mohamed Anwar, Bowen Shi, Vedanuj Goswami, Wei-Ning Hsu, Juan Pino, Changhan Wang
2023InterspeechExpresso: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis.Tu Anh Nguyen, Wei-Ning Hsu, Antony D'Avirro, Bowen Shi, Itai Gat, Maryam Fazel-Zarandi, Tal Remez, Jade Copet, Gabriel Synnaeve, Michael Hassid, Felix Kreuk, Yossi Adi, Emmanuel Dupoux
2022ACLSearching for fingerspelled content in American Sign Language.Bowen Shi, Diane Brentari, Greg Shakhnarovich, Karen Livescu
2022ECCVA Transformer-Based Decoder for Semantic Segmentation with Multi-level Context Mining.Bowen Shi, Dongsheng Jiang, Xiaopeng Zhang, Han Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian
2022EMNLPOpen-Domain Sign Language Translation Learned from Online Video.Bowen Shi, Diane Brentari, Gregory Shakhnarovich, Karen Livescu
2022ICLRLearning Audio-Visual Speech Representation by Masked Multimodal Cluster Prediction.Bowen Shi, Wei-Ning Hsu, Kushal Lakhotia, Abdelrahman Mohamed
2022InterspeechRobust Self-Supervised Audio-Visual Speech Recognition.Bowen Shi, Wei-Ning Hsu, Abdelrahman Mohamed
2022InterspeechLearning Lip-Based Audio-Visual Speaker Embeddings with AV-HuBERT.Bowen Shi, Abdelrahman Mohamed, Wei-Ning Hsu
2021BMVCHierarchical Graph Networks for 3D Human Pose Estimation.Han Li, Bowen Shi, Wenrui Dai, Yabo Chen, Botao Wang, Yu Sun, Min Guo, Chenglin Li, Junni Zou, Hongkai Xiong
2021CVPRFingerspelling Detection in American Sign Language.Bowen Shi, Diane Brentari, Greg Shakhnarovich, Karen Livescu
2020ICASSPFew-Shot Acoustic Event Detection Via Meta Learning.Bowen Shi, Ming Sun, Krishna C. Puvvada, Chieh-Chi Kao, Spyros Matsoukas, Chao Wang
2020ICIPTiny-Hourglassnet: An Efficient Design For 3d Human Pose Estimation.Bowen Shi, Yuhui Xu, Wenrui Dai, Botao Wang, Shuai Zhang, Chenglin Li, Junni Zou, Hongkai Xiong
2020InterspeechA Joint Framework for Audio Tagging and Weakly Supervised Acoustic Event Detection Using DenseNet with Global Average Pooling.Chieh-Chi Kao, Bowen Shi, Ming Sun, Chao Wang
2019GLOBECOMDeep Neural Network-Based Algorithm Approximation via Multivariate Polynomial Regression.Chunmiao Liu, Bowen Shi, Chenglin Li, Junni Zou, Yingqi Chen, Hongkai Xiong
2019ICASSPSemi-supervised Acoustic Event Detection Based on Tri-training.Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang
2019ICCVFingerspelling Recognition in the Wild With Iterative Visual Attention.Bowen Shi, Aurora Martinez Del Rio, Jonathan Keane, Diane Brentari, Greg Shakhnarovich, Karen Livescu
2019InterspeechOn the Contributions of Visual and Textual Supervision in Low-Resource Semantic Speech Retrieval.Ankita Pasad, Bowen Shi, Herman Kamper, Karen Livescu
2019InterspeechCompression of Acoustic Event Detection Models with Quantized Distillation.Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang
2017ASRUMultitask training with unlabeled data for end-to-end sign language fingerspelling recognition.Bowen Shi, Karen Livescu
2015IECONAccuracy improvement of carrier signal injection sensorless control for IPMSM in consideration of inverter nonlinearity.Tianhao Wang, Bowen Shi, John Xu, Chris Gerada