Bowen Shi
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
43
Venues
17
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
43 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Profiling-Free Mixed-Precision Quantization for MoE LLMs via Fuzzy Rule Interpolation. | Huachen Qi, Ruiyu Zhuo, Bowen Shi, Xiang Chang, Fei Chao, Changjing Shang, Qiang Shen |
| 2026 | ACL | CT-FineBench: A Diagnostic Fidelity Benchmark for Fine-Grained Evaluation of CT Report Generation. | Ruifeng Yuan, Wanxing Chang, Weiwei Cao, Bowen Shi, Zhongyu Wei, Ling Zhang, Jianpeng Zhang |
| 2026 | CHI | NoteFlow: Leveraging Charts as Sight Glasses for Consistent and Continuous Data Flow Tracing. | Yuan Tian, Dazhen Deng, Sen Yang, Huawei Zheng, Bowen Shi, Kai Xiong, Xinjing Yi, Yingcai Wu |
| 2025 | ACL | MDCure: A Scalable Pipeline for Multi-Document Instruction-Following. | Gabrielle Kaili-May Liu, Bowen Shi, Avi Caciularu, Idan Szpektor, Arman Cohan |
| 2025 | ASRU | Meta Audiobox Aesthetics: Unified Automatic Assessment for Speech, Music and Sound. | Andros Tjandra, Yi-Chiao Wu, Baishan Guo, John Hoffman, Brian Ellis, Apoorv Vyas, Bowen Shi, Sanyuan Chen, Matt Le, Nick Zacharov, Carleigh Wood, Ann Lee, Wei-Ning Hsu |
| 2025 | ICCV | METEOR: Multi-Encoder Collaborative Token Pruning for Efficient Vision Language Models. | Yuchen Liu, Yaoming Wang, Bowen Shi, Xiaopeng Zhang, Wenrui Dai, Chenglin Li, Hongkai Xiong, Qi Tian |
| 2025 | Interspeech | Audiobox TTA-RAG: Improving Zero-Shot and Few-Shot Text-To-Audio with Retrieval-Augmented Generation. | Mu Yang, Bowen Shi, Matthew Le, Wei-Ning Hsu, Andros Tjandra |
| 2024 | ACL | XLAVS-R: Cross-Lingual Audio-Visual Speech Representation Learning for Noise-Robust Speech Perception. | HyoJung Han, Mohamed Anwar, Juan Pino, Wei-Ning Hsu, Marine Carpuat, Bowen Shi, Changhan Wang |
| 2024 | ACL | Towards Privacy-Aware Sign Language Translation at Scale. | Phillip Rust, Bowen Shi, Skyler Wang, Necati Cihan Camgz, Jean Maillard |
| 2024 | CIKM | NC | Yue Hou, Xueyuan Chen, He Zhu, Ruomei Liu, Bowen Shi, Jiaheng Liu, Junran Wu, Ke Xu |
| 2024 | ECCV | UMG-CLIP: A Unified Multi-granularity Vision Generalist for Open-World Understanding. | Bowen Shi, Peisen Zhao, Zichen Wang, Yuhang Zhang, Yaoming Wang, Jin Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian, Xiaopeng Zhang |
| 2024 | ICASSP | M2BART: Multilingual and Multimodal Encoder-Decoder Pre-Training for Any-to-Any Machine Translation. | Peng-Jen Chen, Bowen Shi, Kelvin Niu, Ann Lee, Wei-Ning Hsu |
| 2024 | ICLR | Generative Pre-training for Speech with Flow Matching. | Alexander H. Liu, Matthew Le, Apoorv Vyas, Bowen Shi, Andros Tjandra, Wei-Ning Hsu |
| 2024 | ICLR | Hybrid Distillation: Connecting Masked Autoencoders with Contrastive Learners. | Bowen Shi, Xiaopeng Zhang, Yaoming Wang, Jin Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian |
| 2024 | ICLR | BarLeRIa: An Efficient Tuning Framework for Referring Image Segmentation. | Yaoming Wang, Jin Li, Xiaopeng Zhang, Bowen Shi, Chenglin Li, Wenrui Dai, Hongkai Xiong, Qi Tian |
| 2024 | ICML | MusicFlow: Cascaded Flow Matching for Text Guided Music Generation. | K. R. Prajwal, Bowen Shi, Matthew Le, Apoorv Vyas, Andros Tjandra, Mahi Luthra, Baishan Guo, Huiyu Wang, Triantafyllos Afouras, David Kant, Wei-Ning Hsu |
| 2024 | ICML | Bootstrap AutoEncoders With Contrastive Paradigm for Self-supervised Gaze Estimation. | Yaoming Wang, Jin Li, Wenrui Dai, Bowen Shi, Xiaopeng Zhang, Chenglin Li, Hongkai Xiong |
| 2024 | Interspeech | Learning Fine-Grained Controllability on Speech Generation via Efficient Fine-Tuning. | Chung-Ming Chien, Andros Tjandra, Apoorv Vyas, Matt Le, Bowen Shi, Wei-Ning Hsu |
| 2023 | AAAI | Pose-Oriented Transformer with Uncertainty-Guided Refinement for 2D-to-3D Human Pose Estimation. | Han Li, Bowen Shi, Wenrui Dai, Hongwei Zheng, Botao Wang, Yu Sun, Min Guo, Chenglin Li, Junni Zou, Hongkai Xiong |
| 2023 | CVPR | ReVISE: Self-Supervised Speech Resynthesis with Visual Input for Universal and Generalized Speech Regeneration. | Wei-Ning Hsu, Tal Remez, Bowen Shi, Jacob Donley, Yossi Adi |
| 2023 | CVPR | Adapting Shortcut with Normalizing Flow: An Efficient Tuning Framework for Visual Recognition. | Yaoming Wang, Bowen Shi, Xiaopeng Zhang, Jin Li, Yuchen Liu, Wenrui Dai, Chenglin Li, Hongkai Xiong, Qi Tian |
| 2023 | ICASSP | Comparative Layer-Wise Analysis of Self-Supervised Speech Models. | Ankita Pasad, Bowen Shi, Karen Livescu |
| 2023 | ICML | SEGA: Structural Entropy Guided Anchor View for Graph Contrastive Learning. | Junran Wu, Xueyuan Chen, Bowen Shi, Shangzhe Li, Ke Xu |
| 2023 | Interspeech | MuAViC: A Multilingual Audio-Visual Corpus for Robust Speech Recognition and Robust Speech-to-Text Translation. | Mohamed Anwar, Bowen Shi, Vedanuj Goswami, Wei-Ning Hsu, Juan Pino, Changhan Wang |
| 2023 | Interspeech | Expresso: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis. | Tu Anh Nguyen, Wei-Ning Hsu, Antony D'Avirro, Bowen Shi, Itai Gat, Maryam Fazel-Zarandi, Tal Remez, Jade Copet, Gabriel Synnaeve, Michael Hassid, Felix Kreuk, Yossi Adi, Emmanuel Dupoux |
| 2022 | ACL | Searching for fingerspelled content in American Sign Language. | Bowen Shi, Diane Brentari, Greg Shakhnarovich, Karen Livescu |
| 2022 | ECCV | A Transformer-Based Decoder for Semantic Segmentation with Multi-level Context Mining. | Bowen Shi, Dongsheng Jiang, Xiaopeng Zhang, Han Li, Wenrui Dai, Junni Zou, Hongkai Xiong, Qi Tian |
| 2022 | EMNLP | Open-Domain Sign Language Translation Learned from Online Video. | Bowen Shi, Diane Brentari, Gregory Shakhnarovich, Karen Livescu |
| 2022 | ICLR | Learning Audio-Visual Speech Representation by Masked Multimodal Cluster Prediction. | Bowen Shi, Wei-Ning Hsu, Kushal Lakhotia, Abdelrahman Mohamed |
| 2022 | Interspeech | Robust Self-Supervised Audio-Visual Speech Recognition. | Bowen Shi, Wei-Ning Hsu, Abdelrahman Mohamed |
| 2022 | Interspeech | Learning Lip-Based Audio-Visual Speaker Embeddings with AV-HuBERT. | Bowen Shi, Abdelrahman Mohamed, Wei-Ning Hsu |
| 2021 | BMVC | Hierarchical Graph Networks for 3D Human Pose Estimation. | Han Li, Bowen Shi, Wenrui Dai, Yabo Chen, Botao Wang, Yu Sun, Min Guo, Chenglin Li, Junni Zou, Hongkai Xiong |
| 2021 | CVPR | Fingerspelling Detection in American Sign Language. | Bowen Shi, Diane Brentari, Greg Shakhnarovich, Karen Livescu |
| 2020 | ICASSP | Few-Shot Acoustic Event Detection Via Meta Learning. | Bowen Shi, Ming Sun, Krishna C. Puvvada, Chieh-Chi Kao, Spyros Matsoukas, Chao Wang |
| 2020 | ICIP | Tiny-Hourglassnet: An Efficient Design For 3d Human Pose Estimation. | Bowen Shi, Yuhui Xu, Wenrui Dai, Botao Wang, Shuai Zhang, Chenglin Li, Junni Zou, Hongkai Xiong |
| 2020 | Interspeech | A Joint Framework for Audio Tagging and Weakly Supervised Acoustic Event Detection Using DenseNet with Global Average Pooling. | Chieh-Chi Kao, Bowen Shi, Ming Sun, Chao Wang |
| 2019 | GLOBECOM | Deep Neural Network-Based Algorithm Approximation via Multivariate Polynomial Regression. | Chunmiao Liu, Bowen Shi, Chenglin Li, Junni Zou, Yingqi Chen, Hongkai Xiong |
| 2019 | ICASSP | Semi-supervised Acoustic Event Detection Based on Tri-training. | Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang |
| 2019 | ICCV | Fingerspelling Recognition in the Wild With Iterative Visual Attention. | Bowen Shi, Aurora Martinez Del Rio, Jonathan Keane, Diane Brentari, Greg Shakhnarovich, Karen Livescu |
| 2019 | Interspeech | On the Contributions of Visual and Textual Supervision in Low-Resource Semantic Speech Retrieval. | Ankita Pasad, Bowen Shi, Herman Kamper, Karen Livescu |
| 2019 | Interspeech | Compression of Acoustic Event Detection Models with Quantized Distillation. | Bowen Shi, Ming Sun, Chieh-Chi Kao, Viktor Rozgic, Spyros Matsoukas, Chao Wang |
| 2017 | ASRU | Multitask training with unlabeled data for end-to-end sign language fingerspelling recognition. | Bowen Shi, Karen Livescu |
| 2015 | IECON | Accuracy improvement of carrier signal injection sensorless control for IPMSM in consideration of inverter nonlinearity. | Tianhao Wang, Bowen Shi, John Xu, Chris Gerada |