Jialong Zuo
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
9
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Learning to Tell Apart: Weakly Supervised Video Anomaly Detection via Disentangled Semantic Alignment. | Wenti Yin, Huaxin Zhang, Xiang Wang, Yuqing Lu, Yicheng Zhang, Bingquan Gong, Jialong Zuo, Li Yu, Changxin Gao, Nong Sang |
| 2025 | AAAI | Speech Watermarking with Discrete Intermediate Representations. | Shengpeng Ji, Ziyue Jiang, Jialong Zuo, Minghui Fang, Yifu Chen, Tao Jin, Zhou Zhao |
| 2025 | AAAI | L-Man: A Large Multi-modal Model Unifying Human-centric Tasks. | Jialong Zuo, Ying Nie, Tianyu Guo, Huaxin Zhang, Jiahao Hong, Nong Sang, Changxin Gao, Kai Han |
| 2025 | ACL | CART: A Generative Cross-Modal Retrieval Framework With Coarse-To-Fine Semantic Modeling. | Minghui Fang, Shengpeng Ji, Jialong Zuo, Hai Huang, Yan Xia, Jieming Zhu, Xize Cheng, Xiaoda Yang, Wenrui Liu, Gang Wang, Zhenhua Dong, Zhou Zhao |
| 2025 | ACL | Language-Codec: Bridging Discrete Codec Representations and Speech Language Models. | Shengpeng Ji, Minghui Fang, Jialong Zuo, Ziyue Jiang, Dingdong Wang, Hanting Wang, Hai Huang, Zhou Zhao |
| 2025 | ACL | ControlSpeech: Towards Simultaneous and Independent Zero-shot Speaker Cloning and Zero-shot Language Style Control. | Shengpeng Ji, Qian Chen, Wen Wang, Jialong Zuo, Minghui Fang, Ziyue Jiang, Hai Huang, Zehan Wang, Xize Cheng, Siqi Zheng, Zhou Zhao |
| 2025 | ACL | Rhythm Controllable and Efficient Zero-Shot Voice Conversion via Shortcut Flow Matching. | Jialong Zuo, Shengpeng Ji, Minghui Fang, Mingze Li, Ziyue Jiang, Xize Cheng, Xiaoda Yang, Feiyang Chen, Xinyu Duan, Zhou Zhao |
| 2025 | COLING | VoxpopuliTTS: a large-scale multilingual TTS corpus for zero-shot speech generation. | Wenrui Liu, Jionghao Bai, Xize Cheng, Jialong Zuo, Ziyue Jiang, Shengpeng Ji, Minghui Fang, Xiaoda Yang, Qian Yang, Zhou Zhao |
| 2025 | CVPR | Holmes-VAU: Towards Long-term Video Anomaly Understanding at Any Granularity. | Huaxin Zhang, Xiaohao Xu, Xiang Wang, Jialong Zuo, Xiaonan Huang, Changxin Gao, Shanjun Zhang, Li Yu, Nong Sang |
| 2025 | ICASSP | Enhancing Expressive Voice Conversion with Discrete Pitch-Conditioned Flow Matching Model. | Jialong Zuo, Shengpeng Ji, Minghui Fang, Ziyue Jiang, Xize Cheng, Qian Yang, Wenrui Liu, Guangyan Zhang, Zehai Tu, Yiwen Guo, Zhou Zhao |
| 2025 | ICCV | Partial Forward Blocking: A Novel Data Pruning Paradigm for Lossless Training Acceleration. | Dongyue Wu, Zilin Guo, Jialong Zuo, Nong Sang, Changxin Gao |
| 2025 | ICLR | OmniSep: Unified Omni-Modality Sound Separation with Query-Mixup. | Xize Cheng, Siqi Zheng, Zehan Wang, Minghui Fang, Ziang Zhang, Rongjie Huang, Shengpeng Ji, Jialong Zuo, Tao Jin, Zhou Zhao |
| 2025 | ICLR | WavTokenizer: an Efficient Acoustic Discrete Codec Tokenizer for Audio Language Modeling. | Shengpeng Ji, Ziyue Jiang, Wen Wang, Yifu Chen, Minghui Fang, Jialong Zuo, Qian Yang, Xize Cheng, Zehan Wang, Ruiqi Li, Ziang Zhang, Xiaoda Yang, Rongjie Huang, Yidi Jiang, Qian Chen, Siqi Zheng, Zhou Zhao |
| 2025 | Interspeech | GTA: Towards Generative Text-To-Audio Retrieval via Multi-Scale Tokenizer. | Minghui Fang, Shengpeng Ji, Jialong Zuo, Xize Cheng, Wenrui Liu, Xiaoda Yang, Ruofan Hu, Jieming Zhu, Zhou Zhao |
| 2025 | Interspeech | MelRe: Vision-Based Mel-Spectrogram Restoration. | Kaixuan Luan, Xiaoda Yang, Shile Cai, Ruofan Hu, Minghui Fang, Wenrui Liu, Jialong Zuo, Jiaqi Duan, Yuhang Ma, Junyu Lu |
| 2024 | ACL | MobileSpeech: A Fast and High-Fidelity Framework for Mobile Zero-Shot Text-to-Speech. | Shengpeng Ji, Ziyue Jiang, Hanting Wang, Jialong Zuo, Zhou Zhao |
| 2024 | CVPR | UFineBench: Towards Text-based Person Retrieval with Ultra-fine Granularity. | Jialong Zuo, Hanyu Zhou, Ying Nie, Feng Zhang, Tianyu Guo, Nong Sang, Yunhe Wang, Changxin Gao |
| 2024 | EMNLP | AudioVSR: Enhancing Video Speech Recognition with Audio Data. | Xiaoda Yang, Xize Cheng, Jiaqi Duan, Hongshun Qiu, Minjie Hong, Minghui Fang, Shengpeng Ji, Jialong Zuo, Zhiqing Hong, Zhimeng Zhang, Tao Jin |
| 2024 | ICASSP | TextrolSpeech: A Text Style Control Speech Corpus with Codec Language Text-to-Speech Models. | Shengpeng Ji, Jialong Zuo, Minghui Fang, Ziyue Jiang, Feiyang Chen, Xinyu Duan, Baoxing Huai, Zhou Zhao |
| 2024 | Interspeech | MSceneSpeech: A Multi-Scene Speech Dataset For Expressive Speech Synthesis. | Qian Yang, Jialong Zuo, Zhe Su, Ziyue Jiang, Mingze Li, Zhou Zhao, Feiyang Chen, Zhefeng Wang, Baoxing Huai |
| 2023 | ACL | FluentSpeech: Stutter-Oriented Automatic Speech Editing with Context-Aware Diffusion Models. | Ziyue Jiang, Qian Yang, Jialong Zuo, Zhenhui Ye, Rongjie Huang, Yi Ren, Zhou Zhao |