| 2026 | AAAI | Phased One-Step Adversarial Equilibrium for Video Diffusion Models. | Jiaxiang Cheng, Bing Ma, Xuhua Ren, Hongyi Henry Jin, Kai Yu, Peng Zhang, Wenyue Li, Yuan Zhou, Tianxiang Zheng, Qinglin Lu |
| 2026 | AAAI | AHAMask: Reliable Task Specification for Large Audio Language Models Without Instructions. | Yiwei Guo, Bohan Li, Hankun Wang, Zhihan Li, Shuai Wang, Xie Chen, Kai Yu |
| 2026 | AAAI | MergeDNA: Context-Aware Genome Modeling with Dynamic Tokenization Through Token Merging. | Siyuan Li, Kai Yu, Anna Wang, Zicheng Liu, Chang Yu, Jingbo Zhou, Qirong Yang, Yucheng Guo, Xiaoming Zhang, Stan Z. Li |
| 2026 | EACL | BSCodec: A Band-Split Neural Codec for High-Quality Universal Audio Reconstruction. | Haoran Wang, Jiatong Shi, Jinchuan Tian, Bohan Li, Kai Yu, Shinji Watanabe |
| 2025 | AAAI | VQTalker: Towards Multilingual Talking Avatars Through Facial Motion Tokenization. | Tao Liu, Ziyang Ma, Qi Chen, Feilong Chen, Shuai Fan, Xie Chen, Kai Yu |
| 2025 | ACL | GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement. | Yifan Yang, Zheshu Song, Jianheng Zhuo, Mingyu Cui, Jinpeng Li, Bo Yang, Yexing Du, Ziyang Ma, Xunying Liu, Ziyuan Wang, Ke Li, Shuai Fan, Kai Yu, Wei-Qiang Zhang, Guoguo Chen, Xie Chen |
| 2025 | ACL | NeuSym-RAG: Hybrid Neural Symbolic Retrieval with Multiview Structuring for PDF Question Answering. | Ruisheng Cao, Hanchong Zhang, Tiancheng Huang, Zhangyi Kang, Yuxin Zhang, Liangtai Sun, Hanqi Li, Yuxun Miao, Shuai Fan, Lu Chen, Kai Yu |
| 2025 | ACL | SLAM-Omni: Timbre-Controllable Voice Interaction System with Single-Stage Training. | Wenxi Chen, Ziyang Ma, Ruiqi Yan, Yuzhe Liang, Xiquan Li, Ruiyang Xu, Zhikang Niu, Yanqiao Zhu, Yifan Yang, Zhanxun Liu, Kai Yu, Yuxuan Hu, Jinyu Li, Yan Lu, Shujie Liu, Xie Chen |
| 2025 | ACL | F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching. | Yushen Chen, Zhikang Niu, Ziyang Ma, Keqi Deng, Chunhui Wang, Jian Zhao, Kai Yu, Xie Chen |
| 2025 | ASRU | Low-Resource Domain Adaptation for Speech LLMs via Text-Only Fine-Tuning. | Yangui Fang, Jing Peng, Xu Li, Yu Xi, Chengwei Zhang, Guohui Zhong, Kai Yu |
| 2025 | ASRU | Towards General Discrete Speech Codec for Complex Acoustic Environments: A Study of Reconstruction and Downstream Task Consistency. | Haoran Wang, Guanyu Chen, Bohan Li, Hankun Wang, Yiwei Guo, Zhihan Li, Xie Chen, Kai Yu |
| 2025 | ASRU | Masked Self-distilled Transducer-based Keyword Spotting with Semi-autoregressive Decoding. | Yu Xi, Xiaoyu Gu, Haoyu Li, Jun Song, Bo Zheng, Kai Yu |
| 2025 | COLING | From Generalist to Specialist: A Survey of Large Language Models for Chemistry. | Yang Han, Ziping Wan, Lu Chen, Kai Yu, Xin Chen |
| 2025 | COLING | ChatCite: LLM Agent with Human Workflow Guidance for Comparative Literature Summary. | Yutong Li, Lu Chen, Aiwei Liu, Kai Yu, Lijie Wen |
| 2025 | COLING | Converging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language Models. | Hongchuan Zeng, Senyu Han, Lu Chen, Kai Yu |
| 2025 | EMNLP | Enhancing Speech-to-Speech Dialogue Modeling with End-to-End Retrieval-Augmented Generation. | Pengchao Feng, Ziyang Ma, Wenxi Chen, Yao Li, Sheng Wang, Kai Yu, Xie Chen |
| 2025 | EMNLP | Alignment for Efficient Tool Calling of Large Language Models. | Hongshen Xu, Zihan Wang, Zichen Zhu, Lei Pan, Xingyu Chen, Shuai Fan, Lu Chen, Kai Yu |
| 2025 | EMNLP | URO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models. | Ruiqi Yan, Xiquan Li, Wenxi Chen, Zhikang Niu, Chen Yang, Ziyang Ma, Kai Yu, Xie Chen |
| 2025 | EMNLP | When Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models. | Yingming Zheng, Hanqi Li, Kai Yu, Lu Chen |
| 2025 | ICASSP | SLAM-AAC: Enhancing Audio Captioning with Paraphrasing Augmentation and CLAP-Refine through LLMs. | Wenxi Chen, Ziyang Ma, Xiquan Li, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Kai Yu, Xie Chen |
| 2025 | ICASSP | VALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech. | Chenpeng Du, Yiwei Guo, Hankun Wang, Yifan Yang, Zhikang Niu, Shuai Wang, Hui Zhang, Xie Chen, Kai Yu |
| 2025 | ICASSP | Fast and High-Quality Auto-Regressive Speech Synthesis via Speculative Decoding. | Bohan Li, Hankun Wang, Situo Zhang, Yiwei Guo, Kai Yu |
| 2025 | ICASSP | Neural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario. | Wen Wen, Qiang Zhou, Yu Xi, Haoyu Li, Ziqi Gong, Kai Yu |
| 2025 | ICASSP | Streaming Keyword Spotting Boosted by Cross-layer Discrimination Consistency. | Yu Xi, Haoyu Li, Xiaoyu Gu, Hao Li, Yidi Jiang, Kai Yu |
| 2025 | ICASSP | NTC-KWS: Noise-aware CTC for Robust Keyword Spotting. | Yu Xi, Haoyu Li, Hao Li, Jiaqi Guo, Xu Li, Wen Ding, Kai Yu |
| 2025 | ICCV | Bitrate-Controlled Diffusion for Disentangling Motion and Content in Video. | Xiao Li, Qi Chen, Xiulian Peng, Kai Yu, Xie Chen, Yan Lu |
| 2025 | ICML | Heads up! Large Language Models Can Perform Tasks Without Your Instruction via Selective Attention Head Masking. | Senyu Han, Hongchuan Zeng, Kai Yu, Lu Chen |
| 2025 | ICML | Reducing Tool Hallucination via Reliability Alignment. | Hongshen Xu, Zichen Zhu, Lei Pan, Zihan Wang, Su Zhu, Da Ma, Ruisheng Cao, Lu Chen, Kai Yu |
| 2025 | IJCNN | Convolutional Self-Attention Network with Disentangled Intents for Course Sequence Recommendation. | Kai Yu, Dongjin Yu, Dongjing Wang |
| 2025 | Interspeech | LSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec. | Yiwei Guo, Zhihan Li, Chenpeng Du, Hankun Wang, Xie Chen, Kai Yu |
| 2025 | Interspeech | Unlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate. | Hanglei Zhang, Yiwei Guo, Zhihan Li, Xiang Hao, Xie Chen, Kai Yu |
| 2025 | Interspeech | Accelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling. | Qixi Zheng, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiaofei Wang, Kai Yu, Xie Chen |
| 2025 | Interspeech | VietASR: Achieving Industry-level Vietnamese ASR with 50-hour labeled data and Large-Scale Speech Pretraining. | Jianheng Zhuo, Yifan Yang, Yiwen Shao, Yong Xu, Dong Yu, Kai Yu, Xie Chen |
| 2025 | NAACL | MobA: Multifaceted Memory-Enhanced Adaptive Planning for Efficient Mobile Task Automation. | Zichen Zhu, Hao Tang, Yansi Li, Dingye Liu, Hongshen Xu, Kunyao Lan, Danyang Zhang, Yixuan Jiang, Hao Zhou, Chenrun Wang, Situo Zhang, Liangtai Sun, Yixiao Wang, Yuheng Sun, Lu Chen, Kai Yu |
| 2024 | AAAI | UniCATS: A Unified Context-Aware Text-to-Speech Framework with Contextual VQ-Diffusion and Vocoding. | Chenpeng Du, Yiwei Guo, Feiyu Shen, Zhijun Liu, Zheng Liang, Xie Chen, Shuai Wang, Hui Zhang, Kai Yu |
| 2024 | AAAI | SciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research. | Liangtai Sun, Yang Han, Zihan Zhao, Da Ma, Zhennan Shen, Baocai Chen, Lu Chen, Kai Yu |
| 2024 | ACL | IBSEN: Director-Actor Agent Collaboration for Controllable and Interactive Drama Script Generation. | Senyu Han, Lu Chen, Li-Min Lin, Zhengshan Xu, Kai Yu |
| 2024 | ACL | Sparsity-Accelerated Training for Large Language Models. | Da Ma, Lu Chen, Pengyu Wang, Hongshen Xu, Hanqi Li, Liangtai Sun, Su Zhu, Shuai Fan, Kai Yu |
| 2024 | COLING | Multilingual Brain Surgeon: Large Language Models Can Be Compressed Leaving No Language behind. | Hongchuan Zeng, Hongshen Xu, Lu Chen, Kai Yu |
| 2024 | COLING | Is LLM a Reliable Reviewer? A Comprehensive Evaluation of LLM on Automatic Paper Reviewing Tasks. | Ruiyang Zhou, Lu Chen, Kai Yu |
| 2024 | CVPR | DiffusionGAN3D: Boosting Text-guided 3D Generation and Domain Adaptation by Combining 3D GANs and Diffusion Priors. | Biwen Lei, Kai Yu, Mengyang Feng, Miaomiao Cui, Xuansong Xie |
| 2024 | EMNLP | AlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference. | Yang Han, Yiming Wang, Rui Wang, Lu Chen, Kai Yu |
| 2024 | ICASSP | VoiceFlow: Efficient Text-To-Speech with Rectified Flow Matching. | Yiwei Guo, Chenpeng Du, Ziyang Ma, Xie Chen, Kai Yu |
| 2024 | ICASSP | SEF-VC: Speaker Embedding Free Zero-Shot Voice Conversion with Cross Attention. | Junjie Li, Yiwei Guo, Xie Chen, Kai Yu |
| 2024 | ICASSP | Label-Aware Auxiliary Learning for Dialogue State Tracking. | Yuncong Liu, Lu Chen, Kai Yu |
| 2024 | ICASSP | DiffDub: Person-Generic Visual Dubbing Using Inpainting Renderer with Diffusion Auto-Encoder. | Tao Liu, Chenpeng Du, Shuai Fan, Feilong Chen, Kai Yu |
| 2024 | ICASSP | StoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations. | Sen Liu, Yiwei Guo, Xie Chen, Kai Yu |
| 2024 | ICASSP | Acoustic BPE for Speech Generation with Discrete Tokens. | Feiyu Shen, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2024 | ICASSP | Enhancing Audio Generation Diversity with Visual Information. | Zeyu Xie, Baihan Li, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2024 | ICASSP | TDT-KWS: Fast and Accurate Keyword Spotting Using Token-and-Duration Transducer. | Yu Xi, Hao Li, Baochen Yang, Haoyu Li, Hainan Xu, Kai Yu |
| 2024 | ICASSP | Contrastive Learning with Audio Discrimination for Customizable Keyword Spotting in Continuous Speech. | Yu Xi, Baochen Yang, Hao Li, Jiaqi Guo, Kai Yu |
| 2024 | ICASSP | A Detailed Audio-Text Data Simulation Pipeline Using Single-Event Sounds. | Xuenan Xu, Xiaohang Xu, Zeyu Xie, Pingyue Zhang, Mengyue Wu, Kai Yu |
| 2024 | ICASSP | A Birgat Model for Multi-Intent Spoken Language Understanding with Hierarchical Semantic Frames. | Hongshen Xu, Ruisheng Cao, Su Zhu, Sheng Jiang, Hanchong Zhang, Lu Chen, Kai Yu |
| 2024 | ICASSP | Towards Universal Speech Discrete Tokens: A Case Study for ASR and TTS. | Yifan Yang, Feiyu Shen, Chenpeng Du, Ziyang Ma, Kai Yu, Daniel Povey, Xie Chen |
| 2024 | ICASSP | Semantic-Enhanced Supervised Contrastive Learning. | Pingyue Zhang, Mengyue Wu, Kai Yu |
| 2024 | ICML | Evolving Subnetwork Training for Large Language Models. | Hanqi Li, Lu Chen, Da Ma, Zijian Wu, Su Zhu, Kai Yu |
| 2024 | IGARSS | Monitoring Color for Small Water Bodyies by Fusing Sentinel-2 Multispectral Data and Gaofen -1 Panchromatic Imagery. | Yadong Zhou, Kai Yu, Xueer Geng, Baoyin He, Feng Ling, Lihui Wang, Cheng Shang, Fan Yang, Qi Feng, Yun Du |
| 2024 | Interspeech | On the Effectiveness of Acoustic BPE in Decoder-Only TTS. | Bohan Li, Feiyu Shen, Yiwei Guo, Shuai Wang, Xie Chen, Kai Yu |
| 2024 | Interspeech | DiveSound: LLM-Assisted Automatic Taxonomy Construction for Diverse Audio Generation. | Baihan Li, Zeyu Xie, Xuenan Xu, Yiwei Guo, Ming Yan, Ji Zhang, Kai Yu, Mengyue Wu |
| 2024 | Interspeech | Text-aware Speech Separation for Multi-talker Keyword Spotting. | Haoyu Li, Baochen Yang, Yu Xi, Linfeng Yu, Tian Tan, Hao Li, Kai Yu |
| 2024 | Interspeech | FakeSound: Deepfake General Audio Detection. | Zeyu Xie, Baihan Li, Xuenan Xu, Zheng Liang, Kai Yu, Mengyue Wu |
| 2024 | MICCAI | UrFound: Towards Universal Retinal Foundation Models via Knowledge-Guided Masked Modeling. | Kai Yu, Yang Zhou, Yang Bai, Zhi Da Soh, Xinxing Xu, Rick Siow Mong Goh, Ching-Yu Cheng, Yong Liu |
| 2024 | NAACL | CoE-SQL: In-Context Learning for Multi-Turn Text-to-SQL with Chain-of-Editions. | Hanchong Zhang, Ruisheng Cao, Hongshen Xu, Lu Chen, Kai Yu |
| 2023 | ACL | TeCS: A Dataset and Benchmark for Tense Consistency of Machine Translation. | Yiming Ai, Zhiwei He, Kai Yu, Rui Wang |
| 2023 | ACL | SPM: A Split-Parsing Method for Joint Multi-Intent Detection and Slot Filling. | Sheng Jiang, Su Zhu, Ruisheng Cao, Qingliang Miao, Kai Yu |
| 2023 | ACL | Exploring Schema Generalizability of Text-to-SQL. | Jieyu Li, Lu Chen, Ruisheng Cao, Su Zhu, Hongshen Xu, Zhi Chen, Hanchong Zhang, Kai Yu |
| 2023 | ACL | CSS: A Large-scale Cross-schema Chinese Text-to-SQL Medical Dataset. | Hanchong Zhang, Jieyu Li, Lu Chen, Ruisheng Cao, Yunyan Zhang, Yu Huang, Yefeng Zheng, Kai Yu |
| 2023 | EMNLP | ACT-SQL: In-Context Learning for Text-to-SQL with Automatically-Generated Chain-of-Thought. | Hanchong Zhang, Ruisheng Cao, Lu Chen, Hongshen Xu, Kai Yu |
| 2023 | ICASSP | Improving Few-Shot Learning for Talking Face System with TTS Data Augmentation. | Qi Chen, Ziyang Ma, Tao Liu, Xu Tan, Qu Lu, Kai Yu, Xie Chen |
| 2023 | ICASSP | Multi-Speaker Multi-Lingual VQTTS System for LIMMITS 2023 Challenge. | Chenpeng Du, Yiwei Guo, Feiyu Shen, Kai Yu |
| 2023 | ICASSP | Emodiff: Intensity Controllable Emotional Text-to-Speech with Soft-Label Guidance. | Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2023 | ICASSP | Multi-Speaker End-to-End Multi-Modal Speaker Diarization System for the MISP 2022 Challenge. | Tao Liu, Zhengyang Chen, Yanmin Qian, Kai Yu |
| 2023 | ICASSP | DiffVoice: Text-to-Speech with Latent Diffusion. | Zhijun Liu, Yiwei Guo, Kai Yu |
| 2023 | ICASSP | Diverse and Vivid Sound Generation from Text Descriptions. | Guangwei Li, Xuenan Xu, Lingfeng Dai, Mengyue Wu, Kai Yu |
| 2023 | ICASSP | Investigating Pooling Strategies and Loss Functions for Weakly-Supervised Text-to-Audio Grounding via Contrastive Learning. | Xuenan Xu, Mengyue Wu, Kai Yu |
| 2023 | ICCV | Diverse Data Augmentation with Diffusions for Effective Test-time Prompt Tuning. | Chun-Mei Feng, Kai Yu, Yong Liu, Salman Khan, Wangmeng Zuo |
| 2023 | ICCV | Towards Instance-adaptive Inference for Federated Learning. | Chun-Mei Feng, Kai Yu, Nian Liu, Xinxing Xu, Salman Khan, Wangmeng Zuo |
| 2023 | Interspeech | UnSE: Unsupervised Speech Enhancement Using Optimal Transport. | Wenbin Jiang, Fei Wen, Yifan Zhang, Kai Yu |
| 2023 | Interspeech | Improving Code-Switching and Name Entity Recognition in ASR with Speech Editing based Data Augmentation. | Zheng Liang, Zheshu Song, Ziyang Ma, Chenpeng Du, Kai Yu, Xie Chen |
| 2023 | Interspeech | How ChatGPT is Robust for Spoken Language Understanding? | Guangpeng Li, Lu Chen, Kai Yu |
| 2023 | Interspeech | DSE-TTS: Dual Speaker Embedding for Cross-Lingual Text-to-Speech. | Sen Liu, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu |
| 2023 | Interspeech | Enhance Temporal Relations in Audio Captioning with Sound Event Detection. | Zeyu Xie, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2023 | Interspeech | ReCLR: Reference-Enhanced Contrastive Learning of Audio Representation for Depression Detection. | Pingyue Zhang, Mengyue Wu, Kai Yu |
| 2023 | PIMRC | Deep Reinforcement Learning Enabled Power Allocation for Multi-Connectivity C-V2X Downlink. | Jianzhe Xue, Kai Yu, Tianqi Zhang, Haibo Zhou, Xuemin Sherman Shen |
| 2022 | EMNLP | AdapterShare: Task Correlation Modeling with Adapter Differentiation. | Zhi Chen, Bei Chen, Lu Chen, Kai Yu, Jian-Guang Lou |
| 2022 | EMNLP | META-GUI: Towards Multi-modal Conversational Agents on Mobile GUI. | Liangtai Sun, Xingyu Chen, Lu Chen, Tianle Dai, Zichen Zhu, Kai Yu |
| 2022 | EMNLP | D4: a Chinese Dialogue Dataset for Depression-Diagnosis-Oriented Chat. | Binwei Yao, Chao Shi, Likai Zou, Lingfeng Dai, Mengyue Wu, Lu Chen, Zhen Wang, Kai Yu |
| 2022 | GLOBECOM | Spectral Efficiency Analysis of Uplink-Downlink Decoupled Access in C-V2X Networks. | Luofang Jiao, Kai Yu, Yunting Xu, Tianqi Zhang, Haibo Zhou, Xuemin Shen |
| 2022 | ICASSP | LatticeBART: Lattice-to-Lattice Pre-Training for Speech Recognition. | Lingfeng Dai, Lu Chen, Zhikai Zhou, Kai Yu |
| 2022 | ICASSP | Unsupervised Word-Level Prosody Tagging for Controllable Speech Synthesis. | Yiwei Guo, Chenpeng Du, Kai Yu |
| 2022 | ICASSP | Speech Enhancement with Neural Homomorphic Synthesis. | Wenbin Jiang, Zhijun Liu, Kai Yu, Fei Wen |
| 2022 | ICASSP | Category-Adapted Sound Event Enhancement with Weakly Labeled Data. | Guangwei Li, Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2022 | ICASSP | Navigating Audio-Visual Event Detection Across Mismatched Modalities. | Guangwei Li, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2022 | ICASSP | Audio-Text Retrieval in Context. | Siyu Lou, Xuenan Xu, Mengyue Wu, Kai Yu |
| 2022 | ICASSP | Climate and Weather: Inspecting Depression Detection via Emotion Recognition. | Wen Wu, Mengyue Wu, Kai Yu |
| 2022 | ICASSP | Text Adaptive Detection for Customizable Keyword Spotting. | Yu Xi, Tian Tan, Wangyou Zhang, Baochen Yang, Kai Yu |
| 2022 | ICASSP | Diversity-Controllable and Accurate Audio Captioning Based on Neural Condition. | Xuenan Xu, Mengyue Wu, Kai Yu |
| 2022 | Interspeech | VQTTS: High-Fidelity Text-to-Speech Synthesis with Self-Supervised VQ Acoustic Feature. | Chenpeng Du, Yiwei Guo, Xie Chen, Kai Yu |
| 2022 | Interspeech | Efficient Speech Enhancement with Neural Homomorphic Synthesis. | Wenbin Jiang, Tao Liu, Kai Yu |
| 2022 | Interspeech | MSDWild: Multi-modal Speaker Diarization Dataset in the Wild. | Tao Liu, Shuai Fan, Xu Xiang, Hongbo Song, Shaoxiong Lin, Jiaqi Sun, Tianyuan Han, Siyuan Chen, Binwei Yao, Sen Liu, Yifei Wu, Yanmin Qian, Kai Yu |
| 2022 | MICCAI | Tiny-Lesion Segmentation in OCT via Multi-scale Wavelet Enhanced Transformer. | Meng Wang, Kai Yu, Xinxing Xu, Yi Zhou, Yuanyuan Peng, Yanyu Xu, Rick Siow Mong Goh, Yong Liu, Huazhu Fu |
| 2022 | NAACL | TIE: Topological Information Enhanced Structural Reading Comprehension on Web Pages. | Zihan Zhao, Lu Chen, Ruisheng Cao, Hongshen Xu, Xingyu Chen, Kai Yu |
| 2021 | AAAI | LET: Linguistic Knowledge Enhanced Graph Transformer for Chinese Short Text Matching. | Boer Lyu, Lu Chen, Su Zhu, Kai Yu |
| 2021 | ACL | LGESQL: Line Graph Enhanced Text-to-SQL Model with Mixed Local and Non-Local Relations. | Ruisheng Cao, Lu Chen, Zhi Chen, Yanbin Zhao, Su Zhu, Kai Yu |
| 2021 | ACL | Decoupled Dialogue Modeling and Semantic Parsing for Multi-Turn Text-to-SQL. | Zhi Chen, Lu Chen, Hanqi Li, Ruisheng Cao, Da Ma, Mengyue Wu, Kai Yu |
| 2021 | EMNLP | WebSRC: A Dataset for Web-Based Structural Reading Comprehension. | Xingyu Chen, Zihan Zhao, Lu Chen, Jiabao Ji, Danyang Zhang, Ao Luo, Yuxuan Xiong, Kai Yu |
| 2021 | EMNLP | Glyph Enhanced Chinese Character Pre-Training for Lexical Sememe Prediction. | Boer Lyu, Lu Chen, Kai Yu |
| 2021 | GLOBECOM | Leveraging LEO Assisted Cloud-Edge Collaboration for Energy Efficient Computation Offloading. | Zhixuan Tang, Haibo Zhou, Ting Ma, Kai Yu, Xuemin Sherman Shen |
| 2021 | HCI | Evaluation of Relationship Quality Within Dyads Through the Performance in Dual-Player Cooperative Tasks. | Haijiang Yan, Kai Yu, Guozhen Zhao |
| 2021 | ICASSP | SynAug: Synthesis-Based Data Augmentation for Text-Dependent Speaker Verification. | Chenpeng Du, Bing Han, Shuai Wang, Yanmin Qian, Kai Yu |
| 2021 | ICASSP | Text-to-Audio Grounding: Building Correspondence Between Captions and Sound Events. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2021 | ICASSP | Investigating Local and Global Information for Automated Audio Captioning with Transfer Learning. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Zeyu Xie, Kai Yu |
| 2021 | Interspeech | Class-Based Neural Network Language Model for Second-Pass Rescoring in ASR. | Lingfeng Dai, Qi Liu, Kai Yu |
| 2021 | Interspeech | Rich Prosody Diversity Modelling with Phone-Level Mixture Density Network. | Chenpeng Du, Kai Yu |
| 2021 | Interspeech | A Lightweight Framework for Online Voice Activity Detection in the Wild. | Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2021 | NAACL | ShadowGNN: Graph Projection Neural Network for Text-to-SQL Parser. | Zhi Chen, Lu Chen, Yanbin Zhao, Ruisheng Cao, Zihan Xu, Su Zhu, Kai Yu |
| 2020 | AAAI | Schema-Guided Multi-Domain Dialogue State Tracking with Graph Attention Neural Networks. | Lu Chen, Boer Lv, Chi Wang, Su Zhu, Bowen Tan, Kai Yu |
| 2020 | AAAI | Semi-Supervised Text Simplification with Back-Translation and Asymmetric Denoising Autoencoders. | Yanbin Zhao, Lu Chen, Zhi Chen, Kai Yu |
| 2020 | ACL | Unsupervised Dual Paraphrasing for Two-stage Semantic Parsing. | Ruisheng Cao, Su Zhu, Chenyu Yang, Chen Liu, Rao Ma, Yanbin Zhao, Lu Chen, Kai Yu |
| 2020 | ACL | Neural Graph Matching Networks for Chinese Short Text Matching. | Lu Chen, Yanbin Zhao, Boer Lyu, Lesheng Jin, Zhi Chen, Su Zhu, Kai Yu |
| 2020 | ACL | Line Graph Enhanced AMR-to-Text Generation with Mix-Order Graph Attention Networks. | Yanbin Zhao, Lu Chen, Zhi Chen, Ruisheng Cao, Su Zhu, Kai Yu |
| 2020 | EMNLP | Efficient Context and Schema Fusion Networks for Multi-Domain Dialogue State Tracking. | Su Zhu, Jieyu Li, Lu Chen, Kai Yu |
| 2020 | GLOBECOM | A Reinforcement Learning Aided Decoupled RAN Slicing Framework for Cellular V2X. | Kai Yu, Haibo Zhou, Bo Qian, Zhixuan Tang, Xuemin Shen |
| 2020 | HCI | Can Video Game Training Improve the Two-Dimensional Mental Rotation Ability of Young Children? - A Randomized Controlled Trial. | Xiaocen Liu, Heqing Huang, Kai Yu, Donghui Dou |
| 2020 | ICASSP | Investigation of Specaugment for Deep Speaker Embedding Learning. | Shuai Wang, Johan Rohdin, Oldrich Plchot, Luks Burget, Kai Yu, Jan Cernock |
| 2020 | ICASSP | Channel Invariant Speaker Embedding Learning with Joint Multi-Task and Adversarial Training. | Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu |
| 2020 | ICASSP | Duration Robust Weakly Supervised Sound Event Detection. | Heinrich Dinkel, Kai Yu |
| 2020 | ICASSP | Speaker Augmentation for Low Resource Speech Recognition. | Chenpeng Du, Kai Yu |
| 2020 | ICASSP | A Hierarchical Tracker for Multi-Domain Dialogue State Tracking. | Jieyu Li, Su Zhu, Kai Yu |
| 2020 | ICASSP | Addressing the Polysemy Problem in Language Modeling with Attentional Multi-Sense Embeddings. | Rao Ma, Lesheng Jin, Qi Liu, Lu Chen, Kai Yu |
| 2020 | ICASSP | Neural Lattice Search for Speech Recognition. | Rao Ma, Hao Li, Qi Liu, Lu Chen, Kai Yu |
| 2020 | ICASSP | Text Adaptation for Speaker Verification with Speaker-Text Factorized Embeddings. | Yexin Yang, Shuai Wang, Xun Gong, Yanmin Qian, Kai Yu |
| 2020 | ICDCS | CODA: Improving Resource Utilization by Slimming and Co-locating DNN and CPU Jobs. | Han Zhao, Weihao Cui, Quan Chen, Jingwen Leng, Kai Yu, Deze Zeng, Chao Li, Minyi Guo |
| 2020 | Interspeech | Voice Activity Detection in the Wild via Weakly Supervised Sound Event Detection. | Yefei Chen, Heinrich Dinkel, Mengyue Wu, Kai Yu |
| 2020 | Interspeech | Neural Homomorphic Vocoder. | Zhijun Liu, Kuan Chen, Kai Yu |
| 2020 | Interspeech | Jointly Encoding Word Confusion Network and Dialogue Context with BERT for Spoken Language Understanding. | Chen Liu, Su Zhu, Zijian Zhao, Ruisheng Cao, Lu Chen, Kai Yu |
| 2020 | Interspeech | Dual-Adversarial Domain Adaptation for Generalized Replay Attack Detection. | Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu |
| 2020 | VTC | An Evolutionary Game Assisted Spectrum Sharing Blockchain Framework for Internet of Vehicles. | Dou Hu, Haibo Zhou, Ting Ma, Kai Yu, Nan Cheng |
| 2019 | ACL | Semantic Parsing with Dual Learning. | Ruisheng Cao, Su Zhu, Chen Liu, Jieyu Li, Kai Yu |
| 2019 | ASRU | Exploring Model Units and Training Strategies for End-to-End Speech Recognition. | Mingkun Huang, Yizhou Lu, Lan Wang, Yanmin Qian, Kai Yu |
| 2019 | ASRU | Highly Efficient Neural Network Language Model Compression Using Soft Binarization Training. | Rao Ma, Qi Liu, Kai Yu |
| 2019 | EMNLP | Data Augmentation with Atomic Templates for Spoken Language Understanding. | Zijian Zhao, Su Zhu, Kai Yu |
| 2019 | ICASSP | End-to-end Monaural Multi-speaker ASR System without Pretraining. | Xuankai Chang, Yanmin Qian, Kai Yu, Shinji Watanabe |
| 2019 | ICASSP | Knowledge Distillation for Small Foot-print Deep Speaker Embedding. | Shuai Wang, Yexin Yang, Tianzhe Wang, Yanmin Qian, Kai Yu |
| 2019 | ICASSP | Audio Caption: Listen and Tell. | Mengyue Wu, Heinrich Dinkel, Kai Yu |
| 2019 | ICASSP | A Hierarchical Decoding Model for Spoken Language Understanding from Unaligned Data. | Zijian Zhao, Su Zhu, Kai Yu |
| 2019 | ICMI | Robust Spoken Language Understanding with Acoustic and Domain Knowledge. | Hao Li, Chen Liu, Su Zhu, Kai Yu |
| 2019 | ICMI | CATSLU: The 1st Chinese Audio-Textual Spoken Language Understanding Challenge. | Su Zhu, Zijian Zhao, Tiejun Zhao, Chengqing Zong, Kai Yu |
| 2019 | Interspeech | Joint Decoding of CTC Based Systems for Speech Recognition. | Jiaqi Guo, Yongbin You, Yanmin Qian, Kai Yu |
| 2019 | Interspeech | Cross-Domain Replay Spoofing Attack Detection Using Domain Adversarial Training. | Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu |
| 2019 | Interspeech | On the Usage of Phonetic Information for Text-Independent Speaker Embedding Extraction. | Shuai Wang, Johan Rohdin, Luks Burget, Oldrich Plchot, Yanmin Qian, Kai Yu, Jan Cernock |
| 2019 | Interspeech | Data Augmentation Using Variational Autoencoder for Embedding Based Speaker Verification. | Zhanghao Wu, Shuai Wang, Yanmin Qian, Kai Yu |
| 2019 | Interspeech | The SJTU Robust Anti-Spoofing System for the ASVspoof 2019 Challenge. | Yexin Yang, Hongji Wang, Heinrich Dinkel, Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu |
| 2018 | COLING | Structured Dialogue Policy with Graph Neural Networks. | Lu Chen, Bowen Tan, Sishan Long, Kai Yu |
| 2018 | EMNLP | Towards Universal Dialogue State Tracking. | Liliang Ren, Kaige Xie, Lu Chen, Kai Yu |
| 2018 | ICASSP | Policy Adaptation for Deep Reinforcement Learning-Based Dialogue Management. | Lu Chen, Cheng Chang, Zhi Chen, Bowen Tan, Milica Gasic, Kai Yu |
| 2018 | ICASSP | On Modular Training of Neural Acoustics-to-Word Model for LVCSR. | Zhehuai Chen, Qi Liu, Hao Li, Kai Yu |
| 2018 | ICASSP | Fast Oov Words Incorporation Using Structured Word Embeddings for Neural Network Language Model. | Ruinian Chen, Kai Yu |
| 2018 | ICASSP | Semi-Supervised Training Using Adversarial Multi-Task Learning for Spoken Language Understanding. | Ouyu Lan, Su Zhu, Kai Yu |
| 2018 | ICASSP | Focal Kl-Divergence Based Dilated Convolutional Neural Networks for Co-Channel Speaker Identification. | Shuai Wang, Yanmin Qian, Kai Yu |
| 2018 | ICASSP | Robust Spoken Language Understanding with Unsupervised ASR-Error Adaptation. | Su Zhu, Ouyu Lan, Kai Yu |
| 2018 | Interspeech | High-quality Voice Conversion Using Spectrogram-Based WaveNet Vocoder. | Kuan Chen, Bo Chen, Jiahao Lai, Kai Yu |
| 2018 | Interspeech | Angular Softmax for Short-Duration Text-independent Speaker Verification. | Zili Huang, Shuai Wang, Kai Yu |
| 2018 | Interspeech | Knowledge Distillation for Sequence Model. | Mingkun Huang, Yongbin You, Zhehuai Chen, Yanmin Qian, Kai Yu |
| 2018 | Interspeech | Structured Word Embedding for Low Memory Neural Network Language Model. | Kaiyu Shi, Kai Yu |
| 2018 | MICCAI | Explaining Convolutional Neural Networks for Area Estimation of Choroidal Neovascularization via Genetic Programming. | Yibiao Rong, Kai Yu, Dehui Xiang, Weifang Zhu, Zhun Fan, Xinjian Chen |
| 2018 | NAACL | Binarized LSTM Language Model. | Xuan Liu, Di Cao, Kai Yu |
| 2017 | ASRU | Future vector enhanced LSTM language model for LVCSR. | Qi Liu, Yanmin Qian, Kai Yu |
| 2017 | BMVC | Weakly-supervised Learning of Mid-level Features for Pedestrian Attribute Recognition and Localization. | Yang Zhou, Kai Yu, Biao Leng, Zhang Zhang, Dangwei Li, Kaiqi Huang |
| 2017 | EACL | On-line Dialogue Policy Learning with Companion Teaching. | Lu Chen, Runzhe Yang, Cheng Chang, Zihao Ye, Xiang Zhou, Kai Yu |
| 2017 | EMNLP | Affordable On-line Dialogue Policy Learning. | Cheng Chang, Runzhe Yang, Lu Chen, Xiang Zhou, Kai Yu |
| 2017 | EMNLP | Agent-Aware Dropout DQN for Safe and Efficient On-line Dialogue Policy Learning. | Lu Chen, Xiang Zhou, Cheng Chang, Runzhe Yang, Kai Yu |
| 2017 | ICASSP | Confidence measures for CTC-based phone synchronous decoding. | Zhehuai Chen, Yimeng Zhuang, Kai Yu |
| 2017 | ICASSP | End-to-end spoofing detection with raw waveform CLDNNS. | Heinrich Dinkel, Nanxin Chen, Yanmin Qian, Kai Yu |
| 2017 | ICASSP | Encoder-decoder with focus-mechanism for sequence labelling based spoken language understanding. | Su Zhu, Kai Yu |
| 2017 | IJCNN | Small-footprint convolutional neural network for spoofing detection. | Heinrich Dinkel, Yanmin Qian, Kai Yu |
| 2017 | Interspeech | Discrete Duration Model for Speech Synthesis. | Bo Chen, Tianling Bian, Kai Yu |
| 2017 | Interspeech | Comparison of Modeling Target in LSTM-RNN Duration Model. | Bo Chen, Jiahao Lai, Kai Yu |
| 2017 | Interspeech | What Does the Speaker Embedding Encode? | Shuai Wang, Yanmin Qian, Kai Yu |
| 2017 | Interspeech | Binary Deep Neural Networks for Speech Recognition. | Xu Xiang, Yanmin Qian, Kai Yu |
| 2016 | CHI | Readful-U: Improving Reading Experience and Social Interaction for Low Vision Elders. | Ninglu Wang, Kai Yu, Junhui Li, Ruofan Zhang, Fei Ren |
| 2016 | ICASSP | A comparative study of robustness of deep learning approaches for VAD. | Sibo Tong, Hao Gu, Kai Yu |
| 2016 | ICASSP | Discriminatively trained joint speaker and environment representations for adaptation of deep neural network acoustic models. | Maofan Yin, Sunil Sivadas, Kai Yu, Bin Ma |
| 2016 | ICASSP | A fast direct source localization approach for acoustic sensor array. | Kai Yu, Kung Yao, Ralph E. Hudson, Charles E. Taylor, Zhi Wang |
| 2016 | Interspeech | Phone Synchronous Decoding with CTC Lattice. | Zhehuai Chen, Wei Deng, Tao Xu, Kai Yu |
| 2016 | Interspeech | Hybrid Dialogue State Tracking for Real World Human-to-Human Dialogues. | Kai Sun, Su Zhu, Lu Chen, Siqiu Yao, Xueyang Wu, Kai Yu |
| 2016 | Interspeech | Unrestricted Vocabulary Keyword Spotting Using LSTM-CTC. | Yimeng Zhuang, Xuankai Chang, Yanmin Qian, Kai Yu |
| 2015 | ASRU | Multi-task joint-learning of deep neural networks for robust speech recognition. | Yanmin Qian, Maofan Yin, Yongbin You, Kai Yu |
| 2015 | CVPR | Deep multiple instance learning for image classification and auto-annotation. | Jiajun Wu, Yinan Yu, Chang Huang, Kai Yu |
| 2015 | HPCC | Design and Architecture of Dell Acceleration Appliances for Database (DAAD): A Practical Approach with High Availability Guaranteed. | Kai Yu, Yu-Xiang Gao, Peng Zhang, Meikang Qiu |
| 2015 | ICASSP | A novel static parameter calculation method for model compensation. | Suliang Bu, Yunxin Zhao, Yanmin Qian, Kai Yu |
| 2015 | ICASSP | Recurrent neural network language model with structured word embeddings for speech recognition. | Tianxing He, Xu Xiang, Yanmin Qian, Kai Yu |
| 2015 | ICASSP | Cluster adaptive training for deep neural network. | Tian Tan, Yanmin Qian, Maofan Yin, Yimeng Zhuang, Kai Yu |
| 2015 | ICCV | Text Flow: A Unified Text Detection System in Natural Scene Images. | Shangxuan Tian, Yifeng Pan, Chang Huang, Shijian Lu, Kai Yu, Chew Lim Tan |
| 2015 | IJCNN | Automatic model redundancy reduction for fast back-propagation for deep neural networks in speech recognition. | Yanmin Qian, Tianxing He, Wei Deng, Kai Yu |
| 2015 | Interspeech | Very deep convolutional neural networks for LVCSR. | Mengxiao Bi, Yanmin Qian, Kai Yu |
| 2015 | Interspeech | An investigation of context clustering for statistical speech synthesis with deep neural network. | Bo Chen, Zhehuai Chen, Jiachen Xu, Kai Yu |
| 2015 | Interspeech | Robust deep feature for spoofing detection - the SJTU system for ASVspoof 2015 challenge. | Nanxin Chen, Yanmin Qian, Heinrich Dinkel, Bo Chen, Kai Yu |
| 2015 | Interspeech | Multi-task learning for text-dependent speaker verification. | Nanxin Chen, Yanmin Qian, Kai Yu |
| 2015 | Interspeech | Paragraph vector based topic model for language model adaptation. | Wengong Jin, Tianxing He, Yanmin Qian, Kai Yu |
| 2014 | ICASSP | Second order vector taylor series based robust speech recognition. | Suliang Bu, Yanmin Qian, Khe Chai Sim, Yongbin You, Kai Yu |
| 2014 | ICASSP | Stochastic data sweeping for fast DNN training. | Wei Deng, Yanmin Qian, Yuchen Fan, Tianfan Fu, Kai Yu |
| 2014 | ICASSP | Reshaping deep neural network for fast decoding by node-pruning. | Tianxing He, Yuchen Fan, Yanmin Qian, Tian Tan, Kai Yu |
| 2014 | IJCNN | Speaker verification with deep features. | Yuan Liu, Tianfan Fu, Yuchen Fan, Yanmin Qian, Kai Yu |
| 2014 | Interspeech | A novel dynamic parameters calculation approach for model compensation. | Suliang Bu, Yanmin Qian, Kai Yu |
| 2014 | Interspeech | Tandem deep features for text-dependent speaker verification. | Tianfan Fu, Yanmin Qian, Yuan Liu, Kai Yu |
| 2014 | MASS | An Improved Joint Sparse Representation of Array Covariance Matrices Approach in Multi-source Direct Position. | Zhuo-Hao Chen, Kai Yu, Ji-an Luo, Zhi Wang |
| 2014 | MASS | CS-Based Framework for Sparse Signal Transmission over Lossy Link. | Liantao Wu, Kai Yu, Yu Hen Hu, Zhi Wang |
| 2013 | ASRU | Combination of data borrowing strategies for low-resource LVCSR. | Yanmin Qian, Kai Yu, Jia Liu |
| 2013 | CIKM | Large-scale deep learning at Baidu. | Kai Yu |
| 2013 | ICML | Smooth Sparse Coding via Marginal Regression for Learning Sparse Representations. | Krishnakumar Balasubramanian, Kai Yu, Guy Lebanon |
| 2013 | Interspeech | Cluster adaptive training with factorized decision trees for speech recognition. | Kai Yu, Hainan Xu |
| 2013 | MASS | AWSAN: A Realtime Wireless Sensor Array Platform. | Kai Yu, Ming Yin, Tianxu Du, Liantao Wu, Zhi Wang |
| 2013 | MASS | A Direct Wideband Direction of Arrival Estimation under Compressive Sensing. | Kai Yu, Ming Yin, Ji-an Luo, Ming Bao, Yu Hen Hu, Zhi Wang |
| 2013 | PIMRC | An adaptive massive access management for M2M communications in smart grid. | Peng Si, Xiaobin Tan, Jian Yang, Fei Yin, Haifeng Wang, Kai Yu, Zhiyong Bu |
| 2012 | ECCV | Multi-component Models for Object Detection. | Chunhui Gu, Pablo Andrs Arbelez, Yuanqing Lin, Kai Yu, Jitendra Malik |
| 2012 | ECCV | Object-Centric Spatial Pooling for Image Classification. | Olga Russakovsky, Yuanqing Lin, Kai Yu, Li Fei-Fei |
| 2012 | ECCV | Query Specific Fusion for Image Retrieval. | Shaoting Zhang, Ming Yang, Timothe Cour, Kai Yu, Dimitris N. Metaxas |
| 2012 | ICMI | ICMI'12 grand challenge: haptic voice recognition. | Khe Chai Sim, Shengdong Zhao, Kai Yu, Hank Liao |
| 2012 | ICMI | Development of the 2012 SJTU HVR system. | Hainan Xu, Yuchen Fan, Kai Yu |
| 2012 | ICSE | Improving failure-inducing changes identification using coverage analysis. | Kai Yu |
| 2012 | ICSE | An integrated bug processing framework. | Xiangyu Zhang, Mengxiang Lin, Kai Yu |
| 2012 | ICST | When a GUI Regression Test Failed, What Should be Blamed? | Jin Chen, Mengxiang Lin, Kai Yu, Bing Shao |
| 2012 | ICST | Towards Practical Debugging for Regression Faults. | Kai Yu, Mengxiang Lin |
| 2012 | IGARSS | Investigation on the dynamics of artificial surface reflectance under field condition. | Kang Jiang, Xiangjuan Li, Luyan Ji, Kai Yu, Yongchao Zhao, Hairong Tang, Xiurui Geng, Daobin Zhang |
| 2011 | ACSSC | Efficient re-ranking in vocabulary tree based image retrieval. | Xiaoyu Wang, Ming Yang, Kai Yu |
| 2011 | ASRU | On-line policy optimisation of spoken dialogue systems via live interaction with human subjects. | Milica Gasic, Filip Jurccek, Blaise Thomson, Kai Yu, Steve J. Young |
| 2011 | COMPSAC | Achieving High Branch Coverage with Fewer Paths. | Yu Dong, Mengxiang Lin, Kai Yu, Yi Zhou, Yin-li Chen |
| 2011 | CVPR | Large-scale image classification: Fast feature extraction and SVM training. | Yuanqing Lin, Fengjun Lv, Shenghuo Zhu, Ming Yang, Timothe Cour, Kai Yu, Liangliang Cao, Thomas S. Huang |
| 2011 | CVPR | Correspondence driven adaptation for human profile recognition. | Ming Yang, Shenghuo Zhu, Fengjun Lv, Kai Yu |
| 2011 | CVPR | Learning image representations from the pixel level via hierarchical sparse coding. | Kai Yu, Yuanqing Lin, John D. Lafferty |
| 2011 | DATE | A high-level analytical model for application specific CMP design exploration. | Andrew Cassidy, Kai Yu, Haolang Zhou, Andreas G. Andreou |
| 2011 | ICASSP | Structured precision modelling with Cholesky Basis Superposition for speech recognition. | Lei Jia, Kai Yu, Bo Xu |
| 2011 | ICASSP | Joint modelling of voicing label and continuous F0 for HMM based speech synthesis. | Kai Yu, Steve J. Young |
| 2011 | ICCV | Contextual weighting for vocabulary tree based image retrieval. | Xiaoyu Wang, Ming Yang, Timothe Cour, Shenghuo Zhu, Kai Yu, Tony X. Han |
| 2011 | ICIP | Real-time clothing recognition in surveillance videos. | Ming Yang, Kai Yu |
| 2011 | Interspeech | Real User Evaluation of Spoken Dialogue Systems Using Amazon Mechanical Turk. | Filip Jurccek, Simon Keizer, Milica Gasic, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young |
| 2010 | ACL | Phrase-Based Statistical Language Generation Using Graphical Models and Active Learning. | Franois Mairesse, Milica Gasic, Filip Jurccek, Simon Keizer, Blaise Thomson, Kai Yu, Steve J. Young |
| 2010 | CVPR | Locality-constrained Linear Coding for image classification. | Jinjun Wang, Jianchao Yang, Kai Yu, Fengjun Lv, Thomas S. Huang, Yihong Gong |
| 2010 | CVPR | Supervised translation-invariant sparse coding. | Jianchao Yang, Kai Yu, Thomas S. Huang |
| 2010 | ECCV | Predicting Facial Beauty without Landmarks. | Douglas Gray, Kai Yu, Wei Xu, Yihong Gong |
| 2010 | ECCV | Efficient Highly Over-Complete Sparse Coding Using a Mixture Model. | Jianchao Yang, Kai Yu, Thomas S. Huang |
| 2010 | ECCV | Image Classification Using Super-Vector Coding of Local Image Descriptors. | Xi Zhou, Kai Yu, Tong Zhang, Thomas S. Huang |
| 2010 | ICASSP | Word-level emphasis modelling in HMM-based speech synthesis. | Kai Yu, Franois Mairesse, Steve J. Young |
| 2010 | ICDM | Training Conditional Random Fields Using Transfer Learning for Gesture Recognition. | Jie Liu, Kai Yu, Yi Zhang, Yalou Huang |
| 2010 | ICML | 3D Convolutional Neural Networks for Human Action Recognition. | Shuiwang Ji, Wei Xu, Ming Yang, Kai Yu |
| 2010 | ICML | Improved Local Coordinate Coding using Local Tangents. | Kai Yu, Tong Zhang |
| 2010 | Interspeech | Canonical state models for automatic speech recognition. | Mark J. F. Gales, Kai Yu |
| 2010 | Interspeech | Natural belief-critic: a reinforcement algorithm for parameter estimation in statistical spoken dialogue systems. | Filip Jurccek, Blaise Thomson, Simon Keizer, Franois Mairesse, Milica Gasic, Kai Yu, Steve J. Young |
| 2010 | Interspeech | Context adaptive training with factorized decision trees for HMM-based speech synthesis. | Kai Yu, Heiga Zen, Franois Mairesse, Steve J. Young |
| 2009 | APSEC | Program Sifting: Select Property-Related Functions for Language-Based Static Analysis. | Kai Yu, Cong Wang, Yin-li Chen, Mengxiang Lin |
| 2009 | ASRU | Back-off action selection in summary space-based POMDP dialogue systems. | Milica Gasic, Fabrice Lefvre, Filip Jurccek, Simon Keizer, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young |
| 2009 | CVPR | Linear spatial pyramid matching using sparse coding for image classification. | Jianchao Yang, Kai Yu, Yihong Gong, Thomas S. Huang |
| 2009 | ICASSP | Spoken language understanding from unaligned data using discriminative classification models. | Franois Mairesse, Milica Gasic, Filip Jurccek, Simon Keizer, Blaise Thomson, Kai Yu, Steve J. Young |
| 2009 | ICASSP | Probablistic modelling of F0 in unvoiced regions in HMM based speech synthesis. | Kai Yu, Tomoki Toda, Milica Gasic, Simon Keizer, Franois Mairesse, Blaise Thomson, Steve J. Young |
| 2009 | ICML | Tutorial summary: Learning with dependencies between several response variables. | Volker Tresp, Kai Yu |
| 2009 | ICML | Large-scale collaborative prediction using a nonparametric random effects model. | Kai Yu, John D. Lafferty, Shenghuo Zhu, Yihong Gong |
| 2009 | ICML | Workshop summary: Workshop on learning feature hierarchies. | Kai Yu, Ruslan Salakhutdinov, Yann LeCun, Geoffrey E. Hinton, Yoshua Bengio |
| 2009 | Interspeech | Transformation-based learning for semantic parsing. | Filip Jurccek, Milica Gasic, Simon Keizer, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young |
| 2009 | Interspeech | Profiling large-vocabulary continuous speech recognition on embedded devices: a hardware resource sensitivity analysis. | Kai Yu, Rob A. Rutenbar |
| 2009 | ICSE | Lazy Symbolic Evaluation and Its Path Constraints Solution. | Mengxiang Lin, Yin-li Chen, Kai Yu, Guo-shi Wu |
| 2008 | ECCV | Training Hierarchical Feed-Forward Visual Recognition Models Using Transfer Learning from Pseudo-Tasks. | Amr Ahmed, Kai Yu, Wei Xu, Yihong Gong, Eric P. Xing |
| 2008 | ICASSP | Unsupervised discriminative adaptation using discriminative mapping transforms. | Kai Yu, Mark J. F. Gales, Philip C. Woodland |
| 2008 | Interspeech | Adaptive training using discriminative mapping transforms. | Chandra Kant Raut, Kai Yu, Mark J. F. Gales |
| 2008 | Interspeech | User study of the Bayesian update of dialogue state approach to dialogue management. | Blaise Thomson, Milica Gasic, Simon Keizer, Franois Mairesse, Jost Schatzmann, Kai Yu, Steve J. Young |
| 2008 | Interspeech | Evaluating semantic-level confidence scores with multiple hypotheses. | Blaise Thomson, Kai Yu, Milica Gasic, Simon Keizer, Franois Mairesse, Jost Schatzmann, Steve J. Young |
| 2008 | ISNN | Towards a Categorical Matching Method to Process High-Dimensional Emergency Knowledge Structures. | Qingquan Wang, Lili Rong, Kai Yu |
| 2008 | PIMRC | Combining MIMO and relaying gains for highly efficient wireless backhaul. | Angeliki Alexiou, Kai Yu, Federico Boccardi |
| 2007 | ASRU | Development of a phonetic system for large vocabulary Arabic speech recognition. | Mark J. F. Gales, Frank Diehl, Chandra Kant Raut, Marcus Tomalin, Philip C. Woodland, Kai Yu |
| 2007 | ASRU | Discriminative language model adaptation for Mandarin broadcast speech transcription and translation. | Xunying Liu, William J. Byrne, Mark J. F. Gales, Adri de Gispert, Marcus Tomalin, Philip C. Woodland, Kai Yu |
| 2007 | FPGA | A 1000-word vocabulary, speaker-independent, continuous live-mode speech recognizer implemented in a single FPGA. | Edward C. Lin, Kai Yu, Rob A. Rutenbar, Tsuhan Chen |
| 2007 | ICASSP | Speech Recognition System Combination for Machine Translation. | Mark J. F. Gales, Xunying Liu, Rohit Sinha, Philip C. Woodland, Kai Yu, Spyros Matsoukas, Tim Ng, Kham Nguyen, Long Nguyen, Jean-Luc Gauvain, Lori Lamel, Abdelkhalek Messaoudi |
| 2007 | ICASSP | Improving Speech Transcription for Mandarin-English Translation. | Marcus Tomalin, Mark J. F. Gales, X. Andrew Liu, Khe Chai Sim, Rohit Sinha, Lan Wang, Philip C. Woodland, Kai Yu |
| 2007 | ICML | Local learning projections. | Mingrui Wu, Kai Yu, Shipeng Yu, Bernhard Schlkopf |
| 2007 | ICML | Robust multi-task learning with | Shipeng Yu, Volker Tresp, Kai Yu |
| 2007 | Interspeech | Unsupervised training with directed manual transcription for recognising Mandarin broadcast audio. | Kai Yu, Mark J. F. Gales, Philip C. Woodland |
| 2007 | Interspeech | Generating small, accurate acoustic models with a modified Bayesian information criterion. | Kai Yu, Rob A. Rutenbar |
| 2007 | PIMRC | A New Approach for High Data Rate Relay Transmissions using Multiple Antennas. | Federico Boccardi, Kai Yu, Angeliki Alexiou |
| 2006 | ICASSP | Incremental Adaptation using Bayesian Inference. | Kai Yu, Mark J. F. Gales |
| 2006 | ICML | Active learning via transductive experimental design. | Kai Yu, Jinbo Bi, Volker Tresp |
| 2006 | ICML | Collaborative ordinal regression. | Shipeng Yu, Kai Yu, Volker Tresp, Hans-Peter Kriegel |
| 2006 | Interspeech | Moving speech recognition from software to silicon: the in silico vox project. | Edward C. Lin, Kai Yu, Rob A. Rutenbar, Tsuhan Chen |
| 2006 | KDD | Supervised probabilistic principal component analysis. | Shipeng Yu, Kai Yu, Volker Tresp, Hans-Peter Kriegel, Mingrui Wu |
| 2005 | AISTATS | Dirichlet Enhanced Latent Semantic Analysis. | Kai Yu, Shipeng Yu, Volker Tresp |
| 2005 | CVPR | Multi-Output Regularized Projection. | Kai Yu, Shipeng Yu, Volker Tresp |
| 2005 | ICASSP | Training LVCSR Systems on Thousands of Hours of Data. | Gunnar Evermann, Ho Yin Chan, Mark J. F. Gales, Bin Jia, David Mrva, Philip C. Woodland, Kai Yu |
| 2005 | ICASSP | Development of the CUHTK 2004 Mandarin Conversational Telephone Speech Transcription System. | Mark J. F. Gales, Bin Jia, X. Andrew Liu, Khe Chai Sim, Philip C. Woodland, Kai Yu |
| 2005 | ICASSP | Investigation of Acoustic Modeling Techniques for LVCSR Systems. | Xunying Liu, Mark J. F. Gales, Khe Chai Sim, Kai Yu |
| 2005 | ICDM | Hierarchy-Regularized Latent Semantic Indexing. | Yi Huang, Kai Yu, Matthias Schubert, Shipeng Yu, Volker Tresp, Hans-Peter Kriegel |
| 2005 | ICML | Dirichlet enhanced relational learning. | Zhao Xu, Volker Tresp, Kai Yu, Shipeng Yu, Hans-Peter Kriegel |
| 2005 | ICML | Learning Gaussian processes from multiple tasks. | Kai Yu, Volker Tresp, Anton Schwaighofer |
| 2004 | ICASSP | Generating and evaluating segmentations for automatic speech recognition of conversational telephone speech. | Sue Tranter, Kai Yu, Gunnar Evermann, Philip C. Woodland |
| 2004 | ICASSP | Adaptive training using structured transforms. | Kai Yu, Mark J. F. Gales |
| 2004 | ICWE | Measuring Semantic Relations of Web Sites by Clustering of Local Context. | Carsten Stolz, Vassil Gedov, Kai Yu, Ralph Neuneier, Michal Skubacz |
| 2003 | ECIR | A Hybrid Relevance-Feedback Approach to Text Retrieval. | Zhao Xu, Xiaowei Xu, Kai Yu, Volker Tresp |
| 2003 | ECIR | Representative Sampling for Text Classification Using Support Vector Machines. | Zhao Xu, Kai Yu, Volker Tresp, Xiaowei Xu, Jizhi Wang |
| 2002 | CIKM | Removing redundancy and inconsistency in memory-based collaborative filtering. | Kai Yu, Xiaowei Xu, Anton Schwaighofer, Volker Tresp, Hans-Peter Kriegel |
| 2001 | CIKM | Selecting Relevant Instances for Efficient and Accurate Collaborative Filtering. | Kai Yu, Xiaowei Xu, Martin Ester, Hans-Peter Kriegel |
| 2001 | GLOBECOM | Second order statistics of NLOS indoor MIMO channels based on 5.2 GHz measurements. | Kai Yu, Mats Bengtsson, Bjrn E. Ottersten, Darren McNamara, Peter Karlsson, Mark A. Beach |
| 2001 | ICASSP | Codebook constrained iterative noise cancellation with applications to speech enhancement. | Yan Gao, Jing Lu, Kai Yu, Bo-Ling Xu |