Skip to content

Kai Yu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

333

Venues

41

Active years

2001–2026

Best venue rank

A*

Where they publish

Papers

Showing the 300 most recent indexed papers.

YearVenueTitleAuthors
2026AAAIPhased One-Step Adversarial Equilibrium for Video Diffusion Models.Jiaxiang Cheng, Bing Ma, Xuhua Ren, Hongyi Henry Jin, Kai Yu, Peng Zhang, Wenyue Li, Yuan Zhou, Tianxiang Zheng, Qinglin Lu
2026AAAIAHAMask: Reliable Task Specification for Large Audio Language Models Without Instructions.Yiwei Guo, Bohan Li, Hankun Wang, Zhihan Li, Shuai Wang, Xie Chen, Kai Yu
2026AAAIMergeDNA: Context-Aware Genome Modeling with Dynamic Tokenization Through Token Merging.Siyuan Li, Kai Yu, Anna Wang, Zicheng Liu, Chang Yu, Jingbo Zhou, Qirong Yang, Yucheng Guo, Xiaoming Zhang, Stan Z. Li
2026EACLBSCodec: A Band-Split Neural Codec for High-Quality Universal Audio Reconstruction.Haoran Wang, Jiatong Shi, Jinchuan Tian, Bohan Li, Kai Yu, Shinji Watanabe
2025AAAIVQTalker: Towards Multilingual Talking Avatars Through Facial Motion Tokenization.Tao Liu, Ziyang Ma, Qi Chen, Feilong Chen, Shuai Fan, Xie Chen, Kai Yu
2025ACLGigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement.Yifan Yang, Zheshu Song, Jianheng Zhuo, Mingyu Cui, Jinpeng Li, Bo Yang, Yexing Du, Ziyang Ma, Xunying Liu, Ziyuan Wang, Ke Li, Shuai Fan, Kai Yu, Wei-Qiang Zhang, Guoguo Chen, Xie Chen
2025ACLNeuSym-RAG: Hybrid Neural Symbolic Retrieval with Multiview Structuring for PDF Question Answering.Ruisheng Cao, Hanchong Zhang, Tiancheng Huang, Zhangyi Kang, Yuxin Zhang, Liangtai Sun, Hanqi Li, Yuxun Miao, Shuai Fan, Lu Chen, Kai Yu
2025ACLSLAM-Omni: Timbre-Controllable Voice Interaction System with Single-Stage Training.Wenxi Chen, Ziyang Ma, Ruiqi Yan, Yuzhe Liang, Xiquan Li, Ruiyang Xu, Zhikang Niu, Yanqiao Zhu, Yifan Yang, Zhanxun Liu, Kai Yu, Yuxuan Hu, Jinyu Li, Yan Lu, Shujie Liu, Xie Chen
2025ACLF5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching.Yushen Chen, Zhikang Niu, Ziyang Ma, Keqi Deng, Chunhui Wang, Jian Zhao, Kai Yu, Xie Chen
2025ASRULow-Resource Domain Adaptation for Speech LLMs via Text-Only Fine-Tuning.Yangui Fang, Jing Peng, Xu Li, Yu Xi, Chengwei Zhang, Guohui Zhong, Kai Yu
2025ASRUTowards General Discrete Speech Codec for Complex Acoustic Environments: A Study of Reconstruction and Downstream Task Consistency.Haoran Wang, Guanyu Chen, Bohan Li, Hankun Wang, Yiwei Guo, Zhihan Li, Xie Chen, Kai Yu
2025ASRUMasked Self-distilled Transducer-based Keyword Spotting with Semi-autoregressive Decoding.Yu Xi, Xiaoyu Gu, Haoyu Li, Jun Song, Bo Zheng, Kai Yu
2025COLINGFrom Generalist to Specialist: A Survey of Large Language Models for Chemistry.Yang Han, Ziping Wan, Lu Chen, Kai Yu, Xin Chen
2025COLINGChatCite: LLM Agent with Human Workflow Guidance for Comparative Literature Summary.Yutong Li, Lu Chen, Aiwei Liu, Kai Yu, Lijie Wen
2025COLINGConverging to a Lingua Franca: Evolution of Linguistic Regions and Semantics Alignment in Multilingual Large Language Models.Hongchuan Zeng, Senyu Han, Lu Chen, Kai Yu
2025EMNLPEnhancing Speech-to-Speech Dialogue Modeling with End-to-End Retrieval-Augmented Generation.Pengchao Feng, Ziyang Ma, Wenxi Chen, Yao Li, Sheng Wang, Kai Yu, Xie Chen
2025EMNLPAlignment for Efficient Tool Calling of Large Language Models.Hongshen Xu, Zihan Wang, Zichen Zhu, Lei Pan, Xingyu Chen, Shuai Fan, Lu Chen, Kai Yu
2025EMNLPURO-Bench: Towards Comprehensive Evaluation for End-to-End Spoken Dialogue Models.Ruiqi Yan, Xiquan Li, Wenxi Chen, Zhikang Niu, Chen Yang, Ziyang Ma, Kai Yu, Xie Chen
2025EMNLPWhen Long Helps Short: How Context Length in Supervised Fine-tuning Affects Behavior of Large Language Models.Yingming Zheng, Hanqi Li, Kai Yu, Lu Chen
2025ICASSPSLAM-AAC: Enhancing Audio Captioning with Paraphrasing Augmentation and CLAP-Refine through LLMs.Wenxi Chen, Ziyang Ma, Xiquan Li, Xuenan Xu, Yuzhe Liang, Zhisheng Zheng, Kai Yu, Xie Chen
2025ICASSPVALL-T: Decoder-Only Generative Transducer for Robust and Decoding-Controllable Text-to-Speech.Chenpeng Du, Yiwei Guo, Hankun Wang, Yifan Yang, Zhikang Niu, Shuai Wang, Hui Zhang, Xie Chen, Kai Yu
2025ICASSPFast and High-Quality Auto-Regressive Speech Synthesis via Speculative Decoding.Bohan Li, Hankun Wang, Situo Zhang, Yiwei Guo, Kai Yu
2025ICASSPNeural Directed Speech Enhancement with Dual Microphone Array in High Noise Scenario.Wen Wen, Qiang Zhou, Yu Xi, Haoyu Li, Ziqi Gong, Kai Yu
2025ICASSPStreaming Keyword Spotting Boosted by Cross-layer Discrimination Consistency.Yu Xi, Haoyu Li, Xiaoyu Gu, Hao Li, Yidi Jiang, Kai Yu
2025ICASSPNTC-KWS: Noise-aware CTC for Robust Keyword Spotting.Yu Xi, Haoyu Li, Hao Li, Jiaqi Guo, Xu Li, Wen Ding, Kai Yu
2025ICCVBitrate-Controlled Diffusion for Disentangling Motion and Content in Video.Xiao Li, Qi Chen, Xiulian Peng, Kai Yu, Xie Chen, Yan Lu
2025ICMLHeads up! Large Language Models Can Perform Tasks Without Your Instruction via Selective Attention Head Masking.Senyu Han, Hongchuan Zeng, Kai Yu, Lu Chen
2025ICMLReducing Tool Hallucination via Reliability Alignment.Hongshen Xu, Zichen Zhu, Lei Pan, Zihan Wang, Su Zhu, Da Ma, Ruisheng Cao, Lu Chen, Kai Yu
2025IJCNNConvolutional Self-Attention Network with Disentangled Intents for Course Sequence Recommendation.Kai Yu, Dongjin Yu, Dongjing Wang
2025InterspeechLSCodec: Low-Bitrate and Speaker-Decoupled Discrete Speech Codec.Yiwei Guo, Zhihan Li, Chenpeng Du, Hankun Wang, Xie Chen, Kai Yu
2025InterspeechUnlocking Temporal Flexibility: Neural Speech Codec with Variable Frame Rate.Hanglei Zhang, Yiwei Guo, Zhihan Li, Xiang Hao, Xie Chen, Kai Yu
2025InterspeechAccelerating Flow-Matching-Based Text-to-Speech via Empirically Pruned Step Sampling.Qixi Zheng, Yushen Chen, Zhikang Niu, Ziyang Ma, Xiaofei Wang, Kai Yu, Xie Chen
2025InterspeechVietASR: Achieving Industry-level Vietnamese ASR with 50-hour labeled data and Large-Scale Speech Pretraining.Jianheng Zhuo, Yifan Yang, Yiwen Shao, Yong Xu, Dong Yu, Kai Yu, Xie Chen
2025NAACLMobA: Multifaceted Memory-Enhanced Adaptive Planning for Efficient Mobile Task Automation.Zichen Zhu, Hao Tang, Yansi Li, Dingye Liu, Hongshen Xu, Kunyao Lan, Danyang Zhang, Yixuan Jiang, Hao Zhou, Chenrun Wang, Situo Zhang, Liangtai Sun, Yixiao Wang, Yuheng Sun, Lu Chen, Kai Yu
2024AAAIUniCATS: A Unified Context-Aware Text-to-Speech Framework with Contextual VQ-Diffusion and Vocoding.Chenpeng Du, Yiwei Guo, Feiyu Shen, Zhijun Liu, Zheng Liang, Xie Chen, Shuai Wang, Hui Zhang, Kai Yu
2024AAAISciEval: A Multi-Level Large Language Model Evaluation Benchmark for Scientific Research.Liangtai Sun, Yang Han, Zihan Zhao, Da Ma, Zhennan Shen, Baocai Chen, Lu Chen, Kai Yu
2024ACLIBSEN: Director-Actor Agent Collaboration for Controllable and Interactive Drama Script Generation.Senyu Han, Lu Chen, Li-Min Lin, Zhengshan Xu, Kai Yu
2024ACLSparsity-Accelerated Training for Large Language Models.Da Ma, Lu Chen, Pengyu Wang, Hongshen Xu, Hanqi Li, Liangtai Sun, Su Zhu, Shuai Fan, Kai Yu
2024COLINGMultilingual Brain Surgeon: Large Language Models Can Be Compressed Leaving No Language behind.Hongchuan Zeng, Hongshen Xu, Lu Chen, Kai Yu
2024COLINGIs LLM a Reliable Reviewer? A Comprehensive Evaluation of LLM on Automatic Paper Reviewing Tasks.Ruiyang Zhou, Lu Chen, Kai Yu
2024CVPRDiffusionGAN3D: Boosting Text-guided 3D Generation and Domain Adaptation by Combining 3D GANs and Diffusion Priors.Biwen Lei, Kai Yu, Mengyang Feng, Miaomiao Cui, Xuansong Xie
2024EMNLPAlignSum: Data Pyramid Hierarchical Fine-tuning for Aligning with Human Summarization Preference.Yang Han, Yiming Wang, Rui Wang, Lu Chen, Kai Yu
2024ICASSPVoiceFlow: Efficient Text-To-Speech with Rectified Flow Matching.Yiwei Guo, Chenpeng Du, Ziyang Ma, Xie Chen, Kai Yu
2024ICASSPSEF-VC: Speaker Embedding Free Zero-Shot Voice Conversion with Cross Attention.Junjie Li, Yiwei Guo, Xie Chen, Kai Yu
2024ICASSPLabel-Aware Auxiliary Learning for Dialogue State Tracking.Yuncong Liu, Lu Chen, Kai Yu
2024ICASSPDiffDub: Person-Generic Visual Dubbing Using Inpainting Renderer with Diffusion Auto-Encoder.Tao Liu, Chenpeng Du, Shuai Fan, Feilong Chen, Kai Yu
2024ICASSPStoryTTS: A Highly Expressive Text-to-Speech Dataset with Rich Textual Expressiveness Annotations.Sen Liu, Yiwei Guo, Xie Chen, Kai Yu
2024ICASSPAcoustic BPE for Speech Generation with Discrete Tokens.Feiyu Shen, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu
2024ICASSPEnhancing Audio Generation Diversity with Visual Information.Zeyu Xie, Baihan Li, Xuenan Xu, Mengyue Wu, Kai Yu
2024ICASSPTDT-KWS: Fast and Accurate Keyword Spotting Using Token-and-Duration Transducer.Yu Xi, Hao Li, Baochen Yang, Haoyu Li, Hainan Xu, Kai Yu
2024ICASSPContrastive Learning with Audio Discrimination for Customizable Keyword Spotting in Continuous Speech.Yu Xi, Baochen Yang, Hao Li, Jiaqi Guo, Kai Yu
2024ICASSPA Detailed Audio-Text Data Simulation Pipeline Using Single-Event Sounds.Xuenan Xu, Xiaohang Xu, Zeyu Xie, Pingyue Zhang, Mengyue Wu, Kai Yu
2024ICASSPA Birgat Model for Multi-Intent Spoken Language Understanding with Hierarchical Semantic Frames.Hongshen Xu, Ruisheng Cao, Su Zhu, Sheng Jiang, Hanchong Zhang, Lu Chen, Kai Yu
2024ICASSPTowards Universal Speech Discrete Tokens: A Case Study for ASR and TTS.Yifan Yang, Feiyu Shen, Chenpeng Du, Ziyang Ma, Kai Yu, Daniel Povey, Xie Chen
2024ICASSPSemantic-Enhanced Supervised Contrastive Learning.Pingyue Zhang, Mengyue Wu, Kai Yu
2024ICMLEvolving Subnetwork Training for Large Language Models.Hanqi Li, Lu Chen, Da Ma, Zijian Wu, Su Zhu, Kai Yu
2024IGARSSMonitoring Color for Small Water Bodyies by Fusing Sentinel-2 Multispectral Data and Gaofen -1 Panchromatic Imagery.Yadong Zhou, Kai Yu, Xueer Geng, Baoyin He, Feng Ling, Lihui Wang, Cheng Shang, Fan Yang, Qi Feng, Yun Du
2024InterspeechOn the Effectiveness of Acoustic BPE in Decoder-Only TTS.Bohan Li, Feiyu Shen, Yiwei Guo, Shuai Wang, Xie Chen, Kai Yu
2024InterspeechDiveSound: LLM-Assisted Automatic Taxonomy Construction for Diverse Audio Generation.Baihan Li, Zeyu Xie, Xuenan Xu, Yiwei Guo, Ming Yan, Ji Zhang, Kai Yu, Mengyue Wu
2024InterspeechText-aware Speech Separation for Multi-talker Keyword Spotting.Haoyu Li, Baochen Yang, Yu Xi, Linfeng Yu, Tian Tan, Hao Li, Kai Yu
2024InterspeechFakeSound: Deepfake General Audio Detection.Zeyu Xie, Baihan Li, Xuenan Xu, Zheng Liang, Kai Yu, Mengyue Wu
2024MICCAIUrFound: Towards Universal Retinal Foundation Models via Knowledge-Guided Masked Modeling.Kai Yu, Yang Zhou, Yang Bai, Zhi Da Soh, Xinxing Xu, Rick Siow Mong Goh, Ching-Yu Cheng, Yong Liu
2024NAACLCoE-SQL: In-Context Learning for Multi-Turn Text-to-SQL with Chain-of-Editions.Hanchong Zhang, Ruisheng Cao, Hongshen Xu, Lu Chen, Kai Yu
2023ACLTeCS: A Dataset and Benchmark for Tense Consistency of Machine Translation.Yiming Ai, Zhiwei He, Kai Yu, Rui Wang
2023ACLSPM: A Split-Parsing Method for Joint Multi-Intent Detection and Slot Filling.Sheng Jiang, Su Zhu, Ruisheng Cao, Qingliang Miao, Kai Yu
2023ACLExploring Schema Generalizability of Text-to-SQL.Jieyu Li, Lu Chen, Ruisheng Cao, Su Zhu, Hongshen Xu, Zhi Chen, Hanchong Zhang, Kai Yu
2023ACLCSS: A Large-scale Cross-schema Chinese Text-to-SQL Medical Dataset.Hanchong Zhang, Jieyu Li, Lu Chen, Ruisheng Cao, Yunyan Zhang, Yu Huang, Yefeng Zheng, Kai Yu
2023EMNLPACT-SQL: In-Context Learning for Text-to-SQL with Automatically-Generated Chain-of-Thought.Hanchong Zhang, Ruisheng Cao, Lu Chen, Hongshen Xu, Kai Yu
2023ICASSPImproving Few-Shot Learning for Talking Face System with TTS Data Augmentation.Qi Chen, Ziyang Ma, Tao Liu, Xu Tan, Qu Lu, Kai Yu, Xie Chen
2023ICASSPMulti-Speaker Multi-Lingual VQTTS System for LIMMITS 2023 Challenge.Chenpeng Du, Yiwei Guo, Feiyu Shen, Kai Yu
2023ICASSPEmodiff: Intensity Controllable Emotional Text-to-Speech with Soft-Label Guidance.Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu
2023ICASSPMulti-Speaker End-to-End Multi-Modal Speaker Diarization System for the MISP 2022 Challenge.Tao Liu, Zhengyang Chen, Yanmin Qian, Kai Yu
2023ICASSPDiffVoice: Text-to-Speech with Latent Diffusion.Zhijun Liu, Yiwei Guo, Kai Yu
2023ICASSPDiverse and Vivid Sound Generation from Text Descriptions.Guangwei Li, Xuenan Xu, Lingfeng Dai, Mengyue Wu, Kai Yu
2023ICASSPInvestigating Pooling Strategies and Loss Functions for Weakly-Supervised Text-to-Audio Grounding via Contrastive Learning.Xuenan Xu, Mengyue Wu, Kai Yu
2023ICCVDiverse Data Augmentation with Diffusions for Effective Test-time Prompt Tuning.Chun-Mei Feng, Kai Yu, Yong Liu, Salman Khan, Wangmeng Zuo
2023ICCVTowards Instance-adaptive Inference for Federated Learning.Chun-Mei Feng, Kai Yu, Nian Liu, Xinxing Xu, Salman Khan, Wangmeng Zuo
2023InterspeechUnSE: Unsupervised Speech Enhancement Using Optimal Transport.Wenbin Jiang, Fei Wen, Yifan Zhang, Kai Yu
2023InterspeechImproving Code-Switching and Name Entity Recognition in ASR with Speech Editing based Data Augmentation.Zheng Liang, Zheshu Song, Ziyang Ma, Chenpeng Du, Kai Yu, Xie Chen
2023InterspeechHow ChatGPT is Robust for Spoken Language Understanding?Guangpeng Li, Lu Chen, Kai Yu
2023InterspeechDSE-TTS: Dual Speaker Embedding for Cross-Lingual Text-to-Speech.Sen Liu, Yiwei Guo, Chenpeng Du, Xie Chen, Kai Yu
2023InterspeechEnhance Temporal Relations in Audio Captioning with Sound Event Detection.Zeyu Xie, Xuenan Xu, Mengyue Wu, Kai Yu
2023InterspeechReCLR: Reference-Enhanced Contrastive Learning of Audio Representation for Depression Detection.Pingyue Zhang, Mengyue Wu, Kai Yu
2023PIMRCDeep Reinforcement Learning Enabled Power Allocation for Multi-Connectivity C-V2X Downlink.Jianzhe Xue, Kai Yu, Tianqi Zhang, Haibo Zhou, Xuemin Sherman Shen
2022EMNLPAdapterShare: Task Correlation Modeling with Adapter Differentiation.Zhi Chen, Bei Chen, Lu Chen, Kai Yu, Jian-Guang Lou
2022EMNLPMETA-GUI: Towards Multi-modal Conversational Agents on Mobile GUI.Liangtai Sun, Xingyu Chen, Lu Chen, Tianle Dai, Zichen Zhu, Kai Yu
2022EMNLPD4: a Chinese Dialogue Dataset for Depression-Diagnosis-Oriented Chat.Binwei Yao, Chao Shi, Likai Zou, Lingfeng Dai, Mengyue Wu, Lu Chen, Zhen Wang, Kai Yu
2022GLOBECOMSpectral Efficiency Analysis of Uplink-Downlink Decoupled Access in C-V2X Networks.Luofang Jiao, Kai Yu, Yunting Xu, Tianqi Zhang, Haibo Zhou, Xuemin Shen
2022ICASSPLatticeBART: Lattice-to-Lattice Pre-Training for Speech Recognition.Lingfeng Dai, Lu Chen, Zhikai Zhou, Kai Yu
2022ICASSPUnsupervised Word-Level Prosody Tagging for Controllable Speech Synthesis.Yiwei Guo, Chenpeng Du, Kai Yu
2022ICASSPSpeech Enhancement with Neural Homomorphic Synthesis.Wenbin Jiang, Zhijun Liu, Kai Yu, Fei Wen
2022ICASSPCategory-Adapted Sound Event Enhancement with Weakly Labeled Data.Guangwei Li, Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu
2022ICASSPNavigating Audio-Visual Event Detection Across Mismatched Modalities.Guangwei Li, Xuenan Xu, Mengyue Wu, Kai Yu
2022ICASSPAudio-Text Retrieval in Context.Siyu Lou, Xuenan Xu, Mengyue Wu, Kai Yu
2022ICASSPClimate and Weather: Inspecting Depression Detection via Emotion Recognition.Wen Wu, Mengyue Wu, Kai Yu
2022ICASSPText Adaptive Detection for Customizable Keyword Spotting.Yu Xi, Tian Tan, Wangyou Zhang, Baochen Yang, Kai Yu
2022ICASSPDiversity-Controllable and Accurate Audio Captioning Based on Neural Condition.Xuenan Xu, Mengyue Wu, Kai Yu
2022InterspeechVQTTS: High-Fidelity Text-to-Speech Synthesis with Self-Supervised VQ Acoustic Feature.Chenpeng Du, Yiwei Guo, Xie Chen, Kai Yu
2022InterspeechEfficient Speech Enhancement with Neural Homomorphic Synthesis.Wenbin Jiang, Tao Liu, Kai Yu
2022InterspeechMSDWild: Multi-modal Speaker Diarization Dataset in the Wild.Tao Liu, Shuai Fan, Xu Xiang, Hongbo Song, Shaoxiong Lin, Jiaqi Sun, Tianyuan Han, Siyuan Chen, Binwei Yao, Sen Liu, Yifei Wu, Yanmin Qian, Kai Yu
2022MICCAITiny-Lesion Segmentation in OCT via Multi-scale Wavelet Enhanced Transformer.Meng Wang, Kai Yu, Xinxing Xu, Yi Zhou, Yuanyuan Peng, Yanyu Xu, Rick Siow Mong Goh, Yong Liu, Huazhu Fu
2022NAACLTIE: Topological Information Enhanced Structural Reading Comprehension on Web Pages.Zihan Zhao, Lu Chen, Ruisheng Cao, Hongshen Xu, Xingyu Chen, Kai Yu
2021AAAILET: Linguistic Knowledge Enhanced Graph Transformer for Chinese Short Text Matching.Boer Lyu, Lu Chen, Su Zhu, Kai Yu
2021ACLLGESQL: Line Graph Enhanced Text-to-SQL Model with Mixed Local and Non-Local Relations.Ruisheng Cao, Lu Chen, Zhi Chen, Yanbin Zhao, Su Zhu, Kai Yu
2021ACLDecoupled Dialogue Modeling and Semantic Parsing for Multi-Turn Text-to-SQL.Zhi Chen, Lu Chen, Hanqi Li, Ruisheng Cao, Da Ma, Mengyue Wu, Kai Yu
2021EMNLPWebSRC: A Dataset for Web-Based Structural Reading Comprehension.Xingyu Chen, Zihan Zhao, Lu Chen, Jiabao Ji, Danyang Zhang, Ao Luo, Yuxuan Xiong, Kai Yu
2021EMNLPGlyph Enhanced Chinese Character Pre-Training for Lexical Sememe Prediction.Boer Lyu, Lu Chen, Kai Yu
2021GLOBECOMLeveraging LEO Assisted Cloud-Edge Collaboration for Energy Efficient Computation Offloading.Zhixuan Tang, Haibo Zhou, Ting Ma, Kai Yu, Xuemin Sherman Shen
2021HCIEvaluation of Relationship Quality Within Dyads Through the Performance in Dual-Player Cooperative Tasks.Haijiang Yan, Kai Yu, Guozhen Zhao
2021ICASSPSynAug: Synthesis-Based Data Augmentation for Text-Dependent Speaker Verification.Chenpeng Du, Bing Han, Shuai Wang, Yanmin Qian, Kai Yu
2021ICASSPText-to-Audio Grounding: Building Correspondence Between Captions and Sound Events.Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu
2021ICASSPInvestigating Local and Global Information for Automated Audio Captioning with Transfer Learning.Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Zeyu Xie, Kai Yu
2021InterspeechClass-Based Neural Network Language Model for Second-Pass Rescoring in ASR.Lingfeng Dai, Qi Liu, Kai Yu
2021InterspeechRich Prosody Diversity Modelling with Phone-Level Mixture Density Network.Chenpeng Du, Kai Yu
2021InterspeechA Lightweight Framework for Online Voice Activity Detection in the Wild.Xuenan Xu, Heinrich Dinkel, Mengyue Wu, Kai Yu
2021NAACLShadowGNN: Graph Projection Neural Network for Text-to-SQL Parser.Zhi Chen, Lu Chen, Yanbin Zhao, Ruisheng Cao, Zihan Xu, Su Zhu, Kai Yu
2020AAAISchema-Guided Multi-Domain Dialogue State Tracking with Graph Attention Neural Networks.Lu Chen, Boer Lv, Chi Wang, Su Zhu, Bowen Tan, Kai Yu
2020AAAISemi-Supervised Text Simplification with Back-Translation and Asymmetric Denoising Autoencoders.Yanbin Zhao, Lu Chen, Zhi Chen, Kai Yu
2020ACLUnsupervised Dual Paraphrasing for Two-stage Semantic Parsing.Ruisheng Cao, Su Zhu, Chenyu Yang, Chen Liu, Rao Ma, Yanbin Zhao, Lu Chen, Kai Yu
2020ACLNeural Graph Matching Networks for Chinese Short Text Matching.Lu Chen, Yanbin Zhao, Boer Lyu, Lesheng Jin, Zhi Chen, Su Zhu, Kai Yu
2020ACLLine Graph Enhanced AMR-to-Text Generation with Mix-Order Graph Attention Networks.Yanbin Zhao, Lu Chen, Zhi Chen, Ruisheng Cao, Su Zhu, Kai Yu
2020EMNLPEfficient Context and Schema Fusion Networks for Multi-Domain Dialogue State Tracking.Su Zhu, Jieyu Li, Lu Chen, Kai Yu
2020GLOBECOMA Reinforcement Learning Aided Decoupled RAN Slicing Framework for Cellular V2X.Kai Yu, Haibo Zhou, Bo Qian, Zhixuan Tang, Xuemin Shen
2020HCICan Video Game Training Improve the Two-Dimensional Mental Rotation Ability of Young Children? - A Randomized Controlled Trial.Xiaocen Liu, Heqing Huang, Kai Yu, Donghui Dou
2020ICASSPInvestigation of Specaugment for Deep Speaker Embedding Learning.Shuai Wang, Johan Rohdin, Oldrich Plchot, Luks Burget, Kai Yu, Jan Cernock
2020ICASSPChannel Invariant Speaker Embedding Learning with Joint Multi-Task and Adversarial Training.Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu
2020ICASSPDuration Robust Weakly Supervised Sound Event Detection.Heinrich Dinkel, Kai Yu
2020ICASSPSpeaker Augmentation for Low Resource Speech Recognition.Chenpeng Du, Kai Yu
2020ICASSPA Hierarchical Tracker for Multi-Domain Dialogue State Tracking.Jieyu Li, Su Zhu, Kai Yu
2020ICASSPAddressing the Polysemy Problem in Language Modeling with Attentional Multi-Sense Embeddings.Rao Ma, Lesheng Jin, Qi Liu, Lu Chen, Kai Yu
2020ICASSPNeural Lattice Search for Speech Recognition.Rao Ma, Hao Li, Qi Liu, Lu Chen, Kai Yu
2020ICASSPText Adaptation for Speaker Verification with Speaker-Text Factorized Embeddings.Yexin Yang, Shuai Wang, Xun Gong, Yanmin Qian, Kai Yu
2020ICDCSCODA: Improving Resource Utilization by Slimming and Co-locating DNN and CPU Jobs.Han Zhao, Weihao Cui, Quan Chen, Jingwen Leng, Kai Yu, Deze Zeng, Chao Li, Minyi Guo
2020InterspeechVoice Activity Detection in the Wild via Weakly Supervised Sound Event Detection.Yefei Chen, Heinrich Dinkel, Mengyue Wu, Kai Yu
2020InterspeechNeural Homomorphic Vocoder.Zhijun Liu, Kuan Chen, Kai Yu
2020InterspeechJointly Encoding Word Confusion Network and Dialogue Context with BERT for Spoken Language Understanding.Chen Liu, Su Zhu, Zijian Zhao, Ruisheng Cao, Lu Chen, Kai Yu
2020InterspeechDual-Adversarial Domain Adaptation for Generalized Replay Attack Detection.Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu
2020VTCAn Evolutionary Game Assisted Spectrum Sharing Blockchain Framework for Internet of Vehicles.Dou Hu, Haibo Zhou, Ting Ma, Kai Yu, Nan Cheng
2019ACLSemantic Parsing with Dual Learning.Ruisheng Cao, Su Zhu, Chen Liu, Jieyu Li, Kai Yu
2019ASRUExploring Model Units and Training Strategies for End-to-End Speech Recognition.Mingkun Huang, Yizhou Lu, Lan Wang, Yanmin Qian, Kai Yu
2019ASRUHighly Efficient Neural Network Language Model Compression Using Soft Binarization Training.Rao Ma, Qi Liu, Kai Yu
2019EMNLPData Augmentation with Atomic Templates for Spoken Language Understanding.Zijian Zhao, Su Zhu, Kai Yu
2019ICASSPEnd-to-end Monaural Multi-speaker ASR System without Pretraining.Xuankai Chang, Yanmin Qian, Kai Yu, Shinji Watanabe
2019ICASSPKnowledge Distillation for Small Foot-print Deep Speaker Embedding.Shuai Wang, Yexin Yang, Tianzhe Wang, Yanmin Qian, Kai Yu
2019ICASSPAudio Caption: Listen and Tell.Mengyue Wu, Heinrich Dinkel, Kai Yu
2019ICASSPA Hierarchical Decoding Model for Spoken Language Understanding from Unaligned Data.Zijian Zhao, Su Zhu, Kai Yu
2019ICMIRobust Spoken Language Understanding with Acoustic and Domain Knowledge.Hao Li, Chen Liu, Su Zhu, Kai Yu
2019ICMICATSLU: The 1st Chinese Audio-Textual Spoken Language Understanding Challenge.Su Zhu, Zijian Zhao, Tiejun Zhao, Chengqing Zong, Kai Yu
2019InterspeechJoint Decoding of CTC Based Systems for Speech Recognition.Jiaqi Guo, Yongbin You, Yanmin Qian, Kai Yu
2019InterspeechCross-Domain Replay Spoofing Attack Detection Using Domain Adversarial Training.Hongji Wang, Heinrich Dinkel, Shuai Wang, Yanmin Qian, Kai Yu
2019InterspeechOn the Usage of Phonetic Information for Text-Independent Speaker Embedding Extraction.Shuai Wang, Johan Rohdin, Luks Burget, Oldrich Plchot, Yanmin Qian, Kai Yu, Jan Cernock
2019InterspeechData Augmentation Using Variational Autoencoder for Embedding Based Speaker Verification.Zhanghao Wu, Shuai Wang, Yanmin Qian, Kai Yu
2019InterspeechThe SJTU Robust Anti-Spoofing System for the ASVspoof 2019 Challenge.Yexin Yang, Hongji Wang, Heinrich Dinkel, Zhengyang Chen, Shuai Wang, Yanmin Qian, Kai Yu
2018COLINGStructured Dialogue Policy with Graph Neural Networks.Lu Chen, Bowen Tan, Sishan Long, Kai Yu
2018EMNLPTowards Universal Dialogue State Tracking.Liliang Ren, Kaige Xie, Lu Chen, Kai Yu
2018ICASSPPolicy Adaptation for Deep Reinforcement Learning-Based Dialogue Management.Lu Chen, Cheng Chang, Zhi Chen, Bowen Tan, Milica Gasic, Kai Yu
2018ICASSPOn Modular Training of Neural Acoustics-to-Word Model for LVCSR.Zhehuai Chen, Qi Liu, Hao Li, Kai Yu
2018ICASSPFast Oov Words Incorporation Using Structured Word Embeddings for Neural Network Language Model.Ruinian Chen, Kai Yu
2018ICASSPSemi-Supervised Training Using Adversarial Multi-Task Learning for Spoken Language Understanding.Ouyu Lan, Su Zhu, Kai Yu
2018ICASSPFocal Kl-Divergence Based Dilated Convolutional Neural Networks for Co-Channel Speaker Identification.Shuai Wang, Yanmin Qian, Kai Yu
2018ICASSPRobust Spoken Language Understanding with Unsupervised ASR-Error Adaptation.Su Zhu, Ouyu Lan, Kai Yu
2018InterspeechHigh-quality Voice Conversion Using Spectrogram-Based WaveNet Vocoder.Kuan Chen, Bo Chen, Jiahao Lai, Kai Yu
2018InterspeechAngular Softmax for Short-Duration Text-independent Speaker Verification.Zili Huang, Shuai Wang, Kai Yu
2018InterspeechKnowledge Distillation for Sequence Model.Mingkun Huang, Yongbin You, Zhehuai Chen, Yanmin Qian, Kai Yu
2018InterspeechStructured Word Embedding for Low Memory Neural Network Language Model.Kaiyu Shi, Kai Yu
2018MICCAIExplaining Convolutional Neural Networks for Area Estimation of Choroidal Neovascularization via Genetic Programming.Yibiao Rong, Kai Yu, Dehui Xiang, Weifang Zhu, Zhun Fan, Xinjian Chen
2018NAACLBinarized LSTM Language Model.Xuan Liu, Di Cao, Kai Yu
2017ASRUFuture vector enhanced LSTM language model for LVCSR.Qi Liu, Yanmin Qian, Kai Yu
2017BMVCWeakly-supervised Learning of Mid-level Features for Pedestrian Attribute Recognition and Localization.Yang Zhou, Kai Yu, Biao Leng, Zhang Zhang, Dangwei Li, Kaiqi Huang
2017EACLOn-line Dialogue Policy Learning with Companion Teaching.Lu Chen, Runzhe Yang, Cheng Chang, Zihao Ye, Xiang Zhou, Kai Yu
2017EMNLPAffordable On-line Dialogue Policy Learning.Cheng Chang, Runzhe Yang, Lu Chen, Xiang Zhou, Kai Yu
2017EMNLPAgent-Aware Dropout DQN for Safe and Efficient On-line Dialogue Policy Learning.Lu Chen, Xiang Zhou, Cheng Chang, Runzhe Yang, Kai Yu
2017ICASSPConfidence measures for CTC-based phone synchronous decoding.Zhehuai Chen, Yimeng Zhuang, Kai Yu
2017ICASSPEnd-to-end spoofing detection with raw waveform CLDNNS.Heinrich Dinkel, Nanxin Chen, Yanmin Qian, Kai Yu
2017ICASSPEncoder-decoder with focus-mechanism for sequence labelling based spoken language understanding.Su Zhu, Kai Yu
2017IJCNNSmall-footprint convolutional neural network for spoofing detection.Heinrich Dinkel, Yanmin Qian, Kai Yu
2017InterspeechDiscrete Duration Model for Speech Synthesis.Bo Chen, Tianling Bian, Kai Yu
2017InterspeechComparison of Modeling Target in LSTM-RNN Duration Model.Bo Chen, Jiahao Lai, Kai Yu
2017InterspeechWhat Does the Speaker Embedding Encode?Shuai Wang, Yanmin Qian, Kai Yu
2017InterspeechBinary Deep Neural Networks for Speech Recognition.Xu Xiang, Yanmin Qian, Kai Yu
2016CHIReadful-U: Improving Reading Experience and Social Interaction for Low Vision Elders.Ninglu Wang, Kai Yu, Junhui Li, Ruofan Zhang, Fei Ren
2016ICASSPA comparative study of robustness of deep learning approaches for VAD.Sibo Tong, Hao Gu, Kai Yu
2016ICASSPDiscriminatively trained joint speaker and environment representations for adaptation of deep neural network acoustic models.Maofan Yin, Sunil Sivadas, Kai Yu, Bin Ma
2016ICASSPA fast direct source localization approach for acoustic sensor array.Kai Yu, Kung Yao, Ralph E. Hudson, Charles E. Taylor, Zhi Wang
2016InterspeechPhone Synchronous Decoding with CTC Lattice.Zhehuai Chen, Wei Deng, Tao Xu, Kai Yu
2016InterspeechHybrid Dialogue State Tracking for Real World Human-to-Human Dialogues.Kai Sun, Su Zhu, Lu Chen, Siqiu Yao, Xueyang Wu, Kai Yu
2016InterspeechUnrestricted Vocabulary Keyword Spotting Using LSTM-CTC.Yimeng Zhuang, Xuankai Chang, Yanmin Qian, Kai Yu
2015ASRUMulti-task joint-learning of deep neural networks for robust speech recognition.Yanmin Qian, Maofan Yin, Yongbin You, Kai Yu
2015CVPRDeep multiple instance learning for image classification and auto-annotation.Jiajun Wu, Yinan Yu, Chang Huang, Kai Yu
2015HPCCDesign and Architecture of Dell Acceleration Appliances for Database (DAAD): A Practical Approach with High Availability Guaranteed.Kai Yu, Yu-Xiang Gao, Peng Zhang, Meikang Qiu
2015ICASSPA novel static parameter calculation method for model compensation.Suliang Bu, Yunxin Zhao, Yanmin Qian, Kai Yu
2015ICASSPRecurrent neural network language model with structured word embeddings for speech recognition.Tianxing He, Xu Xiang, Yanmin Qian, Kai Yu
2015ICASSPCluster adaptive training for deep neural network.Tian Tan, Yanmin Qian, Maofan Yin, Yimeng Zhuang, Kai Yu
2015ICCVText Flow: A Unified Text Detection System in Natural Scene Images.Shangxuan Tian, Yifeng Pan, Chang Huang, Shijian Lu, Kai Yu, Chew Lim Tan
2015IJCNNAutomatic model redundancy reduction for fast back-propagation for deep neural networks in speech recognition.Yanmin Qian, Tianxing He, Wei Deng, Kai Yu
2015InterspeechVery deep convolutional neural networks for LVCSR.Mengxiao Bi, Yanmin Qian, Kai Yu
2015InterspeechAn investigation of context clustering for statistical speech synthesis with deep neural network.Bo Chen, Zhehuai Chen, Jiachen Xu, Kai Yu
2015InterspeechRobust deep feature for spoofing detection - the SJTU system for ASVspoof 2015 challenge.Nanxin Chen, Yanmin Qian, Heinrich Dinkel, Bo Chen, Kai Yu
2015InterspeechMulti-task learning for text-dependent speaker verification.Nanxin Chen, Yanmin Qian, Kai Yu
2015InterspeechParagraph vector based topic model for language model adaptation.Wengong Jin, Tianxing He, Yanmin Qian, Kai Yu
2014ICASSPSecond order vector taylor series based robust speech recognition.Suliang Bu, Yanmin Qian, Khe Chai Sim, Yongbin You, Kai Yu
2014ICASSPStochastic data sweeping for fast DNN training.Wei Deng, Yanmin Qian, Yuchen Fan, Tianfan Fu, Kai Yu
2014ICASSPReshaping deep neural network for fast decoding by node-pruning.Tianxing He, Yuchen Fan, Yanmin Qian, Tian Tan, Kai Yu
2014IJCNNSpeaker verification with deep features.Yuan Liu, Tianfan Fu, Yuchen Fan, Yanmin Qian, Kai Yu
2014InterspeechA novel dynamic parameters calculation approach for model compensation.Suliang Bu, Yanmin Qian, Kai Yu
2014InterspeechTandem deep features for text-dependent speaker verification.Tianfan Fu, Yanmin Qian, Yuan Liu, Kai Yu
2014MASSAn Improved Joint Sparse Representation of Array Covariance Matrices Approach in Multi-source Direct Position.Zhuo-Hao Chen, Kai Yu, Ji-an Luo, Zhi Wang
2014MASSCS-Based Framework for Sparse Signal Transmission over Lossy Link.Liantao Wu, Kai Yu, Yu Hen Hu, Zhi Wang
2013ASRUCombination of data borrowing strategies for low-resource LVCSR.Yanmin Qian, Kai Yu, Jia Liu
2013CIKMLarge-scale deep learning at Baidu.Kai Yu
2013ICMLSmooth Sparse Coding via Marginal Regression for Learning Sparse Representations.Krishnakumar Balasubramanian, Kai Yu, Guy Lebanon
2013InterspeechCluster adaptive training with factorized decision trees for speech recognition.Kai Yu, Hainan Xu
2013MASSAWSAN: A Realtime Wireless Sensor Array Platform.Kai Yu, Ming Yin, Tianxu Du, Liantao Wu, Zhi Wang
2013MASSA Direct Wideband Direction of Arrival Estimation under Compressive Sensing.Kai Yu, Ming Yin, Ji-an Luo, Ming Bao, Yu Hen Hu, Zhi Wang
2013PIMRCAn adaptive massive access management for M2M communications in smart grid.Peng Si, Xiaobin Tan, Jian Yang, Fei Yin, Haifeng Wang, Kai Yu, Zhiyong Bu
2012ECCVMulti-component Models for Object Detection.Chunhui Gu, Pablo Andrs Arbelez, Yuanqing Lin, Kai Yu, Jitendra Malik
2012ECCVObject-Centric Spatial Pooling for Image Classification.Olga Russakovsky, Yuanqing Lin, Kai Yu, Li Fei-Fei
2012ECCVQuery Specific Fusion for Image Retrieval.Shaoting Zhang, Ming Yang, Timothe Cour, Kai Yu, Dimitris N. Metaxas
2012ICMIICMI'12 grand challenge: haptic voice recognition.Khe Chai Sim, Shengdong Zhao, Kai Yu, Hank Liao
2012ICMIDevelopment of the 2012 SJTU HVR system.Hainan Xu, Yuchen Fan, Kai Yu
2012ICSEImproving failure-inducing changes identification using coverage analysis.Kai Yu
2012ICSEAn integrated bug processing framework.Xiangyu Zhang, Mengxiang Lin, Kai Yu
2012ICSTWhen a GUI Regression Test Failed, What Should be Blamed?Jin Chen, Mengxiang Lin, Kai Yu, Bing Shao
2012ICSTTowards Practical Debugging for Regression Faults.Kai Yu, Mengxiang Lin
2012IGARSSInvestigation on the dynamics of artificial surface reflectance under field condition.Kang Jiang, Xiangjuan Li, Luyan Ji, Kai Yu, Yongchao Zhao, Hairong Tang, Xiurui Geng, Daobin Zhang
2011ACSSCEfficient re-ranking in vocabulary tree based image retrieval.Xiaoyu Wang, Ming Yang, Kai Yu
2011ASRUOn-line policy optimisation of spoken dialogue systems via live interaction with human subjects.Milica Gasic, Filip Jurccek, Blaise Thomson, Kai Yu, Steve J. Young
2011COMPSACAchieving High Branch Coverage with Fewer Paths.Yu Dong, Mengxiang Lin, Kai Yu, Yi Zhou, Yin-li Chen
2011CVPRLarge-scale image classification: Fast feature extraction and SVM training.Yuanqing Lin, Fengjun Lv, Shenghuo Zhu, Ming Yang, Timothe Cour, Kai Yu, Liangliang Cao, Thomas S. Huang
2011CVPRCorrespondence driven adaptation for human profile recognition.Ming Yang, Shenghuo Zhu, Fengjun Lv, Kai Yu
2011CVPRLearning image representations from the pixel level via hierarchical sparse coding.Kai Yu, Yuanqing Lin, John D. Lafferty
2011DATEA high-level analytical model for application specific CMP design exploration.Andrew Cassidy, Kai Yu, Haolang Zhou, Andreas G. Andreou
2011ICASSPStructured precision modelling with Cholesky Basis Superposition for speech recognition.Lei Jia, Kai Yu, Bo Xu
2011ICASSPJoint modelling of voicing label and continuous F0 for HMM based speech synthesis.Kai Yu, Steve J. Young
2011ICCVContextual weighting for vocabulary tree based image retrieval.Xiaoyu Wang, Ming Yang, Timothe Cour, Shenghuo Zhu, Kai Yu, Tony X. Han
2011ICIPReal-time clothing recognition in surveillance videos.Ming Yang, Kai Yu
2011InterspeechReal User Evaluation of Spoken Dialogue Systems Using Amazon Mechanical Turk.Filip Jurccek, Simon Keizer, Milica Gasic, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young
2010ACLPhrase-Based Statistical Language Generation Using Graphical Models and Active Learning.Franois Mairesse, Milica Gasic, Filip Jurccek, Simon Keizer, Blaise Thomson, Kai Yu, Steve J. Young
2010CVPRLocality-constrained Linear Coding for image classification.Jinjun Wang, Jianchao Yang, Kai Yu, Fengjun Lv, Thomas S. Huang, Yihong Gong
2010CVPRSupervised translation-invariant sparse coding.Jianchao Yang, Kai Yu, Thomas S. Huang
2010ECCVPredicting Facial Beauty without Landmarks.Douglas Gray, Kai Yu, Wei Xu, Yihong Gong
2010ECCVEfficient Highly Over-Complete Sparse Coding Using a Mixture Model.Jianchao Yang, Kai Yu, Thomas S. Huang
2010ECCVImage Classification Using Super-Vector Coding of Local Image Descriptors.Xi Zhou, Kai Yu, Tong Zhang, Thomas S. Huang
2010ICASSPWord-level emphasis modelling in HMM-based speech synthesis.Kai Yu, Franois Mairesse, Steve J. Young
2010ICDMTraining Conditional Random Fields Using Transfer Learning for Gesture Recognition.Jie Liu, Kai Yu, Yi Zhang, Yalou Huang
2010ICML3D Convolutional Neural Networks for Human Action Recognition.Shuiwang Ji, Wei Xu, Ming Yang, Kai Yu
2010ICMLImproved Local Coordinate Coding using Local Tangents.Kai Yu, Tong Zhang
2010InterspeechCanonical state models for automatic speech recognition.Mark J. F. Gales, Kai Yu
2010InterspeechNatural belief-critic: a reinforcement algorithm for parameter estimation in statistical spoken dialogue systems.Filip Jurccek, Blaise Thomson, Simon Keizer, Franois Mairesse, Milica Gasic, Kai Yu, Steve J. Young
2010InterspeechContext adaptive training with factorized decision trees for HMM-based speech synthesis.Kai Yu, Heiga Zen, Franois Mairesse, Steve J. Young
2009APSECProgram Sifting: Select Property-Related Functions for Language-Based Static Analysis.Kai Yu, Cong Wang, Yin-li Chen, Mengxiang Lin
2009ASRUBack-off action selection in summary space-based POMDP dialogue systems.Milica Gasic, Fabrice Lefvre, Filip Jurccek, Simon Keizer, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young
2009CVPRLinear spatial pyramid matching using sparse coding for image classification.Jianchao Yang, Kai Yu, Yihong Gong, Thomas S. Huang
2009ICASSPSpoken language understanding from unaligned data using discriminative classification models.Franois Mairesse, Milica Gasic, Filip Jurccek, Simon Keizer, Blaise Thomson, Kai Yu, Steve J. Young
2009ICASSPProbablistic modelling of F0 in unvoiced regions in HMM based speech synthesis.Kai Yu, Tomoki Toda, Milica Gasic, Simon Keizer, Franois Mairesse, Blaise Thomson, Steve J. Young
2009ICMLTutorial summary: Learning with dependencies between several response variables.Volker Tresp, Kai Yu
2009ICMLLarge-scale collaborative prediction using a nonparametric random effects model.Kai Yu, John D. Lafferty, Shenghuo Zhu, Yihong Gong
2009ICMLWorkshop summary: Workshop on learning feature hierarchies.Kai Yu, Ruslan Salakhutdinov, Yann LeCun, Geoffrey E. Hinton, Yoshua Bengio
2009InterspeechTransformation-based learning for semantic parsing.Filip Jurccek, Milica Gasic, Simon Keizer, Franois Mairesse, Blaise Thomson, Kai Yu, Steve J. Young
2009InterspeechProfiling large-vocabulary continuous speech recognition on embedded devices: a hardware resource sensitivity analysis.Kai Yu, Rob A. Rutenbar
2009ICSELazy Symbolic Evaluation and Its Path Constraints Solution.Mengxiang Lin, Yin-li Chen, Kai Yu, Guo-shi Wu
2008ECCVTraining Hierarchical Feed-Forward Visual Recognition Models Using Transfer Learning from Pseudo-Tasks.Amr Ahmed, Kai Yu, Wei Xu, Yihong Gong, Eric P. Xing
2008ICASSPUnsupervised discriminative adaptation using discriminative mapping transforms.Kai Yu, Mark J. F. Gales, Philip C. Woodland
2008InterspeechAdaptive training using discriminative mapping transforms.Chandra Kant Raut, Kai Yu, Mark J. F. Gales
2008InterspeechUser study of the Bayesian update of dialogue state approach to dialogue management.Blaise Thomson, Milica Gasic, Simon Keizer, Franois Mairesse, Jost Schatzmann, Kai Yu, Steve J. Young
2008InterspeechEvaluating semantic-level confidence scores with multiple hypotheses.Blaise Thomson, Kai Yu, Milica Gasic, Simon Keizer, Franois Mairesse, Jost Schatzmann, Steve J. Young
2008ISNNTowards a Categorical Matching Method to Process High-Dimensional Emergency Knowledge Structures.Qingquan Wang, Lili Rong, Kai Yu
2008PIMRCCombining MIMO and relaying gains for highly efficient wireless backhaul.Angeliki Alexiou, Kai Yu, Federico Boccardi
2007ASRUDevelopment of a phonetic system for large vocabulary Arabic speech recognition.Mark J. F. Gales, Frank Diehl, Chandra Kant Raut, Marcus Tomalin, Philip C. Woodland, Kai Yu
2007ASRUDiscriminative language model adaptation for Mandarin broadcast speech transcription and translation.Xunying Liu, William J. Byrne, Mark J. F. Gales, Adri de Gispert, Marcus Tomalin, Philip C. Woodland, Kai Yu
2007FPGAA 1000-word vocabulary, speaker-independent, continuous live-mode speech recognizer implemented in a single FPGA.Edward C. Lin, Kai Yu, Rob A. Rutenbar, Tsuhan Chen
2007ICASSPSpeech Recognition System Combination for Machine Translation.Mark J. F. Gales, Xunying Liu, Rohit Sinha, Philip C. Woodland, Kai Yu, Spyros Matsoukas, Tim Ng, Kham Nguyen, Long Nguyen, Jean-Luc Gauvain, Lori Lamel, Abdelkhalek Messaoudi
2007ICASSPImproving Speech Transcription for Mandarin-English Translation.Marcus Tomalin, Mark J. F. Gales, X. Andrew Liu, Khe Chai Sim, Rohit Sinha, Lan Wang, Philip C. Woodland, Kai Yu
2007ICMLLocal learning projections.Mingrui Wu, Kai Yu, Shipeng Yu, Bernhard Schlkopf
2007ICMLRobust multi-task learning withShipeng Yu, Volker Tresp, Kai Yu
2007InterspeechUnsupervised training with directed manual transcription for recognising Mandarin broadcast audio.Kai Yu, Mark J. F. Gales, Philip C. Woodland
2007InterspeechGenerating small, accurate acoustic models with a modified Bayesian information criterion.Kai Yu, Rob A. Rutenbar
2007PIMRCA New Approach for High Data Rate Relay Transmissions using Multiple Antennas.Federico Boccardi, Kai Yu, Angeliki Alexiou
2006ICASSPIncremental Adaptation using Bayesian Inference.Kai Yu, Mark J. F. Gales
2006ICMLActive learning via transductive experimental design.Kai Yu, Jinbo Bi, Volker Tresp
2006ICMLCollaborative ordinal regression.Shipeng Yu, Kai Yu, Volker Tresp, Hans-Peter Kriegel
2006InterspeechMoving speech recognition from software to silicon: the in silico vox project.Edward C. Lin, Kai Yu, Rob A. Rutenbar, Tsuhan Chen
2006KDDSupervised probabilistic principal component analysis.Shipeng Yu, Kai Yu, Volker Tresp, Hans-Peter Kriegel, Mingrui Wu
2005AISTATSDirichlet Enhanced Latent Semantic Analysis.Kai Yu, Shipeng Yu, Volker Tresp
2005CVPRMulti-Output Regularized Projection.Kai Yu, Shipeng Yu, Volker Tresp
2005ICASSPTraining LVCSR Systems on Thousands of Hours of Data.Gunnar Evermann, Ho Yin Chan, Mark J. F. Gales, Bin Jia, David Mrva, Philip C. Woodland, Kai Yu
2005ICASSPDevelopment of the CUHTK 2004 Mandarin Conversational Telephone Speech Transcription System.Mark J. F. Gales, Bin Jia, X. Andrew Liu, Khe Chai Sim, Philip C. Woodland, Kai Yu
2005ICASSPInvestigation of Acoustic Modeling Techniques for LVCSR Systems.Xunying Liu, Mark J. F. Gales, Khe Chai Sim, Kai Yu
2005ICDMHierarchy-Regularized Latent Semantic Indexing.Yi Huang, Kai Yu, Matthias Schubert, Shipeng Yu, Volker Tresp, Hans-Peter Kriegel
2005ICMLDirichlet enhanced relational learning.Zhao Xu, Volker Tresp, Kai Yu, Shipeng Yu, Hans-Peter Kriegel
2005ICMLLearning Gaussian processes from multiple tasks.Kai Yu, Volker Tresp, Anton Schwaighofer
2004ICASSPGenerating and evaluating segmentations for automatic speech recognition of conversational telephone speech.Sue Tranter, Kai Yu, Gunnar Evermann, Philip C. Woodland
2004ICASSPAdaptive training using structured transforms.Kai Yu, Mark J. F. Gales
2004ICWEMeasuring Semantic Relations of Web Sites by Clustering of Local Context.Carsten Stolz, Vassil Gedov, Kai Yu, Ralph Neuneier, Michal Skubacz
2003ECIRA Hybrid Relevance-Feedback Approach to Text Retrieval.Zhao Xu, Xiaowei Xu, Kai Yu, Volker Tresp
2003ECIRRepresentative Sampling for Text Classification Using Support Vector Machines.Zhao Xu, Kai Yu, Volker Tresp, Xiaowei Xu, Jizhi Wang
2002CIKMRemoving redundancy and inconsistency in memory-based collaborative filtering.Kai Yu, Xiaowei Xu, Anton Schwaighofer, Volker Tresp, Hans-Peter Kriegel
2001CIKMSelecting Relevant Instances for Efficient and Accurate Collaborative Filtering.Kai Yu, Xiaowei Xu, Martin Ester, Hans-Peter Kriegel
2001GLOBECOMSecond order statistics of NLOS indoor MIMO channels based on 5.2 GHz measurements.Kai Yu, Mats Bengtsson, Bjrn E. Ottersten, Darren McNamara, Peter Karlsson, Mark A. Beach
2001ICASSPCodebook constrained iterative noise cancellation with applications to speech enhancement.Yan Gao, Jing Lu, Kai Yu, Bo-Ling Xu