| 2026 | AAAI | DegVoC: Revisiting Neural Vocoder from a Degradation Perspective. | Andong Li, Tong Lei, Lingling Dai, Kai Li, Rilin Chen, Meng Yu, Xiaodong Li, Dong Yu, Chengshi Zheng |
| 2026 | AAAI | Beyond Euclidean Assumptions: Geometry-Aware Adaptive Routing for Remote Sensing Segmentation. | Jie Qiu, Dizuo Cao, Linwei Dai, Xin Li, Fan Yang, Dong Yu, Changying Wang, Zongheng Wen, Youqin Chen, Jianzhang Chen |
| 2026 | AAAI | Enhancing Stability and Fidelity for Zero-Shot TTS with a Multi-Level Evaluator. | Hualei Wang, Na Li, Chuke Wang, Shu Wu, Zhifeng Li, Dong Yu |
| 2026 | AAAI | UniCUE: Unified Recognition and Generation Framework for Chinese Cued Speech Video-to-Speech Generation. | Jinting Wang, Shan Yang, Chenxing Li, Dong Yu, Li Liu |
| 2026 | AAAI | Audio-Thinker: Guiding Large Audio Language Model When and How to Think via Reinforcement Learning. | Shu Wu, Chenxing Li, Wenfu Wang, Hao Zhang, Hualei Wang, Meng Yu, Dong Yu |
| 2026 | ACL | Multi-Scale Spectral Selection and Entropy-Guided Uncertainty Fusion for Multimodal Rumor Detection. | Zongliang Han, Wenyu Guo, Guoqing Jin, Yang Liu, Fan Li, Dong Yu, Yan Song, Fengzhen Zhang |
| 2026 | ACL | Covariance Matrix-Driven Image Channel Allocation for Multimodal Fake News Detection. | Zongliang Han, Wenyu Guo, Guoqing Jin, Yang Liu, Yan Song, Dong Yu, Wang Min |
| 2026 | ACL | VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents. | Jiliang Hu, Wenfu Wang, Zuchao Li, Chenxing Li, Yiyang Zhao, Hanzhao Li, Liqiang Zhang, Meng Yu, Dong Yu |
| 2026 | ACL | Your Reasoning Model is Secretly a Reward Model - Optimization-Free Verification from Experience. | Zhenwen Liang, Ruosen Li, Yujun Zhou, Linfeng Song, Dian Yu, Xinya Du, Haitao Mi, Dong Yu |
| 2026 | ACL | Too Correct to Learn: Reinforcement Learning on Saturated Reasoning Data. | Zhenwen Liang, Yujun Zhou, Sidi Lu, Xiangliang Zhang, Haitao Mi, Dong Yu |
| 2026 | ACL | EconProver: Towards More Economical Test-Time Scaling for Automated Theorem Proving. | Mukai Li, Linfeng Song, Zhenwen Liang, Jiahao Xu, Shansan Gong, Qi Liu, Haitao Mi, Dong Yu |
| 2026 | ACL | Save the Good Prefix: Precise Error Penalization via Process-Supervised RL to Enhance LLM Reasoning. | Haolin Liu, Dian Yu, Sidi Lu, Yujun Zhou, Rui Liu, Zhenwen Liang, Haitao Mi, Chen-Yu Wei, Dong Yu |
| 2026 | ACL | Verified Critical Step Optimization for LLM Agents. | Mukai Li, Qingcheng Zeng, Tianqing Fang, Zhenwen Liang, Linfeng Song, Qi Liu, Haitao Mi, Dong Yu |
| 2026 | ACL | Beyond Detection: Evaluating Fallacy Awareness of LLMs in Interactive Scenarios. | Conghui Niu, Ningxin Wu, Ziran Zhao, Dong Yu, Chen Kang, Pengyuan Liu |
| 2026 | ACL | SPAGBias: Uncovering and Tracing Structured Spatial Gender Bias in Large Language Models. | Binxian Su, Haoye Lou, Shucheng Zhu, Weikang Wang, Ying Liu, Dong Yu, Pengyuan Liu |
| 2026 | ACL | Crossing the Reward Bridge: Expanding Reinforcement Learning with Verifiable Rewards Across Diverse Domains. | Yi Su, Dian Yu, Linfeng Song, Juntao Li, Haitao Mi, Zhaopeng Tu, Min Zhang, Dong Yu |
| 2026 | ACL | Revisiting Audio-language Pretraining for Learning General-purpose Audio Representation. | Wei-Cheng Tseng, Xuanru Zhou, Mingyue Huo, Yiwen Shao, Hao Zhang, Dong Yu |
| 2026 | ACL | Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification. | Yuxuan Wan, Tianqing Fang, Zaitang LI, Yintong Huo, Wenxuan Wang, Haitao Mi, Dong Yu, Michael R. Lyu |
| 2026 | ACL | Measure Twice, Click Once: Co-evolving Proposer and Visual Critic via Reinforcement Learning for GUI Grounding. | Wenkai Wang, Xiyun Li, Hongcan Guo, Wenhao Yu, Tianqing Fang, Haitao Mi, Dong Yu, Shengyu Zhang |
| 2026 | ACL | WebAggregator: Enhancing Compositional Reasoning Capabilities of Deep Research Agent Foundation Models. | Rui Wang, Ce Zhang, Jun-Yu Ma, Jianshu Zhang, Hongru Wang, Yi Chen, Boyang Xue, Tianqing Fang, Zhisong Zhang, Hongming Zhang, Haitao Mi, Dong Yu, Kam-Fai Wong |
| 2026 | CHI | "I Want My Own Space, but I Want to Be Understood": The Adolescent Emotional Communication Dilemma in Hospitals. | Liuping Wang, Mingjing Wu, Shengmin Zhao, Wenhui Kang, Jin Huang, Chenglei Yang, Dong Yu, Pengyuan Liu |
| 2026 | EACL | WebRollback: Enhancing Web Agents with Explicit Rollback Mechanisms. | Zhisong Zhang, Tianqing Fang, Kaixin Ma, Wenhao Yu, Hongming Zhang, Haitao Mi, Dong Yu |
| 2025 | AAAI | LiteSearch: Efficient Tree Search with Dynamic Exploration Budget for Math Reasoning. | Ante Wang, Linfeng Song, Ye Tian, Baolin Peng, Dian Yu, Haitao Mi, Jinsong Su, Dong Yu |
| 2025 | ACL | A Silver Bullet or a Compromise for Full Attention? A Comprehensive Study of Gist Token-based Context Compression. | Chenlong Deng, Zhisong Zhang, Kelong Mao, Shuaiyi Li, Xinting Huang, Dong Yu, Zhicheng Dou |
| 2025 | ACL | OpenWebVoyager: Building Multimodal Web Agents via Iterative Real-World Exploration, Feedback and Optimization. | Hongliang He, Wenlin Yao, Kaixin Ma, Wenhao Yu, Hongming Zhang, Tianqing Fang, Zhenzhong Lan, Dong Yu |
| 2025 | ACL | DeFine: Decision-Making with Analogical Reasoning over Factor Profiles. | Yebowen Hu, Xiaoyang Wang, Wenlin Yao, Yiming Lu, Daoan Zhang, Hassan Foroosh, Dong Yu, Fei Liu |
| 2025 | ACL | Low-Bit Quantization Favors Undertrained LLMs. | Xu Ouyang, Tao Ge, Thomas Hartvigsen, Zhisong Zhang, Haitao Mi, Dong Yu |
| 2025 | ACL | Don't Get Lost in the Trees: Streamlining LLM Reasoning by Overcoming Tree Search Exploration Pitfalls. | Ante Wang, Linfeng Song, Ye Tian, Dian Yu, Haitao Mi, Xiangyu Duan, Zhaopeng Tu, Jinsong Su, Dong Yu |
| 2025 | ACL | LoGU: Long-form Generation with Uncertainty Expressions. | Ruihan Yang, Caiqi Zhang, Zhisong Zhang, Xinting Huang, Sen Yang, Nigel Collier, Dong Yu, Deqing Yang |
| 2025 | ACL | Attention Entropy is a Key Factor: An Analysis of Parallel Context Encoding with Full-attention-based Pre-trained Language Models. | Zhisong Zhang, Yan Wang, Xinting Huang, Tianqing Fang, Hongming Zhang, Chenlong Deng, Shuaiyi Li, Dong Yu |
| 2025 | ASRU | Efficient Scaling for LLM-based ASR. | Bingshen Mu, Yiwen Shao, Kun Wei, Dong Yu, Lei Xie |
| 2025 | ASRU | Continual Pre-training for Codec-Based Speech LLMs: Balancing Understanding and Generation. | Jiatong Shi, Chunlei Zhang, Jinchuan Tian, Junrui Ni, Hao Zhang, Shinji Watanabe, Dong Yu |
| 2025 | ASRU | Deep Audio Zooming: Creating a Sound Barrier With Microphone Array Processing. | Meng Yu, Dong Yu |
| 2025 | COLING | Entropy Guided Extrapolative Decoding to Improve Factuality in Large Language Models. | Souvik Das, Lifeng Jin, Linfeng Song, Haitao Mi, Baolin Peng, Dong Yu |
| 2025 | COLING | What's the most important value? INVP: INvestigating the Value Priorities of LLMs through Decision-making in Social Scenarios. | Xuelin Liu, Pengyuan Liu, Dong Yu |
| 2025 | EMNLP | Investigating Value-Reasoning Reliability in Small Large Language Models. | Xia Du, Shuhan Sun, Pengyuan Liu, Dong Yu |
| 2025 | EMNLP | WebEvolver: Enhancing Web Agent Self-Improvement with Co-evolving World Model. | Tianqing Fang, Hongming Zhang, Zhisong Zhang, Kaixin Ma, Wenhao Yu, Haitao Mi, Dong Yu |
| 2025 | EMNLP | Router-Tuning: A Simple and Effective Approach for Dynamic Depth. | Shwai He, Tao Ge, Guoheng Sun, Bowei Tian, Xiaoyang Wang, Dong Yu |
| 2025 | EMNLP | WebCoT: Enhancing Web Agent Reasoning by Reconstructing Chain-of-Thought in Reflection, Branching, and Rollback. | Minda Hu, Tianqing Fang, Jianshu Zhang, Jun-Yu Ma, Zhisong Zhang, Jingyan Zhou, Hongming Zhang, Haitao Mi, Dong Yu, Irwin King |
| 2025 | EMNLP | Recall with Reasoning: Chain-of-Thought Distillation for Mamba's Long-Context Memory and Extrapolation. | Jun-Yu Ma, Tianqing Fang, Zhisong Zhang, Hongming Zhang, Haitao Mi, Dong Yu |
| 2025 | EMNLP | DivScene: Towards Open-Vocabulary Object Navigation with Large Vision Language Models in Diverse Scenes. | Zhaowei Wang, Hongming Zhang, Tianqing Fang, Ye Tian, Yue Yang, Kaixin Ma, Xiaoman Pan, Yangqiu Song, Dong Yu |
| 2025 | EMNLP | Attribution and Application of Multiple Neurons in Multimodal Large Language Models. | Feiyu Wang, Ziran Zhao, Dong Yu, Pengyuan Liu |
| 2025 | EMNLP | Retrieval-augmented GUI Agents with Generative Guidelines. | Ran Xu, Kaixin Ma, Wenhao Yu, Hongming Zhang, Joyce C. Ho, Carl Yang, Dong Yu |
| 2025 | EMNLP | UNCLE: Benchmarking Uncertainty Expressions in Long-Form Generation. | Ruihan Yang, Caiqi Zhang, Zhisong Zhang, Xinting Huang, Dong Yu, Nigel Collier, Deqing Yang |
| 2025 | ICASSP | Neural Ambisonic Encoding For Multi-Speaker Scenarios Using A Circular Microphone Array. | Yue Qiao, Vinay Kothapally, Meng Yu, Dong Yu |
| 2025 | ICASSP | BANC: Towards Efficient Binaural Audio Neural Codec for Overlapping Speech. | Anton Ratnarajah, Shi-Xiong Zhang, Dong Yu |
| 2025 | ICASSP | STA-V2A: Video-to-Audio Generation with Semantic and Temporal Alignment. | Yong Ren, Chenxing Li, Manjie Xu, Wei Liang, Yu Gu, Rilin Chen, Dong Yu |
| 2025 | ICASSP | Preference Alignment Improves Language Model-Based TTS. | Jinchuan Tian, Chunlei Zhang, Jiatong Shi, Hao Zhang, Jianwei Yu, Shinji Watanabe, Dong Yu |
| 2025 | ICASSP | SSR-Speech: Towards Stable, Safe and Robust Zero-shot Text-based Speech Editing and Synthesis. | Helin Wang, Meng Yu, Jiarui Hai, Chen Chen, Yuchen Hu, Rilin Chen, Najim Dehak, Dong Yu |
| 2025 | ICLR | DSBench: How Far Are Data Science Agents from Becoming Data Science Experts? | Liqiang Jing, Zhehui Huang, Xiaoyang Wang, Wenlin Yao, Wenhao Yu, Kaixin Ma, Hongming Zhang, Xinya Du, Dong Yu |
| 2025 | ICLR | RepoGraph: Enhancing AI Software Engineering with Repository-level Code Graph. | Siru Ouyang, Wenhao Yu, Kaixin Ma, Zilin Xiao, Zhihan Zhang, Mengzhao Jia, Jiawei Han, Hongming Zhang, Dong Yu |
| 2025 | ICLR | LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory. | Di Wu, Hongwei Wang, Wenhao Yu, Yuwei Zhang, Kai-Wei Chang, Dong Yu |
| 2025 | ICLR | DOTS: Learning to Reason Dynamically in LLMs via Optimal Reasoning Trajectories Search. | Murong Yue, Wenlin Yao, Haitao Mi, Dian Yu, Ziyu Yao, Dong Yu |
| 2025 | ICLR | Iterative Nash Policy Optimization: Aligning LLMs with General Preferences via No-Regret Learning. | Yuheng Zhang, Dian Yu, Baolin Peng, Linfeng Song, Ye Tian, Mingyue Huo, Nan Jiang, Haitao Mi, Dong Yu |
| 2025 | ICML | Do NOT Think That Much for 2+3=? On the Overthinking of Long Reasoning Models. | Xingyu Chen, Jiahao Xu, Tian Liang, Zhiwei He, Jianhui Pang, Dian Yu, Linfeng Song, Qiuzhi Liu, Mengfei Zhou, Zhuosheng Zhang, Rui Wang, Zhaopeng Tu, Haitao Mi, Dong Yu |
| 2025 | IJCAI | BridgeVoC: Neural Vocoder with Schrdinger Bridge. | Tong Lei, Zhiyu Zhang, Rilin Chen, Meng Yu, Jing Lu, Chengshi Zheng, Dong Yu, Andong Li |
| 2025 | IJCNLP | Atomic Calibration of LLMs in Long-Form Generations. | Caiqi Zhang, Ruihan Yang, Zhisong Zhang, Xinting Huang, Sen Yang, Dong Yu, Nigel Collier |
| 2025 | Interspeech | EzAudio: Enhancing Text-to-Audio Generation with Efficient Diffusion Transformer. | Jiarui Hai, Yong Xu, Hao Zhang, Chenxing Li, Helin Wang, Mounya Elhilali, Dong Yu |
| 2025 | Interspeech | Video-to-Audio Generation with Fine-grained Temporal Semantics. | Yuchen Hu, Yu Gu, Chenxing Li, Rilin Chen, Dong Yu |
| 2024 | ACL | WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models. | Hongliang He, Wenlin Yao, Kaixin Ma, Wenhao Yu, Yong Dai, Hongming Zhang, Zhenzhong Lan, Dong Yu |
| 2024 | ACL | CLOMO: Counterfactual Logical Modification with Large Language Models. | Yinya Huang, Ruixin Hong, Hongming Zhang, Wei Shao, Zhicheng Yang, Dong Yu, Changshui Zhang, Xiaodan Liang, Linqi Song |
| 2024 | ACL | Make-A-Voice: Revisiting Voice Large Language Models as Scalable Multilingual and Multitask Learners. | Rongjie Huang, Chunlei Zhang, Yongqi Wang, Dongchao Yang, Jinchuan Tian, Zhenhui Ye, Luping Liu, Zehan Wang, Ziyue Jiang, Xuankai Chang, Jiatong Shi, Chao Weng, Zhou Zhao, Dong Yu |
| 2024 | ACL | SportsMetrics: Blending Text and Numerical Data to Understand Information Fusion in LLMs. | Yebowen Hu, Kaiqiang Song, Sangwoo Cho, Xiaoyang Wang, Hassan Foroosh, Dong Yu, Fei Liu |
| 2024 | ACL | InFoBench: Evaluating Instruction Following Ability in Large Language Models. | Yiwei Qin, Kaiqiang Song, Yebowen Hu, Wenlin Yao, Sangwoo Cho, Xiaoyang Wang, Xuansheng Wu, Fei Liu, Pengfei Liu, Dong Yu |
| 2024 | ACL | Improving LLM Generations via Fine-Grained Self-Endorsement. | Ante Wang, Linfeng Song, Baolin Peng, Lifeng Jin, Ye Tian, Haitao Mi, Jinsong Su, Dong Yu |
| 2024 | ACL | MatPlotAgent: Method and Evaluation for LLM-Based Agentic Scientific Data Visualization. | Zhiyu Yang, Zihan Zhou, Shuo Wang, Xin Cong, Xu Han, Yukun Yan, Zhenghao Liu, Zhixing Tan, Pengyuan Liu, Dong Yu, Zhiyuan Liu, Xiaodong Shi, Maosong Sun |
| 2024 | ACL | MM-LLMs: Recent Advances in MultiModal Large Language Models. | Duzhen Zhang, Yahan Yu, Jiahua Dong, Chenxing Li, Dan Su, Chenhui Chu, Dong Yu |
| 2024 | ACL | Fact-and-Reflection (FaR) Improves Confidence Calibration of Large Language Models. | Xinran Zhao, Hongming Zhang, Xiaoman Pan, Wenlin Yao, Dong Yu, Tongshuang Wu, Jianshu Chen |
| 2024 | ACL | Generative Pre-trained Speech Language Model with Efficient Hierarchical Transformer. | Yongxin Zhu, Dan Su, Liqiang He, Linli Xu, Dong Yu |
| 2024 | COLING | MinT: Boosting Generalization in Mathematical Reasoning via Multi-view Fine-tuning. | Zhenwen Liang, Dian Yu, Xiaoman Pan, Wenlin Yao, Qingkai Zeng, Xiangliang Zhang, Dong Yu |
| 2024 | COLING | A Knowledge Plug-and-Play Test Bed for Open-domain Dialogue Generation. | Xiangci Li, Linfeng Song, Lifeng Jin, Haitao Mi, Jessica Ouyang, Dong Yu |
| 2024 | EACL | Event Semantic Classification in Context. | Haoyu Wang, Hongming Zhang, Kaiqiang Song, Dong Yu, Dan Roth |
| 2024 | EACL | Inconsistent dialogue responses and how to recover from them. | Mian Zhang, Lifeng Jin, Linfeng Song, Haitao Mi, Dong Yu |
| 2024 | EMNLP | Chain-of-Note: Enhancing Robustness in Retrieval-Augmented Language Models. | Wenhao Yu, Hongming Zhang, Xiaoman Pan, Peixin Cao, Kaixin Ma, Jian Li, Hongwei Wang, Dong Yu |
| 2024 | EMNLP | Dense X Retrieval: What Retrieval Granularity Should We Use? | Tong Chen, Hongwei Wang, Sihao Chen, Wenhao Yu, Kaixin Ma, Xinran Zhao, Hongming Zhang, Dong Yu |
| 2024 | EMNLP | Skills-in-Context: Unlocking Compositionality in Large Language Models. | Jiaao Chen, Xiaoman Pan, Dian Yu, Kaiqiang Song, Xiaoyang Wang, Dong Yu, Jianshu Chen |
| 2024 | EMNLP | Abstraction-of-Thought Makes Language Models Better Reasoners. | Ruixin Hong, Hongming Zhang, Xiaoman Pan, Dong Yu, Changshui Zhang |
| 2024 | EMNLP | When Reasoning Meets Information Aggregation: A Case Study with Sports Narratives. | Yebowen Hu, Kaiqiang Song, Sangwoo Cho, Xiaoyang Wang, Wenlin Yao, Hassan Foroosh, Dong Yu, Fei Liu |
| 2024 | EMNLP | Evaluating Moral Beliefs across LLMs through a Pluralistic Framework. | Xuelin Liu, Yanfei Zhu, Shucheng Zhu, Pengyuan Liu, Ying Liu, Dong Yu |
| 2024 | EMNLP | Self-Consistency Boosts Calibration for Math Reasoning. | Ante Wang, Linfeng Song, Ye Tian, Baolin Peng, Lifeng Jin, Haitao Mi, Jinsong Su, Dong Yu |
| 2024 | EMNLP | Learn Beyond The Answer: Training Language Models with Reflection for Mathematical Reasoning. | Zhihan Zhang, Tao Ge, Zhenwen Liang, Wenhao Yu, Dian Yu, Mengzhao Jia, Dong Yu, Meng Jiang |
| 2024 | ICASSP | UniX-Encoder: A Universal X-Channel Speech Encoder for AD-HOC Microphone Array Speech Processing. | Zili Huang, Yiwen Shao, Shi-Xiong Zhang, Dong Yu |
| 2024 | ICASSP | SPATIALCODEC: Neural Spatial Speech Coding. | Zhongweiyang Xu, Yong Xu, Vinay Kothapally, Heming Wang, Muqiao Yang, Dong Yu |
| 2024 | ICASSP | uSee: Unified Speech Enhancement And Editing with Conditional Diffusion Models. | Muqiao Yang, Chunlei Zhang, Yong Xu, Zhongweiyang Xu, Heming Wang, Bhiksha Raj, Dong Yu |
| 2024 | ICASSP | Advancing Acoustic Howling Suppression Through Recursive Training of Neural Networks. | Hao Zhang, Yixuan Zhang, Meng Yu, Dong Yu |
| 2024 | ICLR | The Trickle-down Impact of Reward Inconsistency on RLHF. | Lingfeng Shen, Sihao Chen, Linfeng Song, Lifeng Jin, Baolin Peng, Haitao Mi, Daniel Khashabi, Dong Yu |
| 2024 | ICML | Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment. | Rui Yang, Xiaoman Pan, Feng Luo, Shuang Qiu, Han Zhong, Dong Yu, Jianshu Chen |
| 2024 | ICML | Prompt-guided Precise Audio Editing with Diffusion Models. | Manjie Xu, Chenxing Li, Duzhen Zhang, Dan Su, Wei Liang, Dong Yu |
| 2024 | IJCNN | Document-level Overlapping Event Extraction via ChatGPT Leading Decision and Cross-Sentence Entity Representation Enhancements. | Dong Yu, Jiawen Cao |
| 2023 | ACL | Generating User-Engaging News Headlines. | Pengshan Cai, Kaiqiang Song, Sangwoo Cho, Hongwei Wang, Xiaoyang Wang, Hong Yu, Fei Liu, Dong Yu |
| 2023 | ACL | Faithful Question Answering with Monte-Carlo Planning. | Ruixin Hong, Hongming Zhang, Hong Zhao, Dong Yu, Changshui Zhang |
| 2023 | ACL | Prosody-TTS: Improving Prosody with Masked Autoencoder and Conditional Diffusion Model For Expressive Text-to-Speech. | Rongjie Huang, Chunlei Zhang, Yi Ren, Zhou Zhao, Dong Yu |
| 2023 | ACL | Bi-level Finetuning with Task-dependent Similarity Structure for Low-resource Training. | Sai Ashish Somayajula, Lifeng Jin, Linfeng Song, Haitao Mi, Dong Yu |
| 2023 | ACL | Going Beyond Sentence Embeddings: A Token-Level Matching Algorithm for Calculating Semantic Textual Similarity. | Hongwei Wang, Dong Yu |
| 2023 | ACL | Zemi: Learning Zero-Shot Semi-Parametric Language Models from Multiple Tasks. | Zhenhailong Wang, Xiaoman Pan, Dian Yu, Dong Yu, Jianshu Chen, Heng Ji |
| 2023 | ACL | OASum: Large-Scale Open Domain Aspect-based Summarization. | Xianjun Yang, Kaiqiang Song, Sangwoo Cho, Xiaoyang Wang, Xiaoman Pan, Linda R. Petzold, Dong Yu |
| 2023 | ACL | SafeConv: Explaining and Correcting Conversational Unsafe Behavior. | Mian Zhang, Lifeng Jin, Linfeng Song, Haitao Mi, Wenliang Chen, Dong Yu |
| 2023 | ASRU | Neuralecho: Hybrid of Full-Band and Sub-Band Recurrent Neural Network For Acoustic Echo Cancellation and Speech Enhancement. | Meng Yu, Yong Xu, Chunlei Zhang, Shi-Xiong Zhang, Dong Yu |
| 2023 | ASRU | Deep Learning for Joint Acoustic Echo and Acoustic Howling Suppression in Hybrid Meetings. | Hao Zhang, Meng Yu, Dong Yu |
| 2023 | ASRU | Neuralkalman: A Learnable Kalman Filter for Acoustic Echo Cancellation. | Yixuan Zhang, Meng Yu, Hao Zhang, Dong Yu, DeLiang Wang |
| 2023 | EACL | How do Words Contribute to Sentence Semantics? Revisiting Sentence Embeddings with a Perturbation Method. | Wenlin Yao, Lifeng Jin, Hongming Zhang, Xiaoman Pan, Kaiqiang Song, Dian Yu, Dong Yu, Jianshu Chen |
| 2023 | EACL | Friend-training: Learning from Models of Different but Related Tasks. | Mian Zhang, Lifeng Jin, Linfeng Song, Haitao Mi, Xiabing Zhou, Dong Yu |
| 2023 | EMNLP | Bridging the Gap between Synthetic and Authentic Images for Multimodal Machine Translation. | Wenyu Guo, Qingkai Fang, Dong Yu, Yang Feng |
| 2023 | EMNLP | Bridging Continuous and Discrete Spaces: Interpretable Sentence Representation Learning via Compositional Operations. | James Y. Huang, Wenlin Yao, Kaiqiang Song, Hongming Zhang, Muhao Chen, Dong Yu |
| 2023 | EMNLP | PIVOINE: Instruction Tuning for Open-world Entity Profiling. | Keming Lu, Xiaoman Pan, Kaiqiang Song, Hongming Zhang, Dong Yu, Jianshu Chen |
| 2023 | EMNLP | On the Dimensionality of Sentence Embeddings. | Hongwei Wang, Hongming Zhang, Dong Yu |
| 2023 | EMNLP | More Than Spoken Words: Nonverbal Message Extraction and Generation. | Dian Yu, Xiaoyang Wang, Wanshun Chen, Nan Du, Longyue Wang, Haitao Mi, Dong Yu |
| 2023 | ICASSP | Trinet: Stabilizing Self-Supervised Learning From Complete or Slow Collapse. | Lixin Cao, Jun Wang, Ben Yang, Dan Su, Dong Yu |
| 2023 | ICASSP | Deep Neural Mel-Subband Beamformer for in-Car Speech Separation. | Vinay Kothapally, Yong Xu, Meng Yu, Shi-Xiong Zhang, Dong Yu |
| 2023 | ICASSP | Deep AHS: A Deep Learning Approach to Acoustic Howling Suppression. | Hao Zhang, Meng Yu, Dong Yu |
| 2023 | ICLR | Knowledge-in-Context: Towards Knowledgeable Semi-Parametric Language Models. | Xiaoman Pan, Wenlin Yao, Hongming Zhang, Dian Yu, Dong Yu, Jianshu Chen |
| 2023 | ICLR | Bayes Risk CTC: Controllable CTC Alignment in Sequence-to-Sequence Tasks. | Jinchuan Tian, Brian Yan, Jianwei Yu, Chao Weng, Dong Yu, Shinji Watanabe |
| 2023 | IJCNLP | Unsupervised Multi-document Summarization with Holistic Inference. | Haopeng Zhang, Sangwoo Cho, Kaiqiang Song, Xiaoyang Wang, Hongwei Wang, Jiawei Zhang, Dong Yu |
| 2023 | Interspeech | Zoneformer: On-device Neural Beamformer For In-car Multi-zone Speech Separation, Enhancement and Echo Cancellation. | Yong Xu, Vinay Kothapally, Meng Yu, Shixiong Zhang, Dong Yu |
| 2022 | AAAI | Hierarchical Context Tagging for Utterance Rewriting. | Lisa Jin, Linfeng Song, Lifeng Jin, Dong Yu, Daniel Gildea |
| 2022 | ACL | Improving Machine Reading Comprehension with Contextualized Commonsense Knowledge. | Kai Sun, Dian Yu, Jianshu Chen, Dong Yu, Claire Cardie |
| 2022 | ACL | Variational Graph Autoencoding as Cheap Supervision for AMR Coreference Resolution. | Irene Li, Linfeng Song, Kun Xu, Dong Yu |
| 2022 | ACL | Towards Abstractive Grounded Summarization of Podcast Transcripts. | Kaiqiang Song, Chen Li, Xiaoyang Wang, Dong Yu, Fei Liu |
| 2022 | ACL | C-MORE: Pretraining to Answer Open-Domain Questions by Consulting Millions of References. | Xiang Yue, Xiaoman Pan, Wenlin Yao, Dian Yu, Dong Yu, Jianshu Chen |
| 2022 | ACL | Learning-by-Narrating: Narrative Pre-Training for Zero-Shot Dialogue Comprehension. | Chao Zhao, Wenlin Yao, Dian Yu, Kaiqiang Song, Dong Yu, Jianshu Chen |
| 2022 | COLING | From Polarity to Intensity: Mining Morality from Semantic Space. | Chunxu Zhao, Pengyuan Liu, Dong Yu |
| 2022 | EMNLP | Cross-lingual Text-to-SQL Semantic Parsing with Representation Mixup. | Peng Shi, Linfeng Song, Lifeng Jin, Haitao Mi, He Bai, Jimmy Lin, Dong Yu |
| 2022 | EMNLP | Toward Unifying Text Segmentation and Long Document Summarization. | Sangwoo Cho, Kaiqiang Song, Xiaoyang Wang, Fei Liu, Dong Yu |
| 2022 | EMNLP | MetaLogic: Logical Reasoning Explanations with Fine-Grained Structure. | Yinya Huang, Hongming Zhang, Ruixin Hong, Xiaodan Liang, Changshui Zhang, Dong Yu |
| 2022 | EMNLP | Salience Allocation as Guidance for Abstractive Summarization. | Fei Wang, Kaiqiang Song, Hongming Zhang, Lifeng Jin, Sangwoo Cho, Wenlin Yao, Xiaoyang Wang, Muhao Chen, Dong Yu |
| 2022 | EMNLP | Z-LaVI: Zero-Shot Language Solver Fueled by Visual Imagination. | Yue Yang, Wenlin Yao, Hongming Zhang, Xiaoyang Wang, Dong Yu, Jianshu Chen |
| 2022 | EMNLP | Learning a Grammar Inducer from Massive Uncurated Instructional Videos. | Songyang Zhang, Linfeng Song, Lifeng Jin, Haitao Mi, Kun Xu, Dong Yu, Jiebo Luo |
| 2022 | EMNLP | Efficient Zero-shot Event Extraction with Context-Definition Alignment. | Hongming Zhang, Wenlin Yao, Dong Yu |
| 2022 | EMNLP | FlowEval: A Consensus-Based Dialogue Evaluation Framework Using Segment Act Flows. | Jianqiao Zhao, Yanyang Li, Wanyu Du, Yangfeng Ji, Dong Yu, Michael R. Lyu, Liwei Wang |
| 2022 | ICASSP | Robust Disentangled Variational Speech Representation Learning for Zero-Shot Voice Conversion. | Jiachen Lian, Chunlei Zhang, Dong Yu |
| 2022 | ICASSP | Referee: Towards Reference-Free Cross-Speaker Style Transfer with Low-Quality Data for Expressive Speech Synthesis. | Songxiang Liu, Shan Yang, Dan Su, Dong Yu |
| 2022 | ICASSP | DP-DWA: Dual-Path Dynamic Weight Attention Network With Streaming Dfsmn-San For Automatic Speech Recognition. | Dongpeng Ma, Yiwen Wang, Liqiang He, Mingjie Jin, Dan Su, Dong Yu |
| 2022 | ICASSP | Fast-Rir: Fast Neural Diffuse Room Impulse Response Generator. | Anton Ratnarajah, Shi-Xiong Zhang, Meng Yu, Zhenyu Tang, Dinesh Manocha, Dong Yu |
| 2022 | ICASSP | Multi-Channel Multi-Speaker ASR Using 3D Spatial Feature. | Yiwen Shao, Shi-Xiong Zhang, Dong Yu |
| 2022 | ICASSP | Consistent Training and Decoding for End-to-End Speech Recognition Using Lattice-Free MMI. | Jinchuan Tian, Jianwei Yu, Chao Weng, Shi-Xiong Zhang, Dan Su, Dong Yu, Yuexian Zou |
| 2022 | ICASSP | VCVTS: Multi-Speaker Video-to-Speech Synthesis Via Cross-Modal Knowledge Transfer from Voice Conversion. | Disong Wang, Shan Yang, Dan Su, Xunying Liu, Dong Yu, Helen Meng |
| 2022 | ICASSP | Joint Modeling of Code-Switched and Monolingual ASR via Conditional Factorization. | Brian Yan, Chunlei Zhang, Meng Yu, Shi-Xiong Zhang, Siddharth Dalmia, Dan Berrebbi, Chao Weng, Shinji Watanabe, Dong Yu |
| 2022 | ICASSP | Speechmoe2: Mixture-of-Experts Model with Improved Routing. | Zhao You, Shulin Feng, Dan Su, Dong Yu |
| 2022 | ICASSP | Towards end-to-end Speaker Diarization with Generalized Neural Speaker Clustering. | Chunlei Zhang, Jiatong Shi, Chao Weng, Meng Yu, Dong Yu |
| 2022 | ICDM | ZeroKBC: A Comprehensive Benchmark for Zero-Shot Knowledge Base Completion. | Pei Chen, Wenlin Yao, Hongming Zhang, Xiaoman Pan, Dian Yu, Dong Yu, Jianshu Chen |
| 2022 | ICLR | BDDM: Bilateral Denoising Diffusion Models for Fast and High-Quality Speech Synthesis. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2022 | IJCAI | FastDiff: A Fast Conditional Diffusion Model for High-Quality Speech Synthesis. | Rongjie Huang, Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu, Yi Ren, Zhou Zhao |
| 2022 | IJCNN | Perception and Cognition Matters: A new light on sentiment analysis task. | Shiya Peng, Ying Wang, Dong Yu, Pengyuan Liu |
| 2022 | IJCNN | Contrastive Learning Based Visual Representation Enhancement for Multimodal Machine Translation. | Shike Wang, Wen Zhang, Wenyu Guo, Dong Yu, Pengyuan Liu |
| 2022 | Interspeech | Automatic Prosody Annotation with Pre-Trained Text-Speech Model. | Ziqian Dai, Jianwei Yu, Yan Wang, Nuo Chen, Yanyao Bian, Guangzhi Li, Deng Cai, Dong Yu |
| 2022 | Interspeech | Joint Neural AEC and Beamforming with Double-Talk Detection. | Vinay Kothapally, Yong Xu, Meng Yu, Shi-Xiong Zhang, Dong Yu |
| 2022 | Interspeech | Towards Improved Zero-shot Voice Conversion with Conditional DSVAE. | Jiachen Lian, Chunlei Zhang, Gopala Krishna Anumanchipalli, Dong Yu |
| 2021 | AAAI | Tune-In: Training Under Negative Environments with Interference for Attention Networks Simulating Cocktail Party Effect. | Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu |
| 2021 | AAAI | NaturalConv: A Chinese Dialogue Dataset Towards Multi-turn Topic-driven Conversation. | Xiaoyang Wang, Chen Li, Jianqiao Zhao, Dong Yu |
| 2021 | ACL | TexSmart: A System for Enhanced Natural Language Understanding. | Lemao Liu, Haisong Zhang, Haiyun Jiang, Yangming Li, Enbo Zhao, Kun Xu, Linfeng Song, Suncong Zheng, Botong Zhou, Dick Zhu, Xiao Feng, Tao Chen, Tao Yang, Dong Yu, Feng Zhang, Zhanhui Kang, Shuming Shi |
| 2021 | ACL | Importance-based Neuron Allocation for Multilingual Neural Machine Translation. | Wanying Xie, Yang Feng, Shuhao Gu, Dong Yu |
| 2021 | ASRU | 3D Spatial Features for Multi-Channel Target Speech Separation. | Rongzhi Gu, Shi-Xiong Zhang, Meng Yu, Dong Yu |
| 2021 | ASRU | Latency-Controlled Neural Architecture Search for Streaming Speech Recognition. | Liqiang He, Shulin Feng, Dan Su, Dong Yu |
| 2021 | CVPR | Improving Weakly Supervised Visual Grounding by Contrastive Knowledge Distillation. | Liwei Wang, Jing Huang, Yin Li, Kun Xu, Zhengyuan Yang, Dong Yu |
| 2021 | EMNLP | RAST: Domain-Robust Dialogue Rewriting as Sequence Tagging. | Jie Hao, Linfeng Song, Liwei Wang, Kun Xu, Zhaopeng Tu, Dong Yu |
| 2021 | EMNLP | Instance-adaptive training with noise-robust losses against noisy labels. | Lifeng Jin, Linfeng Song, Kun Xu, Dong Yu |
| 2021 | EMNLP | Connect-the-Dots: Bridging Semantics between Words and Definitions via Aligning Word Sense Inventories. | Wenlin Yao, Xiaoman Pan, Lifeng Jin, Jianshu Chen, Dian Yu, Dong Yu |
| 2021 | EMNLP | Self-Teaching Machines to Read and Comprehend with Large-Scale Multi-Subject Question-Answering Data. | Dian Yu, Kai Sun, Dong Yu, Claire Cardie |
| 2021 | EMNLP | Exophoric Pronoun Resolution in Dialogues with Topic Regularization. | Xintong Yu, Hongming Zhang, Yangqiu Song, Changshui Zhang, Kun Xu, Dong Yu |
| 2021 | ICASSP | Learned Transferable Architectures Can Surpass Hand-Designed Architectures for Large Scale Speech Recognition. | Liqiang He, Dan Su, Dong Yu |
| 2021 | ICASSP | Sandglasset: A Light Multi-Granularity Self-Attentive Network for Time-Domain Speech Separation. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2021 | ICASSP | Replay and Synthetic Speech Detection with Res2Net Architecture. | Xu Li, Na Li, Chao Weng, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2021 | ICASSP | Improving RNN Transducer with Target Speaker Extraction and Neural Uncertainty Estimation. | Jiatong Shi, Chunlei Zhang, Chao Weng, Shinji Watanabe, Meng Yu, Dong Yu |
| 2021 | ICASSP | Directional ASR: A New Paradigm for E2E Multi-Speaker Speech Recognition with Source Localization. | Aswin Shanmugam Subramanian, Chao Weng, Shinji Watanabe, Meng Yu, Yong Xu, Shi-Xiong Zhang, Dong Yu |
| 2021 | ICASSP | Contrastive Separative Coding for Self-Supervised Representation Learning. | Jun Wang, Max W. Y. Lam, Dan Su, Dong Yu |
| 2021 | ICASSP | Self-Supervised Text-Independent Speaker Verification Using Prototypical Momentum Contrastive Learning. | Wei Xia, Chunlei Zhang, Chao Weng, Meng Yu, Dong Yu |
| 2021 | ICASSP | ADL-MVDR: All Deep Learning MVDR Beamformer for Target Speech Separation. | Zhuohuang Zhang, Yong Xu, Meng Yu, Shi-Xiong Zhang, Lianwu Chen, Dong Yu |
| 2021 | ICASSP | Towards Robust Speaker Verification with Target Speaker Enhancement. | Chunlei Zhang, Meng Yu, Chao Weng, Dong Yu |
| 2021 | Interspeech | Multi-Channel Speaker Verification for Single and Multi-Talker Speech. | Saurabh Kataria, Shi-Xiong Zhang, Dong Yu |
| 2021 | Interspeech | Raw Waveform Encoder with Multi-Scale Globally Attentive Locally Recurrent Networks for End-to-End Speech Recognition. | Max W. Y. Lam, Jun Wang, Chao Weng, Dan Su, Dong Yu |
| 2020 | AAAI | Modeling Fluency and Faithfulness for Diverse Neural Machine Translation. | Yang Feng, Wanying Xie, Shuhao Gu, Chenze Shao, Wen Zhang, Zhengxin Yang, Dong Yu |
| 2020 | AAAI | Relation Extraction Exploiting Full Dependency Forests. | Lifeng Jin, Linfeng Song, Yue Zhang, Kun Xu, Wei-Yun Ma, Dong Yu |
| 2020 | AAAI | Joint Parsing and Generation for Abstractive Summarization. | Kaiqiang Song, Logan Lebanoff, Qipeng Guo, Xipeng Qiu, Xiangyang Xue, Chen Li, Dong Yu, Fei Liu |
| 2020 | AAAI | Coordinated Reasoning for Cross-Lingual Knowledge Graph Alignment. | Kun Xu, Linfeng Song, Yansong Feng, Yan Song, Dong Yu |
| 2020 | ACL | Recurrent Chunking Mechanisms for Long-Text Machine Reading Comprehension. | Hongyu Gong, Yelong Shen, Dian Yu, Jianshu Chen, Dong Yu |
| 2020 | ACL | MART: Memory-Augmented Recurrent Transformer for Coherent Video Paragraph Captioning. | Jie Lei, Liwei Wang, Yelong Shen, Dong Yu, Tamara L. Berg, Mohit Bansal |
| 2020 | ACL | Structural Information Preserving for Graph-to-Text Generation. | Linfeng Song, Ante Wang, Jinsong Su, Yue Zhang, Kun Xu, Yubin Ge, Dong Yu |
| 2020 | ACL | ZPR2: Joint Zero Pronoun Recovery and Resolution using Multi-Task Learning and BERT. | Linfeng Song, Kun Xu, Yue Zhang, Jianshu Chen, Dong Yu |
| 2020 | ACL | Towards Faithful Neural Table-to-Text Generation with Content-Matching Constraints. | Zhenyi Wang, Xiaoyang Wang, Bang An, Dong Yu, Changyou Chen |
| 2020 | ACL | Dialogue-Based Relation Extraction. | Dian Yu, Kai Sun, Claire Cardie, Dong Yu |
| 2020 | ECCV | Comprehensive Image Captioning via Scene Graph Decomposition. | Yiwu Zhong, Liwei Wang, Jianshu Chen, Dong Yu, Yin Li |
| 2020 | EMNLP | Better Highlighting: Creating Sub-Sentence Summary Highlights. | Sangwoo Cho, Kaiqiang Song, Chen Li, Dong Yu, Hassan Foroosh, Fei Liu |
| 2020 | EMNLP | Token-level Adaptive Training for Neural Machine Translation. | Shuhao Gu, Jinchao Zhang, Fandong Meng, Yang Feng, Wanying Xie, Jie Zhou, Dong Yu |
| 2020 | EMNLP | Semantic Role Labeling Guided Multi-turn Dialogue ReWriter. | Kun Xu, Haochen Tan, Linfeng Song, Han Wu, Haisong Zhang, Linqi Song, Dong Yu |
| 2020 | ICASSP | Code-Switched Speech Synthesis Using Bilingual Phonetic Posteriorgram with Only Monolingual Corpora. | Yuewen Cao, Songxiang Liu, Xixin Wu, Shiyin Kang, Peng Liu, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Pitchnet: Unsupervised Singing Voice Conversion with Pitch Adversarial Network. | Chengqi Deng, Chengzhu Yu, Heng Lu, Chao Weng, Dong Yu |
| 2020 | ICASSP | Enhancing End-to-End Multi-Channel Speech Separation Via Spatial Feature Learning. | Rongzhi Gu, Shi-Xiong Zhang, Lianwu Chen, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2020 | ICASSP | A Random Gossip BMUF Process for Neural Language Modeling. | Yiheng Huang, Jinchuan Tian, Lei Han, Guangsen Wang, Xingcheng Song, Dan Su, Dong Yu |
| 2020 | ICASSP | Integration of Multi-Look Beamformers for Multi-Channel Keyword Spotting. | Xuan Ji, Meng Yu, Jie Chen, Jimeng Zheng, Dan Su, Dong Yu |
| 2020 | ICASSP | Speaker-Aware Target Speaker Enhancement by Jointly Learning with Speaker Embedding Extraction. | Xuan Ji, Meng Yu, Chunlei Zhang, Dan Su, Tao Yu, Xiaoyu Liu, Dong Yu |
| 2020 | ICASSP | Mixup-breakdown: A Consistency Training Method for Improving Generalization of Speech Separation Models. | Max W. Y. Lam, Jun Wang, Dan Su, Dong Yu |
| 2020 | ICASSP | Multi-Level Deep Neural Network Adaptation for Speaker Verification Using MMD and Consistency Regularization. | Weiwei Lin, Man-Wai Mak, Na Li, Dan Su, Dong Yu |
| 2020 | ICASSP | End-To-End Accent Conversion Without Using Native Utterances. | Songxiang Liu, Disong Wang, Yuewen Cao, Lifa Sun, Xixin Wu, Shiyin Kang, Zhiyong Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2020 | ICASSP | Far-Field Location Guided Target Speech Extraction Using End-to-End Speech Recognition Objectives. | Aswin Shanmugam Subramanian, Chao Weng, Meng Yu, Shi-Xiong Zhang, Yong Xu, Shinji Watanabe, Dong Yu |
| 2020 | ICASSP | Improving Reverberant Speech Training Using Diffuse Acoustic Simulation. | Zhenyu Tang, Lianwu Chen, Bo Wu, Dong Yu, Dinesh Manocha |
| 2020 | ICASSP | Dfsmn-San with Persistent Memory Model for Automatic Speech Recognition. | Zhao You, Dan Su, Jie Chen, Chao Weng, Dong Yu |
| 2020 | ICASSP | Audio-Visual Recognition of Overlapped Speech for the LRS2 Dataset. | Jianwei Yu, Shi-Xiong Zhang, Jian Wu, Shahram Ghorbani, Bo Wu, Shiyin Kang, Shansong Liu, Xunying Liu, Helen Meng, Dong Yu |
| 2020 | Interspeech | End-to-End Multi-Look Keyword Spotting. | Meng Yu, Xuan Ji, Bo Wu, Dan Su, Dong Yu |
| 2020 | Interspeech | Investigating Robustness of Adversarial Samples Detection for Automatic Speaker Verification. | Xu Li, Na Li, Jinghua Zhong, Xixin Wu, Xunying Liu, Dan Su, Dong Yu, Helen Meng |
| 2019 | ACL | Reliability-aware Dynamic Feature Composition for Name Tagging. | Ying Lin, Liyuan Liu, Heng Ji, Dong Yu, Jiawei Han |
| 2019 | ACL | Cross-lingual Knowledge Graph Alignment via Graph Matching Neural Network. | Kun Xu, Liwei Wang, Mo Yu, Yansong Feng, Yan Song, Zhiguo Wang, Dong Yu |
| 2019 | ACL | Knowledge-aware Pronoun Coreference Resolution. | Hongming Zhang, Yan Song, Yangqiu Song, Dong Yu |
| 2019 | ASRU | Syllable-Dependent Discriminative Learning for Small Footprint Text-Dependent Speaker Verification. | Junyi Peng, Yuexian Zou, Na Li, Deyi Tuo, Dan Su, Meng Yu, Chunlei Zhang, Dong Yu |
| 2019 | ASRU | Time Domain Audio Visual Speech Separation. | Jian Wu, Yong Xu, Shi-Xiong Zhang, Lianwu Chen, Meng Yu, Lei Xie, Dong Yu |
| 2019 | ASRU | Improving Speech Enhancement with Phonetic Embedding Features. | Bo Wu, Meng Yu, Lianwu Chen, Mingjie Jin, Dan Su, Dong Yu |
| 2019 | CoNLL | Improving Pre-Trained Multilingual Model with Vocabulary Expansion. | Hai Wang, Dian Yu, Kai Sun, Jianshu Chen, Dong Yu |
| 2019 | CoNLL | Evidence Sentence Extraction for Machine Reading Comprehension. | Hai Wang, Dian Yu, Kai Sun, Jianshu Chen, Dong Yu, David A. McAllester, Dan Roth |
| 2019 | EMNLP | Generating Diverse Story Continuations with Controllable Semantics. | Lifu Tu, Xiaoan Ding, Dong Yu, Kevin Gimpel |
| 2019 | EMNLP | Multiplex Word Embeddings for Selectional Preference Acquisition. | Hongming Zhang, Jiaxin Bai, Yan Song, Kun Xu, Changlong Yu, Yangqiu Song, Wilfred Ng, Dong Yu |
| 2019 | ICASSP | Multi-band PIT and Model Integration for Improved Multi-channel Speech Separation. | Lianwu Chen, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Boundary Discriminative Large Margin Cosine Loss for Text-independent Speaker Verification. | Rongjin Li, Na Li, Deyi Tuo, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Component Fusion: Learning Replaceable Language Model Component for End-to-end Speech Recognition System. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Investigating End-to-end Speech Recognition for Mandarin-english Code-switching. | Changhao Shan, Chao Weng, Guangsen Wang, Dan Su, Min Luo, Dong Yu, Lei Xie |
| 2019 | ICASSP | Token-wise Training for Attention Based End-to-end Speech Recognition. | Peidong Wang, Jia Cui, Chao Weng, Dong Yu |
| 2019 | ICASSP | Learning Discriminative Features in Sequence Training without Requiring Framewise Labelled Data. | Jun Wang, Dan Su, Jie Chen, Shulin Feng, Dongpeng Ma, Na Li, Dong Yu |
| 2019 | ICASSP | Quasi-fully Convolutional Neural Network with Variational Inference for Speech Synthesis. | Mu Wang, Xixin Wu, Zhiyong Wu, Shiyin Kang, Deyi Tuo, Guangzhi Li, Dan Su, Dong Yu, Helen Meng |
| 2019 | ICASSP | A Comparison of Lattice-free Discriminative Training Criteria for Purely Sequence-trained Neural Network Acoustic Models. | Chao Weng, Dong Yu |
| 2019 | ICASSP | Joint Training of Complex Ratio Mask Based Beamformer and Acoustic Model for Noise Robust Asr. | Yong Xu, Chao Weng, Like Hui, Jianming Liu, Meng Yu, Dan Su, Dong Yu |
| 2019 | ICASSP | Enhancing Hybrid Self-attention Structure with Relative-position-aware Bias for Speech Synthesis. | Shan Yang, Heng Lu, Shiying Kang, Lei Xie, Dong Yu |
| 2019 | ICASSP | Teach an All-rounder with Experts in Different Domains. | Zhao You, Dan Su, Dong Yu |
| 2019 | ICASSP | Encrypted Speech Recognition Using Deep Polynomial Networks. | Shi-Xiong Zhang, Yifan Gong, Dong Yu |
| 2019 | ICASSP | Seq2Seq Attentional Siamese Neural Networks for Text-dependent Speaker Verification. | Yichi Zhang, Meng Yu, Na Li, Chengzhu Yu, Jia Cui, Dong Yu |
| 2019 | ICCV | A Fast and Accurate One-Stage Approach to Visual Grounding. | Zhengyuan Yang, Boqing Gong, Liwei Wang, Wenbing Huang, Dong Yu, Jiebo Luo |
| 2019 | ICLR | Unsupervised Speech Recognition via Segmental Empirical Output Distribution Matching. | Chih-Kuan Yeh, Jianshu Chen, Chengzhu Yu, Dong Yu |
| 2019 | IJCAI | Unsupervised Neural Aspect Extraction with Sememes. | Ling Luo, Xiang Ao, Yan Song, Jinyao Li, Xiaopeng Yang, Qing He, Dong Yu |
| 2019 | Interspeech | A Comprehensive Study of Speech Separation: Spectrogram vs Waveform Separation. | Fahimeh Bahmaninezhad, Jian Wu, Rongzhi Gu, Shi-Xiong Zhang, Yong Xu, Meng Yu, Dong Yu |
| 2019 | Interspeech | Disambiguation of Chinese Polyphones in an End-to-End Framework with Semantic Features Extracted by Pre-Trained BERT. | Dongyang Dai, Zhiyong Wu, Shiyin Kang, Xixin Wu, Jia Jia, Dan Su, Dong Yu, Helen Meng |
| 2019 | Interspeech | Neural Spatial Filter: Target Speaker Speech Separation Assisted with Directional Information. | Rongzhi Gu, Lianwu Chen, Shi-Xiong Zhang, Jimeng Zheng, Yong Xu, Meng Yu, Dan Su, Yuexian Zou, Dong Yu |
| 2019 | Interspeech | Extract, Adapt and Recognize: An End-to-End Neural Network for Corrupted Monaural Speech Recognition. | Max W. Y. Lam, Jun Wang, Xunying Liu, Helen Meng, Dan Su, Dong Yu |
| 2018 | EMNLP | XL-NBT: A Cross-lingual Neural Belief Tracking Framework. | Wenhu Chen, Jianshu Chen, Yu Su, Xin Wang, Dong Yu, Xifeng Yan, William Yang Wang |
| 2018 | ICASSP | Knowledge Transfer in Permutation Invariant Training for Single-Channel Multi-Talker Speech Recognition. | Tian Tan, Yanmin Qian, Dong Yu |
| 2018 | ICASSP | Adaptive Permutation Invariant Training with Auxiliary Information for Monaural Multi-Talker Speech Recognition. | Xuankai Chang, Yanmin Qian, Dong Yu |
| 2018 | Interspeech | Monaural Multi-Talker Speech Recognition with Attention Mechanism and Gated Convolutional Networks. | Xuankai Chang, Yanmin Qian, Dong Yu |
| 2018 | Interspeech | Permutation Invariant Training of Generative Adversarial Network for Monaural Speech Separation. | Lianwu Chen, Meng Yu, Yanmin Qian, Dan Su, Dong Yu |
| 2017 | HealthCom | Analyzing chronological order reconstruction problem in cyber-physical systems. | An Guo, Rongli Gai, Dong Yu, Yi Hu |
| 2017 | ICASSP | The microsoft 2016 conversational speech recognition system. | Wayne Xiong, Jasha Droppo, Xuedong Huang, Frank Seide, Mike Seltzer, Andreas Stolcke, Dong Yu, Geoffrey Zweig |
| 2017 | ICASSP | Permutation invariant training of deep models for speaker-independent multi-talker speech separation. | Dong Yu, Morten Kolbk, Zheng-Hua Tan, Jesper Jensen |
| 2016 | ICASSP | An investigation into using parallel data for far-field speech recognition. | Yanmin Qian, Tian Tan, Dong Yu |
| 2016 | ICASSP | Integrated adaptation with multi-factor joint-learning for far-field speech recognition. | Yanmin Qian, Tian Tan, Dong Yu, Yu Zhang |
| 2016 | ICASSP | Speaker-aware training of LSTM-RNNS for acoustic modelling. | Tian Tan, Yanmin Qian, Dong Yu, Souvik Kundu, Liang Lu, Khe Chai Sim, Xiong Xiao, Yu Zhang |
| 2016 | ICASSP | Deep beamforming networks for multi-channel speech recognition. | Xiong Xiao, Shinji Watanabe, Hakan Erdogan, Liang Lu, John R. Hershey, Michael L. Seltzer, Guoguo Chen, Yu Zhang, Michael I. Mandel, Dong Yu |
| 2016 | ICASSP | Prediction-adaptation-correction recurrent neural networks for low-resource language speech recognition. | Yu Zhang, Ekapol Chuangsuwanich, James R. Glass, Dong Yu |
| 2016 | ICASSP | Highway long short-term memory RNNS for distant speech recognition. | Yu Zhang, Guoguo Chen, Dong Yu, Kaisheng Yao, Sanjeev Khudanpur, James R. Glass |
| 2015 | ASRU | Deep bi-directional recurrent networks over spectral windows. | Abdel-rahman Mohamed, Frank Seide, Dong Yu, Jasha Droppo, Andreas Stolcke, Geoffrey Zweig, Gerald Penn |
| 2015 | ICASSP | Improving speech recognition in reverberation using a room-aware deep neural network and multi-task learning. | Ritwik Giri, Michael L. Seltzer, Jasha Droppo, Dong Yu |
| 2015 | ICASSP | Speech recognition with prediction-adaptation-correction recurrent neural networks. | Yu Zhang, Dong Yu, Michael L. Seltzer, Jasha Droppo |
| 2014 | ICASSP | Phone sequence modeling with recurrent neural networks. | Nicolas Boulanger-Lewandowski, Jasha Droppo, Mike Seltzer, Dong Yu |
| 2014 | ICASSP | On parallelizability of stochastic gradient descent for speech DNNS. | Frank Seide, Hao Fu, Jasha Droppo, Gang Li, Dong Yu |
| 2014 | ICASSP | Single-channel mixed speech recognition using deep neural networks. | Chao Weng, Dong Yu, Michael L. Seltzer, Jasha Droppo |
| 2014 | ICASSP | Recurrent deep neural networks for robust speech recognition. | Chao Weng, Dong Yu, Shinji Watanabe, Biing-Hwang Fred Juang |
| 2014 | ICASSP | Singular value decomposition based low-footprint speaker adaptation and personalization for deep neural network. | Jian Xue, Jinyu Li, Dong Yu, Mike Seltzer, Yifan Gong |
| 2014 | ICASSP | Recurrent conditional random field for language understanding. | Kaisheng Yao, Baolin Peng, Geoffrey Zweig, Dong Yu, Xiaolong Li, Feng Gao |
| 2014 | Interspeech | Speech emotion recognition using deep neural network and extreme learning machine. | Kun Han, Dong Yu, Ivan Tashev |
| 2014 | Interspeech | A comparative analytic study on the Gaussian mixture and context dependent deep neural network hidden Markov models. | Yan Huang, Dong Yu, Chaojun Liu, Yifan Gong |
| 2014 | Interspeech | Multi-accent deep neural network acoustic model with accent-specific top layer using the KLD-regularized model adaptation. | Yan Huang, Dong Yu, Chaojun Liu, Yifan Gong |
| 2013 | ICASSP | Large-scale malware classification using random projections and neural networks. | George E. Dahl, Jack W. Stokes, Li Deng, Dong Yu |
| 2013 | ICASSP | A deep convolutional neural network using heterogeneous pooling for trading acoustic invariance with phonetic confusion. | Li Deng, Ossama Abdel-Hamid, Dong Yu |
| 2013 | ICASSP | Recent advances in deep learning for speech research at Microsoft. | Li Deng, Jinyu Li, Jui-Ting Huang, Kaisheng Yao, Dong Yu, Frank Seide, Michael L. Seltzer, Geoffrey Zweig, Xiaodong He, Jason D. Williams, Yifan Gong, Alex Acero |
| 2013 | ICASSP | Cross-language knowledge transfer using multilingual deep neural network with shared hidden layers. | Jui-Ting Huang, Jinyu Li, Dong Yu, Li Deng, Yifan Gong |
| 2013 | ICASSP | Modeling spectral envelopes using restricted Boltzmann machines for statistical parametric speech synthesis. | Zhen-Hua Ling, Li Deng, Dong Yu |
| 2013 | ICASSP | An investigation of deep neural networks for noise robust speech recognition. | Michael L. Seltzer, Dong Yu, Yongqiang Wang |
| 2013 | ICASSP | Error back propagation for sequence training of Context-Dependent Deep NetworkS for conversational speech transcription. | Hang Su, Gang Li, Dong Yu, Frank Seide |
| 2013 | ICASSP | KL-divergence regularized deep neural network adaptation for improved large vocabulary speech recognition. | Dong Yu, Kaisheng Yao, Hang Su, Gang Li, Frank Seide |
| 2013 | Interspeech | Exploring convolutional neural network structures and optimization techniques for speech recognition. | Ossama Abdel-Hamid, Li Deng, Dong Yu |
| 2013 | Interspeech | Deep segmental neural networks for speech recognition. | Ossama Abdel-Hamid, Li Deng, Dong Yu, Hui Jiang |
| 2013 | Interspeech | Semi-supervised GMM and DNN acoustic model training with multi-system combination and confidence re-calibration. | Yan Huang, Dong Yu, Yifan Gong, Chaojun Liu |
| 2012 | ICASSP | Scalable stacking and learning for building deep architectures. | Li Deng, Dong Yu, John C. Platt |
| 2012 | ICASSP | A deep architecture with bilinear modeling of hidden representations: Applications to phonetic recognition. | Brian Hutchinson, Li Deng, Dong Yu |
| 2012 | ICASSP | Boosting attribute and phone estimation accuracies with deep neural networks for detection-based speech recognition. | Dong Yu, Sabato Marco Siniscalchi, Li Deng, Chin-Hui Lee |
| 2012 | ICASSP | Exploiting sparseness in deep neural networks for large vocabulary speech recognition. | Dong Yu, Frank Seide, Gang Li, Li Deng |
| 2012 | ICML | Conversational Speech Transcription Using Context-Dependent Deep Neural Networks. | Dong Yu, Frank Seide, Gang Li |
| 2012 | Interspeech | Pipelined Back-Propagation for Context-Dependent Deep Neural Networks. | Xie Chen, Adam Eversole, Gang Li, Dong Yu, Frank Seide |
| 2012 | Interspeech | Parallel Training for Deep Stacking Networks. | Li Deng, Brian Hutchinson, Dong Yu |
| 2011 | ASRU | Feature engineering in Context-Dependent Deep Neural Networks for conversational speech transcription. | Frank Seide, Gang Li, Xie Chen, Dong Yu |
| 2011 | ICASSP | Large vocabulary continuous speech recognition with context-dependent DBN-HMMS. | George E. Dahl, Dong Yu, Li Deng, Alex Acero |
| 2011 | ICASSP | Subspace constrained LU decomposition of FMLLR for rapid adaptation. | Lei Jia, Dong Yu, Bo Xu |
| 2010 | ICASSP | Semantic confidence calibration for spoken dialog applications. | Dong Yu, Li Deng |
| 2010 | ICASSP | Language recognition using deep-structured conditional random fields. | Dong Yu, Shizhen Wang, Zahi N. Karam, Li Deng |
| 2010 | ICASSP | Word confidence calibration using a maximum entropy model with constraints on confidence and word distributions. | Dong Yu, Shizhen Wang, Jinyu Li, Li Deng |
| 2010 | Interspeech | Binary coding of speech spectrograms using a deep auto-encoder. | Li Deng, Michael L. Seltzer, Dong Yu, Alex Acero, Abdel-rahman Mohamed, Geoffrey E. Hinton |
| 2009 | ICASSP | A study on multilingual acoustic modeling for large vocabulary ASR. | Hui Lin, Li Deng, Dong Yu, Yifan Gong, Alex Acero, Chin-Hui Lee |
| 2009 | ICASSP | Using collective information in semi-supervised learning for speech recognition. | Balakrishnan Varadarajan, Dong Yu, Li Deng, Alex Acero |
| 2009 | ICASSP | Maximizing global entropy reduction for active learning in speech recognition. | Balakrishnan Varadarajan, Dong Yu, Li Deng, Alex Acero |
| 2009 | ICASSP | Discriminative pronounciation learning using phonetic decoder and minimum-classification-error criterion. | Oriol Vinyals, Li Deng, Dong Yu, Alex Acero |
| 2009 | ICASSP | Cross-lingual speech recognition under runtime resource constraints. | Dong Yu, Li Deng, Peng Liu, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | GLOBECOM | Adaptive Spread-Transform Dither Modulation for Color Image Watermarking. | Lihong Ma, Dong Yu, Hanqing Lu |
| 2008 | ICASSP | HMM adaptation using a phase-sensitive acoustic distortion model for environment-robust speech recognition. | Jinyu Li, Li Deng, Dong Yu, Yifan Gong, Alex Acero |
| 2008 | ICASSP | Adaptation of compressed HMM parameters for resource-constrained speech recognition. | Jinyu Li, Li Deng, Dong Yu, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | ICASSP | A minimum-mean-square-error noise reduction algorithm on Mel-frequency cepstra for robust speech recognition. | Dong Yu, Li Deng, Jasha Droppo, Jian Wu, Yifan Gong, Alex Acero |
| 2008 | ICIP | Adaptive spread-transform dither modulation using an improved luminance-masked threshold. | Dong Yu, Lihong Ma, Guoxi Wang, Hanqing Lu |
| 2007 | ASRU | High-performance hmm adaptation with joint compensation of additive and convolutive distortions via Vector Taylor Series. | Jinyu Li, Li Deng, Dong Yu, Yifan Gong, Alex Acero |
| 2007 | ICASSP | Use of Differential Cepstra as Acoustic Features in Hidden Trajectory Modeling for Phonetic Recognition. | Li Deng, Dong Yu |
| 2007 | ICASSP | A Discriminative Training Framework using N-Best Speech Recognition Transcriptions and Scores for Spoken Utterance Classification. | Sibel Yaman, Li Deng, Dong Yu, Ye-Yi Wang, Alex Acero |
| 2007 | ICASSP | Large-Margin Minimum Classification Error Training for Large-Scale Speech Recognition Tasks. | Dong Yu, Li Deng, Xiaodong He, Alex Acero |
| 2006 | ICASSP | N-Gram Based Filler Model for Robust Grammar Authoring. | Dong Yu, Yun-Cheng Ju, Ye-Yi Wang, Alex Acero |
| 2006 | Interspeech | A time-synchronous phonetic decoder for a long-contextual-Span hidden trajectory model. | Xiaolong Li, Li Deng, Dong Yu, Alex Acero |
| 2005 | ICASSP | A Hidden Trajectory Model with Bi-directional Target-Filtering: Cascaded vs. Integrated Implementation for Phonetic Recognition. | Li Deng, Xiang Li, Dong Yu, Alex Acero |
| 2005 | ICASSP | Maximum Entropy Based Generic Filter for Language Model Adaptation. | Dong Yu, Milind Mahajan, Peter Mau, Alex Acero |
| 2005 | Interspeech | Learning statistically characterized resonance targets in a hidden trajectory model of speech coarticulation and reduction. | Li Deng, Dong Yu, Alex Acero |
| 2004 | ACNS | A Novel Framework for Alert Correlation and Understanding. | Dong Yu, Deborah A. Frincke |