| 2026 | AAAI | Exposing the Cracks: Vulnerabilities of Retrieval-Augmented LLM-based Machine Translation. | Yanming Sun, Runzhe Zhan, Chi Seng Cheang, Han Wu, Xuebo Liu, Yuyao Niu, Fengying Ye, Kaixin Lan, Lidia S. Chao, Derek F. Wong |
| 2026 | ACL | VisAidMath: Benchmarking Visual-Aided Mathematical Reasoning. | Jingkun Ma, Runzhe Zhan, Yang Li, Di Sun, Hou Pong Chan, Lidia S. Chao, Derek F. Wong |
| 2026 | ACL | G-IdiomAlign: A Gloss-Pivoted Benchmark for Cross-Lingual Idiom Alignment. | Fengying Ye, Yanming Sun, Runzhe Zhan, Lidia S. Chao, Zheqi Zhang, Derek F. Wong |
| 2025 | ACL | Rethinking Prompt-based Debiasing in Large Language Model. | Xinyi Yang, Runzhe Zhan, Shu Yang, Junchao Wu, Lidia S. Chao, Derek F. Wong |
| 2025 | COLING | Who Wrote This? The Key to Zero-Shot LLM-Generated Text Detection Is GECScore. | Junchao Wu, Runzhe Zhan, Derek F. Wong, Shu Yang, Xuebo Liu, Lidia S. Chao, Min Zhang |
| 2025 | COLING | Let's Focus on Neuron: Neuron-Level Supervised Fine-tuning for Large Language Model. | Haoyun Xu, Runzhe Zhan, Yingpeng Ma, Derek F. Wong, Lidia S. Chao |
| 2025 | EMNLP | Path Drift in Large Reasoning Models: How First-Person Commitments Override Safety. | Yuyi Huang, Runzhe Zhan, Lidia S. Chao, Ailin Tao, Derek F. Wong |
| 2025 | NAACL | Intrinsic Model Weaknesses: How Priming Attacks Unveil Vulnerabilities in Large Language Models. | Yuyi Huang, Runzhe Zhan, Derek F. Wong, Lidia S. Chao, Ailin Tao |
| 2024 | ACL | Prefix Text as a Yarn: Eliciting Non-English Alignment in Foundation Language Model. | Runzhe Zhan, Xinyi Yang, Derek F. Wong, Lidia S. Chao, Yue Zhang |
| 2024 | EMNLP | Can LLMs Learn Uncertainty on Their Own? Expressing Uncertainty Effectively in A Self-Training Manner. | Shudong Liu, Zhaocong Li, Xuebo Liu, Runzhe Zhan, Derek F. Wong, Lidia S. Chao, Min Zhang |
| 2023 | ACL | Revisiting Commonsense Reasoning in Machine Translation: Training, Evaluation and Challenge. | Xuebo Liu, Yutong Wang, Derek F. Wong, Runzhe Zhan, Liangxuan Yu, Min Zhang |
| 2023 | ACL | TransGEC: Improving Grammatical Error Correction with Translationese. | Tao Fang, Xuebo Liu, Derek F. Wong, Runzhe Zhan, Liang Ding, Lidia S. Chao, Dacheng Tao, Min Zhang |
| 2023 | ACL | Test-time Adaptation for Machine Translation Evaluation by Uncertainty Minimization. | Runzhe Zhan, Xuebo Liu, Derek F. Wong, Cuilian Zhang, Lidia S. Chao, Min Zhang |
| 2023 | EACL | Yu Sheng: Human-in-Loop Classical Chinese Poetry Generation System. | Jingkun Ma, Runzhe Zhan, Derek F. Wong |
| 2021 | AAAI | Meta-Curriculum Learning for Domain Adaptation in Neural Machine Translation. | Runzhe Zhan, Xuebo Liu, Derek F. Wong, Lidia S. Chao |
| 2021 | ACL | Difficulty-Aware Machine Translation Evaluation. | Runzhe Zhan, Xuebo Liu, Derek F. Wong, Lidia S. Chao |