Shimin Tao
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
48
Venues
25
Active years
2015–2026
Best venue rank
A*
Where they publish
- A*EMNLP7 papers
- A*AAAI6 papers
- A*ACL6 papers
- AInterspeech3 papers
- A*SIGIR2 papers
- BIJCNN2 papers
- A*ICDE2 papers
- MulticonferenceICASSP2 papers
- AICDCS2 papers
- ACIKM1 paper
- BCOLING1 paper
- A*ICSE1 paper
- BCOMPSAC1 paper
- BIWQoS1 paper
- AMiddleware1 paper
- AWSDM1 paper
- CEAMT1 paper
- BIJCNLP1 paper
- CKSEM1 paper
- ANAACL1 paper
- BNOMS1 paper
- BINLG1 paper
- BICCCN1 paper
- A*IJCAI1 paper
- ACoNEXT1 paper
Papers
48 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Measuring the Unmeasurable: Unveiling Latent Cognitive Capabilities of LLM. | Cui Danxin, Sihang Jiang, Keyi Wang, Zhiyi Duan, Yanghua Xiao, Bi Yude, Jiaqing Liang, Minggui He, Shimin Tao, Yilun Liu |
| 2026 | AAAI | MIDB: Multilingual Instruction Data Booster for Enhancing Cultural Equality in Multilingual Instruction Synthesis. | Yilun Liu, Chunguang Zhao, Xinhua Yang, Hongyong Zeng, Shimin Tao, Weibin Meng, Minggui He, Yan Yu, Hongxia Ma, Li Zhang, Daimeng Wei, Boxing Chen |
| 2026 | AAAI | ELSPR: Evaluator LLM Training Data Self-Purification on Non-Transitive Preferences via Tournament Graph Reconstruction. | Yan Yu, Yilun Liu, Minggui He, Shimin Tao, Weibin Meng, Xinhua Yang, Li Zhang, Hongxia Ma, Dengye Li, Daimeng Wei, Boxing Chen, Fuliang Li |
| 2026 | ACL | The "Knowledge-Behavior Gap" in Cultural Taboo Safety of Large Language Models. | Ying He, Sihang Jiang, Xingzhou Chen, Zhouhong Gu, Yiwei Gu, Minggui He, Shimin Tao, Hongxia Ma, Yanghua Xiao |
| 2026 | ACL | DeReA: Improving Idiom Translation with Detect-Retrieve-Arbitrate Reasoning. | Rongqing Jiang, Xuebo Liu, Shengxin Liu, Yutong Wang, Min Zhang, Shimin Tao, Daimeng Wei |
| 2026 | ACL | The GaoYao Benchmark: A Comprehensive Framework for Evaluating Multilingual and Multicultural Abilities of Large Language Models. | Yilun Liu, Chunguang Zhao, Mengyao Piao, Lingqi Miao, Shimin Tao, Minggui He, Chenxin Liu, Li Zhang, Hongxia Ma, Jiaxin Guo, Chen Liu, Liqun Deng, Jiansheng Wei, Xiaojun Meng, Fanyi Du, Daimeng Wei, Yanghua Xiao |
| 2026 | SIGIR | M-DaQ: Retrieving Samples with Multilingual Diversity and Quality for Instruction Fine-Tuning Datasets. | Chunguang Zhao, Yilun Liu, Pufan Zeng, Yuanchang Luo, Shimin Tao, Minggui He, Weibin Meng, Song Xu, Chen Liu, Hongxia Ma, Li Zhang, Boxing Chen, Daimeng Wei |
| 2025 | AAAI | SRDC: Semantics-based Ransomware Detection and Classification with LLM-assisted Pre-training. | Ce Zhou, Yilun Liu, Weibin Meng, Shimin Tao, Weinan Tian, Feiyu Yao, Xiaochun Li, Tao Han, Boxing Chen, Hao Yang |
| 2025 | ACL | Two Intermediate Translations Are Better Than One: Fine-tuning LLMs for Document-level Translation Refinement. | Yichen Dong, Xinglin Lyu, Junhui Li, Daimeng Wei, Min Zhang, Shimin Tao, Hao Yang |
| 2025 | CIKM | Adapting Large Language Models to Log Analysis with Interpretable Domain Knowledge. | Yuhe Ji, Yilun Liu, Feiyu Yao, Minggui He, Shimin Tao, Xiaofeng Zhao, Chang Su, Xinhua Yang, Weibin Meng, Yuming Xie, Boxing Chen, Shenglin Zhang, Yongqian Sun |
| 2025 | EMNLP | M-Ped: Multi-Prompt Ensemble Decoding for Large Language Models. | Jiaxin Guo, Daimeng Wei, Yuanchang Luo, Hengchao Shang, Zongyao Li, Jinlong Yang, Zhanglin Wu, Zhiqiang Rao, Shimin Tao, Hao Yang |
| 2025 | EMNLP | Taming Text-to-Image Synthesis for Novices: User-centric Prompt Generation via Multi-turn Guidance. | Yilun Liu, Minggui He, Feiyu Yao, Yuhe Ji, Shimin Tao, Jingzhou Du, Justin Li, Jian Gao, Zhang Li, Hao Yang, Boxing Chen, Osamu Yoshie |
| 2025 | IJCNN | SuperFC: Selective Data Utilization for a Sustainable and Effective Function-Calling Agent. | Xinhua Yang, Yilun Liu, Shimin Tao, Chunguang Zhao, Weibin Meng, Minggui He, Chang Su, Rongrong Liu, Hongxia Ma, Li Zhang, Jingzhou Du, Duan Li, Jian Gao, Hao Yang, Boxing Chen, Chuanwen Li |
| 2024 | AAAI | Translate Meanings, Not Just Words: IdiomKB's Role in Optimizing Idiomatic Translation with Language Models. | Shuang Li, Jiangjie Chen, Siyu Yuan, Xinyi Wu, Hao Yang, Shimin Tao, Yanghua Xiao |
| 2024 | COLING | Evaluation Dataset for Lexical Translation Consistency in Chinese-to-English Document-level Translation. | Xiangyu Lei, Junhui Li, Shimin Tao, Hao Yang |
| 2024 | EMNLP | Clustering and Ranking: Diversity-preserved Instruction Selection through Expert-aligned Quality Estimation. | Yuan Ge, Yilun Liu, Chi Hu, Weibin Meng, Shimin Tao, Xiaofeng Zhao, Mahong Xia, Zhang Li, Boxing Chen, Hao Yang, Bei Li, Tong Xiao, JingBo Zhu |
| 2024 | EMNLP | DeMPT: Decoding-enhanced Multi-phase Prompt Tuning for Making LLMs Be Better Context-aware Translators. | Xinglin Lyu, Junhui Li, Yanqing Zhao, Min Zhang, Daimeng Wei, Shimin Tao, Hao Yang, Min Zhang |
| 2024 | ICDE | CoachLM: Automatic Instruction Revisions Improve the Data Quality in LLM Instruction Tuning. | Yilun Liu, Shimin Tao, Xiaofeng Zhao, Ming Zhu, Wenbing Ma, Junhao Zhu, Chang Su, Yutai Hou, Miao Zhang, Min Zhang, Hongxia Ma, Li Zhang, Hao Yang, Yanfei Jiang |
| 2024 | IJCNN | From Handcrafted Features to LLMs: A Brief Survey for Machine Translation Quality Estimation. | Haofei Zhao, Yilun Liu, Shimin Tao, Weibin Meng, Yimeng Chen, Xiang Geng, Chang Su, Min Zhang, Hao Yang |
| 2024 | Interspeech | Using Large Language Model for End-to-End Chinese ASR and NER. | Yuang Li, Jiawei Yu, Min Zhang, Mengxin Ren, Yanqing Zhao, Xiaofeng Zhao, Shimin Tao, Jinsong Su, Hao Yang |
| 2024 | Interspeech | A Multitask Training Approach to Enhance Whisper with Open-Vocabulary Keyword Spotting. | Yuang Li, Min Zhang, Chang Su, Yinglu Li, Xiaosong Qiao, Mengxin Ren, Miaomiao Ma, Daimeng Wei, Shimin Tao, Hao Yang |
| 2024 | ICSE | LogPrompt: Prompt Engineering Towards Zero-Shot and Interpretable Log Analysis. | Yilun Liu, Shimin Tao, Weibin Meng, Feiyu Yao, Xiaofeng Zhao, Hao Yang |
| 2023 | AAAI | Denoising Pre-training for Machine Translation Quality Estimation with Curriculum Learning. | Xiang Geng, Yu Zhang, Jiahuan Li, Shujian Huang, Hao Yang, Shimin Tao, Yimeng Chen, Ning Xie, Jiajun Chen |
| 2023 | ACL | Lexical Translation Inconsistency-Aware Document-Level Translation Repair. | Zhen Zhang, Junhui Li, Shimin Tao, Hao Yang |
| 2023 | COMPSAC | DA-Parser: A Pre-trained Domain-aware Parsing Framework for Heterogeneous Log Analysis. | Shimin Tao, Yilun Liu, Weibin Meng, Jingyu Wang, Yanqing Zhao, Chang Su, Weinan Tian, Min Zhang, Hao Yang, Xun Chen |
| 2023 | EMNLP | Improved Pseudo Data for Machine Translation Quality Estimation with Constrained Beam Search. | Xiang Geng, Yu Zhang, Zhejian Lai, Shuaijie She, Wei Zou, Shimin Tao, Hao Yang, Jiajun Chen, Shujian Huang |
| 2023 | EMNLP | SmartSpanNER: Making SpanNER Robust in Low Resource Scenarios. | Min Zhang, Xiaosong Qiao, Yanqing Zhao, Shimin Tao, Hao Yang |
| 2023 | ICASSP | UCorrect: An Unsupervised Framework for Automatic Speech Recognition Error Correction. | Jiaxin Guo, Minghan Wang, Xiaosong Qiao, Daimeng Wei, Hengchao Shang, Zongyao Li, Zhengzhe Yu, Yinglu Li, Chang Su, Min Zhang, Shimin Tao, Hao Yang |
| 2023 | ICASSP | Zephyr: Zero-Shot Punctuation Restoration. | Minghan Wang, Yinglu Li, Jiaxin Guo, Xiaosong Qiao, Chang Su, Min Zhang, Shimin Tao, Hao Yang |
| 2023 | ICDCS | CONFPILOT: A Pilot for Faster Configuration by Learning from Device Manuals. | Jinyu Zhao, Haifeng Sun, Jingyu Wang, Qi Qi, Zirui Zhuang, Shimin Tao, Jianxin Liao |
| 2023 | Interspeech | WhiSLU: End-to-End Spoken Language Understanding with Whisper. | Minghan Wang, Yinglu Li, Jiaxin Guo, Xiaosong Qiao, Zongyao Li, Hengchao Shang, Daimeng Wei, Shimin Tao, Min Zhang, Hao Yang |
| 2023 | IWQoS | Biglog: Unsupervised Large-scale Pre-training for a Unified Log Representation. | Shimin Tao, Yilun Liu, Weibin Meng, Zuomin Ren, Hao Yang, Xun Chen, Liang Zhang, Yuming Xie, Chang Su, Xiaosong Oiao, Weinan Tian, Yichen Zhu, Tao Han, Ying Qin, Yun Li |
| 2023 | Middleware | LogDAPT: Log Data Anomaly Detection with Domain-Adaptive Pretraining (industry track). | Haoyu Zheng, Guojun Chu, Haifeng Sun, Jingyu Wang, Shimin Tao, Hao Yang |
| 2023 | SIGIR | Multi-order Matched Neighborhood Consistent Graph Alignment in a Union Vector Space. | Wei Tang, Haifeng Sun, Jingyu Wang, Qi Qi, Jing Wang, Hao Yang, Shimin Tao |
| 2023 | WSDM | Weakly Supervised Entity Alignment with Positional Inspiration. | Wei Tang, Fenglong Su, Haifeng Sun, Qi Qi, Jingyu Wang, Shimin Tao, Hao Yang |
| 2022 | ACL | Capture Human Disagreement Distributions by Calibrated Networks for Natural Language Inference. | Yuxia Wang, Minghan Wang, Yimeng Chen, Shimin Tao, Jiaxin Guo, Chang Su, Min Zhang, Hao Yang |
| 2022 | EAMT | Diformer: Directional Transformer for Neural Machine Translation. | Minghan Wang, Jiaxin Guo, Yuxia Wang, Daimeng Wei, Hengchao Shang, Yinglu Li, Chang Su, Yimeng Chen, Min Zhang, Shimin Tao, Hao Yang |
| 2022 | EMNLP | Modeling Consistency Preference via Lexical Chains for Document-level Neural Machine Translation. | Xinglin Lyu, Junhui Li, Shimin Tao, Hao Yang, Ying Qin, Min Zhang |
| 2022 | IJCNLP | Part Represents Whole: Improving the Evaluation of Machine Translation System Using Entropy Enhanced Metrics. | Yilun Liu, Shimin Tao, Chang Su, Min Zhang, Yanqing Zhao, Hao Yang |
| 2022 | KSEM | CCDC: A Chinese-Centric Cross Domain Contrastive Learning Framework. | Hao Yang, Shimin Tao, Minghan Wang, Min Zhang, Daimeng Wei, Shuai Zhao, Miaomiao Ma, Ying Qin |
| 2022 | NAACL | Neighbors Are Not Strangers: Improving Non-Autoregressive Translation under Low-Frequency Lexical Constraints. | Chun Zeng, Jiangjie Chen, Tianyi Zhuang, Rui Xu, Hao Yang, Ying Qin, Shimin Tao, Yanghua Xiao |
| 2022 | NOMS | WRS: Workflow Retrieval System for Cloud Automatic Remediation. | Hongyi Huang, Wenfei Wu, Shimin Tao |
| 2021 | ICDE | Prefix-Graph: A Versatile Log Parsing Approach Merging Prefix Tree with Probabilistic Graph. | Guojun Chu, Jingyu Wang, Qi Qi, Haifeng Sun, Shimin Tao, Jianxin Liao |
| 2021 | INLG | HI-CMLM: Improve CMLM with Hybrid Decoder Input. | Minghan Wang, Jiaxin Guo, Yuxia Wang, Yimeng Chen, Chang Su, Daimeng Wei, Min Zhang, Shimin Tao, Hao Yang |
| 2020 | ICCCN | LogParse: Making Log Parsing Adaptive through Word Classification. | Weibin Meng, Ying Liu, Federico Zaiter, Shenglin Zhang, Yihao Chen, Yuzhe Zhang, Yichen Zhu, En Wang, Ruizhi Zhang, Shimin Tao, Dian Yang, Rong Zhou, Dan Pei |
| 2019 | IJCAI | LogAnomaly: Unsupervised Detection of Sequential and Quantitative Anomalies in Unstructured Logs. | Weibin Meng, Ying Liu, Yichen Zhu, Shenglin Zhang, Dan Pei, Yuqing Liu, Yihao Chen, Ruizhi Zhang, Shimin Tao, Pei Sun, Rong Zhou |
| 2017 | ICDCS | Segmentation of Time Series Based on Kinetic Characteristics for Storage Consumption Prediction. | Beibei Miao, Yu Chen, Xuebo Jin, Bo Wang, Xianping Qu, Shimin Tao, Dong Wang, Zhi Zang |
| 2015 | CoNEXT | Rapid and robust impact assessment of software changes in large internet-based services. | Shenglin Zhang, Ying Liu, Dan Pei, Yu Chen, Xianping Qu, Shimin Tao, Zhi Zang |