Pinzhen Chen
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
21
Venues
10
Active years
2020–2026
Best venue rank
A*
Where they publish
Papers
21 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | EACL | When Flores Bloomz Wrong: Cross-Direction Contamination in Machine Translation Evaluation. | David Tan, Pinzhen Chen, Josef van Genabith, Koel Dutta Chowdhury |
| 2026 | LREC | HPLT 3.0: Very Large-Scale Multilingual Resources for LLMs and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models. | Stephan Oepen, Nikolay Arefyev, Mikko Aulamo, Marta Ban, Maja Buljan, Laurie Burchell, Lucas Georges Gabriel Charpentier, Pinzhen Chen, Mariia Fedorova, Ona de Gibert, Barry Haddow, Jan Hajic, Jindrich Helcl, Andrey Kutuzov, Veronika Laippala, Zihao Li, Bhavitvya Malik, Vladislav Mikhailov, Amanda Myntti, Dayyn O'Brien, Lucie Polkov, Gema Ramrez-Snchez, Janine Siewert, Pavel Stepachev, Jrg Tiedemann, Teemu Vahtola, Dusan Varis, Fedor Vitiugin, Jaume Zaragoza |
| 2025 | ACL | An Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT). | Laurie Burchell, Ona De Gibert Bonet, Nikolay Arefyev, Mikko Aulamo, Marta Ban, Pinzhen Chen, Mariia Fedorova, Liane Guillou, Barry Haddow, Jan Hajic, Jindrich Helcl, Erik Henriksson, Mateusz Klimaszewski, Ville Komulainen, Andrey Kutuzov, Joona Kytniemi, Veronika Laippala, Petter Mhlum, Bhavitvya Malik, Farrokh Mehryary, Vladislav Mikhailov, Nikita Moghe, Amanda Myntti, Dayyn O'Brien, Stephan Oepen, Proyag Pal, Jousia Piha, Sampo Pyysalo, Gema Ramrez-Snchez, David Samuel, Pavel Stepachev, Jrg Tiedemann, Dusan Varis, Tereza Vojtechov, Jaume Zaragoza-Bernabeu |
| 2025 | COLING | How Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM. | Shaoxiong Ji, Pinzhen Chen |
| 2025 | COLING | AveniBench: Accessible and Versatile Evaluation of Finance Intelligence. | Mateusz Klimaszewski, Pinzhen Chen, Liane Guillou, Ioannis Papaioannou, Barry Haddow, Alexandra Birch |
| 2025 | EMNLP | XL-Suite: Cross-Lingual Synthetic Training and Evaluation Data for Open-Ended Generation. | Vivek Iyer, Pinzhen Chen, Ricardo Rei, Alexandra Birch |
| 2025 | NAACL | Fine-Tuning Large Language Models with Sequential Instructions. | Hanxu Hu, Simon Yu, Pinzhen Chen, Edoardo M. Ponti |
| 2024 | COLING | EEE-QA: Exploring Effective and Efficient Question-Answer Representations. | Zhanghao Hu, Yijun Yang, Junjie Xu, Yifu Qiu, Pinzhen Chen |
| 2024 | EACL | Monolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca. | Pinzhen Chen, Shaoxiong Ji, Nikolay Bogoychev, Andrey Kutuzov, Barry Haddow, Kenneth Heafield |
| 2024 | EAMT | HPLT's First Release of Data and Models. | Nikolay Arefyev, Mikko Aulamo, Pinzhen Chen, Ona De Gibert Bonet, Barry Haddow, Jindrich Helcl, Bhavitvya Malik, Gema Ramrez-Snchez, Pavel Stepachev, Jrg Tiedemann, Dusan Varis, Jaume Zaragoza-Bernabeu |
| 2024 | EAMT | Iterative Translation Refinement with Large Language Models. | Pinzhen Chen, Zhicheng Guo, Barry Haddow, Kenneth Heafield |
| 2024 | EMNLP | Is It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models? | Pinzhen Chen, Simon Yu, Zhicheng Guo, Barry Haddow |
| 2024 | EMNLP | Fine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice? | Dawei Zhu, Pinzhen Chen, Miaoran Zhang, Barry Haddow, Xiaoyu Shen, Dietrich Klakow |
| 2024 | ICASSP | Regarding Topology and Adaptability in Differentiable WFST-Based E2E ASR. | Zeyu Zhao, Pinzhen Chen, Peter Bell |
| 2024 | NAACL | UniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through Debiasing. | Yijun Yang, Jie He, Pinzhen Chen, Vctor Gutirrez-Basulto, Jeff Z. Pan |
| 2023 | EACL | Exploring Data Augmentation for Code Generation Tasks. | Pinzhen Chen, Gerasimos Lampouras |
| 2023 | EMNLP | PMIndiaSum: Multilingual and Cross-lingual Headline Summarization for Languages in India. | Ashok Urlana, Pinzhen Chen, Zheng Zhao, Shay B. Cohen, Manish Shrivastava, Barry Haddow |
| 2022 | IJCNLP | A Unified Model for Reverse Dictionary and Definition Modelling. | Pinzhen Chen, Zheng Zhao |
| 2022 | PACLIC | Approaching Neural Chinese Word Segmentation as a Low-Resource Machine Translation Task. | Pinzhen Chen, Kenneth Heafield |
| 2020 | ACL | ParaCrawl: Web-Scale Acquisition of Parallel Corpora. | Marta Ban, Pinzhen Chen, Barry Haddow, Kenneth Heafield, Hieu Hoang, Miquel Espl-Gomis, Mikel L. Forcada, Amir Kamran, Faheem Kirefu, Philipp Koehn, Sergio Ortiz-Rojas, Leopoldo Pla Sempere, Gema Ramrez-Snchez, Elsa Sarras, Marek Strelec, Brian Thompson, William Waites, Dion Wiggins, Jaume Zaragoza |
| 2020 | ACL | Parallel Sentence Mining by Constrained Decoding. | Pinzhen Chen, Nikolay Bogoychev, Kenneth Heafield, Faheem Kirefu |