Skip to content

Pinzhen Chen

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

21

Venues

10

Active years

2020–2026

Best venue rank

A*

Where they publish

Papers

21 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLWhen Flores Bloomz Wrong: Cross-Direction Contamination in Machine Translation Evaluation.David Tan, Pinzhen Chen, Josef van Genabith, Koel Dutta Chowdhury
2026LRECHPLT 3.0: Very Large-Scale Multilingual Resources for LLMs and MT. Mono- and Bi-lingual Data, Multilingual Evaluation, and Pre-Trained Models.Stephan Oepen, Nikolay Arefyev, Mikko Aulamo, Marta Ban, Maja Buljan, Laurie Burchell, Lucas Georges Gabriel Charpentier, Pinzhen Chen, Mariia Fedorova, Ona de Gibert, Barry Haddow, Jan Hajic, Jindrich Helcl, Andrey Kutuzov, Veronika Laippala, Zihao Li, Bhavitvya Malik, Vladislav Mikhailov, Amanda Myntti, Dayyn O'Brien, Lucie Polkov, Gema Ramrez-Snchez, Janine Siewert, Pavel Stepachev, Jrg Tiedemann, Teemu Vahtola, Dusan Varis, Fedor Vitiugin, Jaume Zaragoza
2025ACLAn Expanded Massive Multilingual Dataset for High-Performance Language Technologies (HPLT).Laurie Burchell, Ona De Gibert Bonet, Nikolay Arefyev, Mikko Aulamo, Marta Ban, Pinzhen Chen, Mariia Fedorova, Liane Guillou, Barry Haddow, Jan Hajic, Jindrich Helcl, Erik Henriksson, Mateusz Klimaszewski, Ville Komulainen, Andrey Kutuzov, Joona Kytniemi, Veronika Laippala, Petter Mhlum, Bhavitvya Malik, Farrokh Mehryary, Vladislav Mikhailov, Nikita Moghe, Amanda Myntti, Dayyn O'Brien, Stephan Oepen, Proyag Pal, Jousia Piha, Sampo Pyysalo, Gema Ramrez-Snchez, David Samuel, Pavel Stepachev, Jrg Tiedemann, Dusan Varis, Tereza Vojtechov, Jaume Zaragoza-Bernabeu
2025COLINGHow Many Languages Make Good Multilingual Instruction Tuning? A Case Study on BLOOM.Shaoxiong Ji, Pinzhen Chen
2025COLINGAveniBench: Accessible and Versatile Evaluation of Finance Intelligence.Mateusz Klimaszewski, Pinzhen Chen, Liane Guillou, Ioannis Papaioannou, Barry Haddow, Alexandra Birch
2025EMNLPXL-Suite: Cross-Lingual Synthetic Training and Evaluation Data for Open-Ended Generation.Vivek Iyer, Pinzhen Chen, Ricardo Rei, Alexandra Birch
2025NAACLFine-Tuning Large Language Models with Sequential Instructions.Hanxu Hu, Simon Yu, Pinzhen Chen, Edoardo M. Ponti
2024COLINGEEE-QA: Exploring Effective and Efficient Question-Answer Representations.Zhanghao Hu, Yijun Yang, Junjie Xu, Yifu Qiu, Pinzhen Chen
2024EACLMonolingual or Multilingual Instruction Tuning: Which Makes a Better Alpaca.Pinzhen Chen, Shaoxiong Ji, Nikolay Bogoychev, Andrey Kutuzov, Barry Haddow, Kenneth Heafield
2024EAMTHPLT's First Release of Data and Models.Nikolay Arefyev, Mikko Aulamo, Pinzhen Chen, Ona De Gibert Bonet, Barry Haddow, Jindrich Helcl, Bhavitvya Malik, Gema Ramrez-Snchez, Pavel Stepachev, Jrg Tiedemann, Dusan Varis, Jaume Zaragoza-Bernabeu
2024EAMTIterative Translation Refinement with Large Language Models.Pinzhen Chen, Zhicheng Guo, Barry Haddow, Kenneth Heafield
2024EMNLPIs It Good Data for Multilingual Instruction Tuning or Just Bad Multilingual Evaluation for Large Language Models?Pinzhen Chen, Simon Yu, Zhicheng Guo, Barry Haddow
2024EMNLPFine-Tuning Large Language Models to Translate: Will a Touch of Noisy Data in Misaligned Languages Suffice?Dawei Zhu, Pinzhen Chen, Miaoran Zhang, Barry Haddow, Xiaoyu Shen, Dietrich Klakow
2024ICASSPRegarding Topology and Adaptability in Differentiable WFST-Based E2E ASR.Zeyu Zhao, Pinzhen Chen, Peter Bell
2024NAACLUniArk: Improving Generalisation and Consistency for Factual Knowledge Extraction through Debiasing.Yijun Yang, Jie He, Pinzhen Chen, Vctor Gutirrez-Basulto, Jeff Z. Pan
2023EACLExploring Data Augmentation for Code Generation Tasks.Pinzhen Chen, Gerasimos Lampouras
2023EMNLPPMIndiaSum: Multilingual and Cross-lingual Headline Summarization for Languages in India.Ashok Urlana, Pinzhen Chen, Zheng Zhao, Shay B. Cohen, Manish Shrivastava, Barry Haddow
2022IJCNLPA Unified Model for Reverse Dictionary and Definition Modelling.Pinzhen Chen, Zheng Zhao
2022PACLICApproaching Neural Chinese Word Segmentation as a Low-Resource Machine Translation Task.Pinzhen Chen, Kenneth Heafield
2020ACLParaCrawl: Web-Scale Acquisition of Parallel Corpora.Marta Ban, Pinzhen Chen, Barry Haddow, Kenneth Heafield, Hieu Hoang, Miquel Espl-Gomis, Mikel L. Forcada, Amir Kamran, Faheem Kirefu, Philipp Koehn, Sergio Ortiz-Rojas, Leopoldo Pla Sempere, Gema Ramrez-Snchez, Elsa Sarras, Marek Strelec, Brian Thompson, William Waites, Dion Wiggins, Jaume Zaragoza
2020ACLParallel Sentence Mining by Constrained Decoding.Pinzhen Chen, Nikolay Bogoychev, Kenneth Heafield, Faheem Kirefu