Fajri Koto
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
48
Venues
13
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
48 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Multilingual Idioms in Sentences and Conversations Across High-, Medium-, and Low-Resource Languages. | Saeed Almheiri, Bilal Elbouardi, Salsabila Zahirah Pranida, Irina Nikishina, Ashwath Rao, Parameswari Krishnamurthy, Muhammad Cendekia Airlangga, Rifo Ahmad Genadi, Nguyen Phan Gia Bao, Amir Hossein Yari, Hawau Olamide Toyin, Nurdaulet Mukhituly, Mena Attia, Besher Hassan, Ahmad Fathan Hidayatullah, Tatsuki Kuribayashi, Haonan Li, Suma Bhat, Fajri Koto |
| 2026 | ACL | Macaron: Controlled, Human-Written Benchmark for Multilingual and Multicultural Reasoning via Template-Filling. | Alaa Elsetohy, Sama Hadhoud, Haryo Akbarianto Wibowo, Chenxi Whitehouse, Genta Indra Winata, Fajri Koto, Alham Fikri Aji |
| 2026 | ACL | Preserving Fairness and Safety in Quantized LLMs Through Critical Weight Protection. | Muhammad Alif Al Hakim, Alfan Farizki Wicaksono, Fajri Koto |
| 2026 | ACL | Controlling Distributional Bias in Multi-Round LLM Generation via KL-Optimized Fine-Tuning. | Yanbei Jiang, Amr Keleg, Ryandito Diandaru, Jey Han Lau, Lea Frermann, Biaoyan Fang, Fajri Koto |
| 2026 | ACL | Cultural Benchmarking of LLMs in Standard and Dialectal Arabic Dialogues. | Muhammad Dehan Al Kautsar, Saeed Almheiri, Momina Ahsan, Bilal Elbouardi, Younes Samih, Sarfraz Ahmad, Amr Keleg, Omar El Herraoui, Kareem Elzeky, Abed Alhakim Freihat, Mohamed Anwar, Zhuohan Xie, Junhong Liang, Mohammad Rustom Al Nasar, Preslav Nakov, Fajri Koto |
| 2026 | ACL | Stereotype Bias in a Bilingual Setting: A Culturally Grounded Evaluation in Kazakhstan. | Nurkhan Laiyk, Daniil Orel, Ayana Mussabayeva, Maiya Goloburda, Kamila Kuishibekova, Liya Goloburda, Diana Turmakhan, Preslav Nakov, Yuxia Wang, Fajri Koto |
| 2026 | ACL | Instruction-Guided Poetry Generation in Arabic and Its Dialects. | Abdelrahman Boda Sadallah, Kareem Ashraf Elozeiri, Mervat Abassy, Rania Elbadry, Mohamed Anwar, Abed Alhakim Freihat, Preslav Nakov, Fajri Koto |
| 2026 | ACL | FinChain: A Symbolic Benchmark for Verifiable Chain-of-Thought Financial Reasoning. | Zhuohan Xie, Daniil Orel, Rushil Thareja, Dhruv Sahnan, Hachem Madmoun, Fan Zhang, Debopriyo Banerjee, Georgi Nenkov Georgiev, Xueqing Peng, Lingfei Qian, Jimin Huang, Jinyan Su, Aaryamonvikram Singh, Rui Xing, Rania Elbadry, Chen Xu, Haonan Li, Fajri Koto, Ivan Koychev, Tanmoy Chakraborty, Yuxia Wang, Salem Lahlou, Veselin Stoyanov, Sophia Ananiadou, Preslav Nakov |
| 2026 | ACL | Revisiting Metric Reliability for Fine-grained Evaluation of Machine Translation and Summarization in Indian Languages. | Amir Hossein Yari, Kalmit Kulkarni, Ahmad Raza Khan, Fajri Koto |
| 2026 | AIED | Evaluating Vision-Language and Large Language Models for Automated Student Assessment in Indonesian Classrooms. | Nurul Aisyah, Muhammad Dehan Al Kautsar, Arif Hidayat, Raqib Chowdhury, Fajri Koto |
| 2026 | EACL | Nanda Family: Open-Weights Generative Large Language Models for Hindi. | Aaryamonvikram Singh, Debopriyo Banerjee, Dhruv Sahnan, Monojit Choudhury, Shivam Chauhan, Rocktim Jyoti Das, Xudong Han, Haonan Li, Alok Anil Jadhav, Utkarsh Agarwal, Mukund Choudhary, Fajri Koto, Junaid Bhat, Awantika Shukla, Samujjwal Ghosh, Samta Kamboj, Onkar Pandit, Lalit Pradhan, Rahul Pal, Sunil Kumar Sahu, Parvez Mullah, Ali El Filali, Zainul Abedien Ahmed Quraishi, Neha Sengupta, Gokul Ramakrishnan, Rituraj Joshi, Gurpreet Gosal, Avraham Sheinin, Natalia Vassilieva, Preslav Nakov |
| 2026 | EACL | LLMs as Cultural Archives: Cultural Commonsense Knowledge Graph Extraction. | Junior Cedric Tonga, Chen Cecilia Liu, Iryna Gurevych, Fajri Koto |
| 2025 | ACL | Crowdsource, Crawl, or Generate? Creating SEA-VL, a Multicultural Vision-Language Dataset for Southeast Asia. | Samuel Cahyawijaya, Holy Lovenia, Joel Ruben Antony Moniz, Tack Hwa Wong, Mohammad Rifqi Farhansyah, Thant Thiri Maung, Frederikus Hudi, David Anugraha, Muhammad Ravi Shulthan Habibi, Muhammad Reza Qorib, Amit Agarwal, Joseph Marvin Imperial, Hitesh Laxmichand Patel, Vicky Feliren, Bahrul Ilmi Nasution, Manuel Antonio Rufino, Genta Indra Winata, Rian Adam Rajagede, Carlos Rafael Catalan, Mohamed Fazli Mohamed Imam, Priyaranjan Pattnayak, Salsabila Zahirah Pranida, Kevin Pratama, Yeshil Bangera, Adisai Na-Thalang, Patricia Nicole Monderin, Yueqi Song, Christian Simon, Lynnette Hui Xian Ng, Richardy Lobo' Sapan, Taki Hasan Rafi, Bin Wang, Supryadi, Kanyakorn Veerakanjana, Piyalitt Ittichaiwong, Matthew Theodore Roque, Karissa Vincentio, Takdanai Kreangphet, Phakphum Artkaew, Kadek Hendrawan Palgunadi, Yanzhi Yu, Rochana Prih Hastuti, William Nixon, Mithil Bangera, Adrian Xuan Wei Lim, Aye Hninn Khine, Hanif Muhammad Zhafran, Teddy Ferdinan, Audra Aurora Izzani, Ayushman Singh, Evan, Jauza Akbar Krito, Michael Anugraha, Fenal Ashokbhai Ilasariya, Haochen Li, John Amadeo Daniswara, Filbert Aurelian Tjiaranata, Eryawan Presma Yulianrifat, Can Udomcharoenchaikit, Fadil Risdian Ansori, Mahardika Krisna Ihsani, Giang Nguyen, Anab Maulana Barik, Dan John Velasco, Rifo Ahmad Genadi, Saptarshi Saha, Chengwei Wei, Isaiah Edri W. Flores, Kenneth Ko Han Chen, Anjela Gail Santos, Wan Shen Lim, Kaung Si Phyo, Tim Santos, Meisyarah Dwiastuti, Jiayun Luo, Jan Christian Blaise Cruz, Ming Shan Hee, Ikhlasul Akmal Hanif, M. Alif Al Hakim, Muhammad Rizky Sya'ban, Kun Kerdthaisong, Lester James Validad Miranda, Fajri Koto, Tirana Noor Fatyanosa, Alham Fikri Aji, Jostin Jerico Rosal, Jun Kevin, Robert Wijaya, Onno P. Kampman, Ruochen Zhang, Brje F. Karlsson, Peerat Limkonchotiwat |
| 2025 | ACL | Qorǵau: Evaluating Safety in Kazakh-Russian Bilingual Contexts. | Maiya Goloburda, Nurkhan Laiyk, Diana Turmakhan, Yuxia Wang, Mukhammed Togmanov, Jonibek Mansurov, Askhat Sametov, Nurdaulet Mukhituly, Minghan Wang, Daniil Orel, Zain Muhammad Mujahid, Fajri Koto, Timothy Baldwin, Preslav Nakov |
| 2025 | ACL | Instruction Tuning on Public Government and Cultural Data for Low-Resource Language: a Case Study in Kazakh. | Nurkhan Laiyk, Daniil Orel, Rituraj Joshi, Maiya Goloburda, Yuxia Wang, Preslav Nakov, Fajri Koto |
| 2025 | ACL | Commonsense Reasoning in Arab Culture. | Abdelrahman Boda Sadallah, Junior Cedric Tonga, Khalid Almubarak, Saeed Almheiri, Farah Atif, Chatrine Qwaider, Karima Kadaoui, Sara Shatnawi, Yaser Alesh, Fajri Koto |
| 2025 | ACL | KazMMLU: Evaluating Language Models on Kazakh, Russian, and Regional Knowledge of Kazakhstan. | Mukhammed Togmanov, Nurdaulet Mukhituly, Diana Turmakhan, Jonibek Mansurov, Maiya Goloburda, Akhmed Sakip, Zhuohan Xie, Yuxia Wang, Bekassyl Syzdykov, Nurkhan Laiyk, Alham Fikri Aji, Ekaterina Kochmar, Preslav Nakov, Fajri Koto |
| 2025 | ACL | Unveiling Cultural Blind Spots: Analyzing the Limitations of mLLMs in Procedural Text Comprehension. | Amir Hossein Yari, Fajri Koto |
| 2025 | EMNLP | Cross-Cultural Transfer of Commonsense Reasoning in LLMs: Evidence from the Arab World. | Saeed Almheiri, Rania Elbadry, Mena Attia, Chenxi Wang, Preslav Nakov, Timothy Baldwin, Fajri Koto |
| 2025 | EMNLP | IndoSafety: Culturally Grounded Safety for LLMs in Indonesian Languages. | Muhammad Falensi Azmi, Muhammad Dehan Al Kautsar, Alfan Farizki Wicaksono, Fajri Koto |
| 2025 | EMNLP | What Do Indonesians Really Need from Language Technology? A Nationwide Survey. | Muhammad Dehan Al Kautsar, Lucky Susanto, Derry Tanti Wijaya, Fajri Koto |
| 2025 | ICLR | INCLUDE: Evaluating Multilingual Language Understanding with Regional Knowledge. | Angelika Romanou, Negar Foroutan, Anna Sotnikova, Zeming Chen, Sree Harsha Nelaturu, Shivalika Singh, Rishabh Maheshwary, Micol Altomare, Mohamed A. Haggag, Imanol Schlag, Marzieh Fadaee, Sara Hooker, Antoine Bosselut, Snegha A, Alfonso Amayuelas, Azril Hafizi Amirudin, Viraat Aryabumi, Danylo Boiko, Michael Chang, Jenny Chim, Gal Cohen, Aditya Kumar Dalmia, Abraham Diress, Sharad Duwal, Daniil Dzenhaliou, Daniel Fernando Erazo Florez, Fabian Farestam, Joseph Marvin Imperial, Shayekh Bin Islam, Perttu Isotalo, Maral Jabbarishiviari, Brje F. Karlsson, Eldar Khalilov, Christopher Klamm, Fajri Koto, Dominik Krzeminski, Gabriel Adriano de Melo, Syrielle Montariol, Yiyang Nan, Joel Niklaus, Jekaterina Novikova, Johan Samir Obando-Ceron, Debjit Paul, Esther Ploeger, Jebish Purbey, Swati Rajwal, Selvan Sunitha Ravi, Sara Rydell, Roshan Santhosh, Drishti Sharma, Marjana Prifti Skenduli, Arshia Soltani Moakhar, Bardia Soltani Moakhar, Ran Tamir, Ayush Kumar Tarun, Azmine Toushik Wasi, Thenuka Ovin Weerasinghe, Serhan Yilmaz, Mike Zhang |
| 2025 | IJCNLP | Role-Aware Language Models for Secure and Contextualized Access Control in Organizations. | Saeed Almheiri, Yerulan Kongrat, Adrian Santosh, Ruslan Tasmukhanov, Josemaria Vera, Muhammad Dehan Al Kautsar, Fajri Koto |
| 2025 | NAACL | Cracking the Code: Multi-domain LLM Evaluation on Real-World Professional Exams in Indonesia. | Fajri Koto |
| 2025 | NAACL | Libra-Leaderboard: Towards Responsible AI through a Balanced Leaderboard of Safety and Capability. | Haonan Li, Xudong Han, Zenan Zhai, Honglin Mu, Hao Wang, Zhenxuan Zhang, Yilin Geng, Shom Lin, Renxi Wang, Artem Shelmanov, Xiangyu Qi, Yuxia Wang, Donghai Hong, Youliang Yuan, Meng Chen, Haoqin Tu, Fajri Koto, Cong Zeng, Tatsuki Kuribayashi, Rishabh Bhardwaj, Bingchen Zhao, Yawen Duan, Yi Liu, Emad A. Alghamdi, Yaodong Yang, Yinpeng Dong, Soujanya Poria, Pengfei Liu, Zhengzhong Liu, Xuguang Ren, Eduard H. Hovy, Iryna Gurevych, Preslav Nakov, Monojit Choudhury, Timothy Baldwin |
| 2024 | ACL | CMMLU: Measuring massive multitask language understanding in Chinese. | Haonan Li, Yixuan Zhang, Fajri Koto, Yifei Yang, Hai Zhao, Yeyun Gong, Nan Duan, Timothy Baldwin |
| 2024 | ACL | Cendol: Open Instruction-tuned Generative Large Language Models for Indonesian Languages. | Samuel Cahyawijaya, Holy Lovenia, Fajri Koto, Rifki Afina Putri, Tjeng Wawan Cenggoro, Jhonson Lee, Salsabil Maulana Akbar, Emmanuel Dave, Nuur Shadieq, Muhammad Ihza Mahendra, Dea Annisayanti Putri, Bryan Wilie, Genta Indra Winata, Alham Fikri Aji, Ayu Purwarianti, Pascale Fung |
| 2024 | ACL | ArabicMMLU: Assessing Massive Multitask Language Understanding in Arabic. | Fajri Koto, Haonan Li, Sara Shatnawi, Jad Doughman, Abdelrahman Boda Sadallah, Aisha Alraeesi, Khalid Almubarak, Zaid Alyafeai, Neha Sengupta, Shady Shehata, Nizar Habash, Preslav Nakov, Timothy Baldwin |
| 2024 | EACL | Zero-shot Sentiment Analysis in Low-Resource Languages Using a Multilingual Sentiment Lexicon. | Fajri Koto, Tilman Beck, Zeerak Talat, Iryna Gurevych, Timothy Baldwin |
| 2024 | EMNLP | SEACrowd: A Multilingual Multimodal Data Hub and Benchmark Suite for Southeast Asian Languages. | Holy Lovenia, Rahmad Mahendra, Salsabil Maulana Akbar, Lester James V. Miranda, Jennifer Santoso, Elyanah Aco, Akhdan Fadhilah, Jonibek Mansurov, Joseph Marvin Imperial, Onno Kampman, Joel Ruben Antony Moniz, Muhammad Ravi Shulthan Habibi, Frederikus Hudi, Jann Railey Montalan, Ryan Hadiwijaya, Joanito Agili Lopo, William Nixon, Brje Karlsson, James Jaya, Ryandito Diandaru, Yuze Gao, Patrick Amadeus Irawan, Bin Wang, Jan Christian Blaise Cruz, Chenxi Whitehouse, Ivan Halim Parmonangan, Maria Khelli, Wenyu Zhang, Lucky Susanto, Reynard Adha Ryanda, Sonny Lazuardi Hermawan, Dan John Velasco, Muhammad Dehan Al Kautsar, Willy Fitra Hendria, Yasmin Moslem, Noah Flynn, Muhammad Farid Adilazuarda, Haochen Li, Johanes Lee, R. Damanhuri, Shuo Sun, Muhammad Reza Qorib, Amirbek Djanibekov, Wei Qi Leong, Quyet V. Do, Niklas Muennighoff, Tanrada Pansuwan, Ilham Firdausi Putra, Yan Xu, Ngee Tai Chia, Ayu Purwarianti, Sebastian Ruder, William-Chandra Tjhi, Peerat Limkonchotiwat, Alham Fikri Aji, Sedrick Keh, Genta Indra Winata, Ruochen Zhang, Fajri Koto, Zheng Xin Yong, Samuel Cahyawijaya |
| 2024 | NAACL | Are Multilingual LLMs Culturally-Diverse Reasoners? An Investigation into Multicultural Proverbs and Sayings. | Chen Liu, Fajri Koto, Timothy Baldwin, Iryna Gurevych |
| 2023 | ACL | NusaCrowd: Open Source Initiative for Indonesian NLP Resources. | Samuel Cahyawijaya, Holy Lovenia, Alham Fikri Aji, Genta Indra Winata, Bryan Wilie, Fajri Koto, Rahmad Mahendra, Christian Wibisono, Ade Romadhony, Karissa Vincentio, Jennifer Santoso, David Moeljadi, Cahya Wirawan, Frederikus Hudi, Muhammad Satrio Wicaksono, Ivan Halim Parmonangan, Ika Alfina, Ilham Firdausi Putra, Samsul Rahmadani, Yulianti Oenang, Ali Akbar Septiandri, James Jaya, Kaustubh D. Dhole, Arie Ardiyanti Suryani, Rifki Afina Putri, Dan Su, Keith Stevens, Made Nindyatama Nityasya, Muhammad Farid Adilazuarda, Ryan Hadiwijaya, Ryandito Diandaru, Tiezheng Yu, Vito Ghifari, Wenliang Dai, Yan Xu, Dyah Damapuspita, Haryo Akbarianto Wibowo, Cuk Tho, Ichwanul Muslim Karo Karo, Tirana Fatyanosa, Ziwei Ji, Graham Neubig, Timothy Baldwin, Sebastian Ruder, Pascale Fung, Herry Sujaini, Sakriani Sakti, Ayu Purwarianti |
| 2023 | EACL | NusaX: Multilingual Parallel Sentiment Dataset for 10 Indonesian Local Languages. | Genta Indra Winata, Alham Fikri Aji, Samuel Cahyawijaya, Rahmad Mahendra, Fajri Koto, Ade Romadhony, Kemal Kurniawan, David Moeljadi, Radityo Eko Prasojo, Pascale Fung |
| 2023 | EMNLP | Large Language Models Only Pass Primary School Exams in Indonesia: A Comprehensive Test on IndoMMLU. | Fajri Koto, Nurul Aisyah, Haonan Li, Timothy Baldwin |
| 2023 | IJCNLP | NusaWrites: Constructing High-Quality Corpora for Underrepresented and Extremely Low-Resource Languages. | Samuel Cahyawijaya, Holy Lovenia, Fajri Koto, Dea Adhista, Emmanuel Dave, Sarah Oktavianti, Salsabil Maulana Akbar, Jhonson Lee, Nuur Shadieq, Tjeng Wawan Cenggoro, Hanung Wahyuning Linuwih, Bryan Wilie, Galih Pradipta Muridan, Genta Indra Winata, David Moeljadi, Alham Fikri Aji, Ayu Purwarianti, Pascale Fung |
| 2022 | ACL | One Country, 700+ Languages: NLP Challenges for Underrepresented Languages and Dialects in Indonesia. | Alham Fikri Aji, Genta Indra Winata, Fajri Koto, Samuel Cahyawijaya, Ade Romadhony, Rahmad Mahendra, Kemal Kurniawan, David Moeljadi, Radityo Eko Prasojo, Timothy Baldwin, Jey Han Lau, Sebastian Ruder |
| 2022 | COLING | LipKey: A Large-Scale News Dataset for Absent Keyphrases Generation and Abstractive Summarization. | Fajri Koto, Timothy Baldwin, Jey Han Lau |
| 2021 | ACL | Evaluating the Efficacy of Summarization Evaluation across Languages. | Fajri Koto, Jey Han Lau, Timothy Baldwin |
| 2021 | EACL | Top-down Discourse Parsing via Sequence Labelling. | Fajri Koto, Jey Han Lau, Timothy Baldwin |
| 2021 | EMNLP | IndoBERTweet: A Pretrained Language Model for Indonesian Twitter with Effective Domain-Specific Vocabulary Initialization. | Fajri Koto, Jey Han Lau, Timothy Baldwin |
| 2021 | NAACL | Discourse Probing of Pretrained Language Models. | Fajri Koto, Jey Han Lau, Timothy Baldwin |
| 2020 | COLING | IndoLEM and IndoBERT: A Benchmark Dataset and Pre-trained Language Model for Indonesian NLP. | Fajri Koto, Afshin Rahimi, Jey Han Lau, Timothy Baldwin |
| 2020 | IJCNLP | Liputan6: A Large-scale Indonesian Dataset for Text Summarization. | Fajri Koto, Jey Han Lau, Timothy Baldwin |
| 2020 | PACLIC | Towards Computational Linguistics in Minangkabau Language: Studies on Sentiment Analysis and Machine Translation. | Fajri Koto, Ikhwan Koto |
| 2016 | LREC | A Publicly Available Indonesian Corpora for Automatic Abstractive and Extractive Chat Summarization. | Fajri Koto |
| 2015 | AINA | The Use of POS Sequence for Analyzing Sentence Pattern in Twitter Sentiment Analysis. | Fajri Koto, Mirna Adriani |
| 2015 | NLDB | A Comparative Study on Twitter Sentiment Analysis: Which Features are Good? | Fajri Koto, Mirna Adriani |
| 2015 | SP | A Study on Natural Expressive Speech: Automatic Memorable Spoken Quote Detection. | Fajri Koto, Sakriani Sakti, Graham Neubig, Tomoki Toda, Mirna Adriani, Satoshi Nakamura |