Thamar Solorio
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
81
Venues
18
Active years
2004–2026
Best venue rank
A*
Where they publish
Papers
81 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Towards Fast and Accurate Modeling for Cross-Lingual Label Projection. | Thang Le, Huy Huu Nguyen, Anh Tuan Luu, Thamar Solorio, Thien Huu Nguyen |
| 2026 | ACL | Afri-MCQA: Multimodal Cultural Question Answering for African Languages. | Atnafu Lambebo Tonja, Srija Anand, Emilio Villa-Cueva, Israel Abebe Azime, Jesujoba Oluwadara Alabi, Muhidin Mohamed, Debela Desalegn Yadeta, Negasi Haile Abadi, Abigail Oppong, Nnaemeka Casmir Obiefuna, Idris Abdulmumin, Naome A. Etori, Eric Peter Wairagala, Kanda Patrick Tshinu, Imanigirimbabazi Emmanuel, Gabofetswe Malema, Alham Fikri Aji, David Ifeoluwa Adelani, Thamar Solorio |
| 2026 | EACL | Beyond Understanding: Evaluating the Pragmatic Gap in LLMs' Cultural Processing of Figurative Language. | Mena Attia, Aashiq Muhamed, Mai Alkhamissi, Thamar Solorio, Mona T. Diab |
| 2026 | EACL | A Scalable Framework for Automated NER Annotation Correction in Low-Resource Languages. | Toqeer Ehsan, Thamar Solorio |
| 2026 | LREC | Benchmarking Arabic Authorship Attribution and Style Transfer with Large Language Models. | Injy Hamed, Bashar Alhafni, Nizar Habash, Thamar Solorio |
| 2025 | AAAI | Why AI Is WEIRD and Shouldn't Be This Way: Towards AI for Everyone, with Everyone, by Everyone. | Rada Mihalcea, Oana Ignat, Longju Bai, Angana Borah, Luis Chiruzzo, Zhijing Jin, Claude Kwizera, Joan Nwatu, Soujanya Poria, Thamar Solorio |
| 2025 | COLING | A Survey of Code-switched Arabic NLP: Progress, Challenges, and Future Directions. | Injy Hamed, Caroline Sabty, Slim Abdennadher, Ngoc Thang Vu, Thamar Solorio, Nizar Habash |
| 2025 | CVPR | All Languages Matter: Evaluating LMMs on Culturally Diverse 100 Languages. | Ashmal Vayani, Dinura Dissanayake, Hasindri Watawana, Noor Ahsan, Nevasini Sasikumar, Omkar Thawakar, Henok Biadglign Ademtew, Yahya Hmaiti, Amandeep Kumar, Kartik Kuckreja, Mykola Maslych, Wafa Al Ghallabi, Mihail Minkov Mihaylov, Chao Qin, Abdelrahman M. Shaker, Mike Zhang, Mahardika Krisna Ihsani, Amiel Gian Esplana, Monil Gokani, Shachar Mirkin, Harsh Singh, Ashay Srivastava, Endre Hamerlik, Fathinah Asma Izzati, Fadillah Adamsyah Maani, Sebastian Cavada, Jenny Chim, Rohit Gupta, Sanjay Manjunath, Kamila Zhumakhanova, Feno Heriniaina Rabevohitra, Azril Hafizi Amirudin, Muhammad Ridzuan, Daniya Najiha Abdul Kareem, Ketan Pravin More, Kunyang Li, Pramesh Shakya, Muhammad Saad, Amirpouya Ghasemaghaei, Amirbek Djanibekov, Dilshod Azizov, Branislava Jankovic, Naman Bhatia, Alvaro Cabrera, Johan S. Obando-Ceron, Olympiah Otieno, Fabian Farestam, Muztoba Rabbani, Sanoojan Baliah, Santosh Sanjeev, Abduragim Shtanchaev, Maheen Fatima, Thao Nguyen, Amrin Kareem, Toluwani Aremu, Nathan Augusto Zacarias Xavier, Amit Bhatkal, Hawau Olamide Toyin, Aman Chadha, Hisham Cholakkal, Rao Muhammad Anwer, Michael Felsberg, Jorma Laaksonen, Thamar Solorio, Monojit Choudhury, Ivan Laptev, Mubarak Shah, Salman H. Khan, Fahad Shahbaz Khan |
| 2025 | EMNLP | MoMentS: A Comprehensive Multimodal Benchmark for Theory of Mind. | Emilio Villa-Cueva, S. M. Masrur Ahmed, Rendi Chevi, Jan Christian Blaise Cruz, Kareem Elzeky, Fermin Cristobal, Alham Fikri Aji, Skyler Wang, Rada Mihalcea, Thamar Solorio |
| 2025 | EMNLP | CaMMT: Benchmarking Culturally Aware Multimodal Machine Translation. | Emilio Villa-Cueva, Sholpan Bolatzhanova, Diana Turmakhan, Kareem Elzeky, Henok Biadglign Ademtew, Alham Fikri Aji, Vladimir Araujo, Israel Abebe Azime, Jinheon Baek, Frederico Belcavello, Fermin Cristobal, Jan Christian Blaise Cruz, Mary Dabre, Raj Dabre, Toqeer Ehsan, Naome A. Etori, Fauzan Farooqui, Jiahui Geng, Guido Ivetta, Thanmay Jayakumar, Soyeong Jeong, Zheng Wei Lim, Aishik Mandal, Sofa Martinelli, Mihail Minkov Mihaylov, Daniil Orel, Aniket Pramanick, Sukannya Purkayastha, Israfel Salazar, Haiyue Song, Tiago Timponi Torrent, Debela Desalegn Yadeta, Injy Hamed, Atnafu Lambebo Tonja, Thamar Solorio |
| 2025 | Interspeech | CS-FLEURS: A Massively Multilingual and Code-Switched Speech Dataset. | Brian Yan, Injy Hamed, Shuichiro Shimizu, Vasista Sai Lodagala, William Chen, Olga Iakovenko, Bashar Talafha, Amir Hussein, Alexander Polok, Kalvin Chang, Dominik Klement, Sara Althubaiti, Puyuan Peng, Matthew Wiesner, Thamar Solorio, Ahmed Ali, Sanjeev Khudanpur, Shinji Watanabe |
| 2025 | NAACL | ProverbEval: Exploring LLM Evaluation Challenges for Low-resource Language Understanding. | Israel Abebe Azime, Atnafu Lambebo Tonja, Tadesse Destaw Belay, Yonas Chanie, Bontu Fufa Balcha, Negasi Haile Abadi, Henok Biadglign Ademtew, Mulubrhan Abebe Nerea, Debela Desalegn Yadeta, Derartu Dagne Geremew, Assefa Atsbiha tesfau, Philipp Slusallek, Thamar Solorio, Dietrich Klakow |
| 2024 | ACL | Question-Instructed Visual Descriptions for Zero-Shot Video Answering. | David Mogrovejo, Thamar Solorio |
| 2024 | ACL | SemRel2024: A Collection of Semantic Textual Relatedness Datasets for 13 Languages. | Nedjma Ousidhoum, Shamsuddeen Hassan Muhammad, Mohamed Abdalla, Idris Abdulmumin, Ibrahim Said Ahmad, Sanchit Ahuja, Alham Fikri Aji, Vladimir Araujo, Abinew Ali Ayele, Pavan Baswani, Meriem Beloucif, Chris Biemann, Sofia Bourhim, Christine de Kock, Genet Shanko Dekebo, Oumaima Hourrane, Gopichand Kanumolu, Lokesh Madasu, Samuel Rutunda, Manish Shrivastava, Thamar Solorio, Nirmal Surange, Hailegnaw Getaneh Tilaye, Krishnapriya Vishnubhotla, Genta Indra Winata, Seid Muhie Yimam, Saif M. Mohammad |
| 2024 | COLING | Labeling Comic Mischief Content in Online Videos with a Multimodal Hierarchical-Cross-Attention Model. | Elaheh Baharlouei, Mahsa Shafaei, Yigeng Zhang, Hugo Jair Escalante, Thamar Solorio |
| 2024 | COLING | OATS: A Challenge Dataset for Opinion Aspect Target Sentiment Joint Detection for Aspect-Based Sentiment Analysis. | Siva Uday Sampreeth Chebolu, Franck Dernoncourt, Nedim Lipka, Thamar Solorio |
| 2024 | COLING | Interpreting Themes from Educational Stories. | Yigeng Zhang, Fabio A. Gonzlez, Thamar Solorio |
| 2024 | COLING | Positive and Risky Message Assessment for Music Products. | Yigeng Zhang, Mahsa Shafaei, Fabio Gonzalez, Thamar Solorio |
| 2024 | EMNLP | The Zeno's Paradox of 'Low-Resource' Languages. | Hellina Hailu Nigatu, Atnafu Lambebo Tonja, Benjamin Rosman, Thamar Solorio, Monojit Choudhury |
| 2024 | NAACL | NLP Progress in Indigenous Latin American Languages. | Atnafu Lambebo Tonja, Fazlourrahman Balouchzahi, Sabur Butt, Olga Kolesnikova, Hector G. Ceballos, Alexander F. Gelbukh, Thamar Solorio |
| 2024 | NAACL | Adaptive Cross-lingual Text Classification through In-Context One-Shot Demonstrations. | Emilio Villa-Cueva, Adrin Pastor Lpez-Monroy, Fernando Snchez-Vega, Thamar Solorio |
| 2023 | ACL | The Decades Progress on Code-Switching Research in NLP: A Systematic Survey on Trends and Challenges. | Genta Indra Winata, Alham Fikri Aji, Zheng Xin Yong, Thamar Solorio |
| 2023 | EACL | Distillation of encoder-decoder transformers for sequence labelling. | Marco Farina, Duccio Pappadopulo, Anant Gupta, Leslie Huang, Ozan Irsoy, Thamar Solorio |
| 2023 | IJCNLP | A Review of Datasets for Aspect-based Sentiment Analysis. | Siva Uday Sampreeth Chebolu, Franck Dernoncourt, Nedim Lipka, Thamar Solorio |
| 2022 | EMNLP | Style Transfer as Data Augmentation: A Case Study on Named Entity Recognition. | Shuguang Chen, Leonardo Neves, Thamar Solorio |
| 2022 | IJCNLP | Cross-lingual Few-Shot Learning on Unseen Languages. | Genta Indra Winata, Shijie Wu, Mayank Kulkarni, Thamar Solorio, Daniel Preotiuc-Pietro |
| 2021 | ACL | PSED: A Dataset for Selecting Emphasis in Presentation Slides. | Amirreza Shirani, Giai Tran, Hieu Trinh, Franck Dernoncourt, Nedim Lipka, Jose Echevarria, Thamar Solorio, Paul Asente |
| 2021 | EMNLP | Char2Subword: Extending the Subword Embedding Space Using Robust Character Compositionality. | Gustavo Aguilar, Bryan McCann, Tong Niu, Nazneen Rajani, Nitish Shirish Keskar, Thamar Solorio |
| 2021 | EMNLP | Data Augmentation for Cross-Domain Named Entity Recognition. | Shuguang Chen, Gustavo Aguilar, Leonardo Neves, Thamar Solorio |
| 2021 | EMNLP | From None to Severe: Predicting Severity in Movie Scripts. | Yigeng Zhang, Mahsa Shafaei, Fabio A. Gonzlez, Thamar Solorio |
| 2021 | ISM | Identifying Keyword Predictors in Lecture Video Screen Text. | Farah Naz Chowdhury, Raga Shalini Koka, Mohammad Rajiur Rahman, Thamar Solorio, Jaspal Subhlok |
| 2021 | PACLIC | Exploring Conditional Text Generation for Aspect-Based Sentiment Analysis. | Siva Uday Sampreeth Chebolu, Franck Dernoncourt, Nedim Lipka, Thamar Solorio |
| 2021 | RANLP | A Case Study of Deep Learning-Based Multi-Modal Methods for Labeling the Presence of Questionable Content in Movie Trailers. | Mahsa Shafaei, Christos Smailis, Ioannis A. Kakadiaris, Thamar Solorio |
| 2020 | ACL | From English to Code-Switching: Transfer Learning with Strong Morphological Clues. | Gustavo Aguilar, Thamar Solorio |
| 2020 | ACL | Let Me Choose: From Verbal Context to Font Selection. | Amirreza Shirani, Franck Dernoncourt, Jose Echevarria, Paul Asente, Nedim Lipka, Thamar Solorio |
| 2020 | EMNLP | Multi-view Story Characterization from Movie Plot Synopses and Reviews. | Sudipta Kar, Gustavo Aguilar, Mirella Lapata, Thamar Solorio |
| 2020 | ISM | Automatic Identification of Keywords in Lecture Video Segments. | Raga Shalini Koka, Farah Naz Chowdhury, Mohammad Rajiur Rahman, Thamar Solorio, Jaspal Subhlok |
| 2020 | LREC | LinCE: A Centralized Benchmark for Linguistic Code-switching Evaluation. | Gustavo Aguilar, Sudipta Kar, Thamar Solorio |
| 2020 | LREC | Age Suitability Rating: Predicting the MPAA Rating Based on Movie Dialogues. | Mahsa Shafaei, Niloofar Safi Samghabadi, Sudipta Kar, Thamar Solorio |
| 2019 | ACL | Learning Emphasis Selection for Written Text in Visual Media from Crowd-Sourced Label Distributions. | Amirreza Shirani, Franck Dernoncourt, Paul Asente, Nedim Lipka, Seokhwan Kim, Jose Echevarria, Thamar Solorio |
| 2019 | FlAIRS | Exploiting Textual, Visual, and Product Features for Predicting the Likeability of Movies. | Mahsa Shafaei, Adrin Pastor Lpez-Monroy, Thamar Solorio |
| 2019 | RANLP | Jointly Learning Author and Annotated Character N-gram Embeddings: A Case Study in Literary Text. | Suraj Maharjan, Deepthi Mave, Prasha Shrestha, Manuel Montes-y-Gmez, Fabio Augusto Gonzlez Osorio, Thamar Solorio |
| 2018 | AAAI | Evaluation of Type Inference with Textual Cues. | Amirreza Shirani, Adrin Pastor Lpez-Monroy, Fabio A. Gonzlez, Thamar Solorio, Mohammad Amin Alipour |
| 2018 | COLING | Folksonomication: Predicting Tags for Movies from Plot Synopses using Emotion Flow Encoded Neural Network. | Sudipta Kar, Suraj Maharjan, Thamar Solorio |
| 2018 | COLING | RiTUAL-UH at TRAC 2018 Shared Task: Aggression Identification. | Niloofar Safi Samghabadi, Deepthi Mave, Sudipta Kar, Thamar Solorio |
| 2018 | EMNLP | A Genre-Aware Attention Model to Improve the Likability Prediction of Books. | Suraj Maharjan, Manuel Montes-y-Gmez, Fabio A. Gonzlez, Thamar Solorio |
| 2018 | LREC | MPST: A Corpus of Movie Plot Synopses with Tags. | Sudipta Kar, Suraj Maharjan, Adrin Pastor Lpez-Monroy, Thamar Solorio |
| 2018 | NAACL | Modeling Noisiness to Recognize Named Entities using Multitask Neural Networks on Social Media. | Gustavo Aguilar, Adrin Pastor Lpez-Monroy, Fabio Augusto Gonzlez Osorio, Thamar Solorio |
| 2018 | NAACL | Early Text Classification Using Multi-Resolution Concept Representations. | Adrin Pastor Lpez-Monroy, Fabio A. Gonzlez, Manuel Montes-y-Gmez, Hugo Jair Escalante, Thamar Solorio |
| 2018 | NAACL | Letting Emotions Flow: Success Prediction by Modeling the Flow of Emotions in Books. | Suraj Maharjan, Sudipta Kar, Manuel Montes-y-Gmez, Fabio A. Gonzlez, Thamar Solorio |
| 2017 | CICLING | Towards Translating Mixed-Code Comments from Social Media. | Thoudam Doren Singh, Thamar Solorio |
| 2017 | EACL | A Multi-task Approach to Predict Likability of Books. | Suraj Maharjan, John Edison Arevalo Ovalle, Manuel Montes-y-Gmez, Fabio A. Gonzlez, Thamar Solorio |
| 2017 | EACL | Convolutional Neural Networks for Authorship Attribution of Short Texts. | Prasha Shrestha, Sebastin Sierra, Fabio A. Gonzlez, Manuel Montes-y-Gmez, Paolo Rosso, Thamar Solorio |
| 2017 | ICLR | Gated Multimodal Units for Information Fusion. | John Edison Arevalo Ovalle, Thamar Solorio, Manuel Montes-y-Gmez, Fabio A. Gonzlez |
| 2016 | ACL | Domain Adaptation for Authorship Attribution: Improved Structural Correspondence Learning. | Upendra Sapkota, Thamar Solorio, Manuel Montes-y-Gmez, Steven Bethard |
| 2016 | CICLING | Large Scale Authorship Attribution of Online Reviews. | Prasha Shrestha, Arjun Mukherjee, Thamar Solorio |
| 2016 | Interspeech | Computational Approaches to Linguistic Code Switching. | Mona T. Diab, Pascale Fung, Julia Hirschberg, Thamar Solorio |
| 2016 | LREC | Age and Gender Prediction on Health Forum Data. | Prasha Shrestha, Nicolas Rey-Villamizar, Farig Sadeque, Ted Pedersen, Steven Bethard, Thamar Solorio |
| 2016 | NAACL | Semi-supervised CLPsych 2016 Shared Task System Submission. | Nicolas Rey-Villamizar, Prasha Shrestha, Thamar Solorio, Farig Sadeque, Steven Bethard, Ted Pedersen |
| 2015 | CICLING | Identification of Original Document by Using Textual Similarities. | Prasha Shrestha, Thamar Solorio |
| 2015 | NAACL | Not All Character N-grams Are Created Equal: A Study in Authorship Attribution. | Upendra Sapkota, Steven Bethard, Manuel Montes-y-Gmez, Thamar Solorio |
| 2014 | COLING | Cross-Topic Authorship Attribution: Will Out-Of-Topic Data Help? | Upendra Sapkota, Thamar Solorio, Manuel Montes-y-Gmez, Steven Bethard, Paolo Rosso |
| 2014 | LREC | Sockpuppet Detection in Wikipedia: A Corpus of Real-World Deceptive Writing for Linking Identities. | Thamar Solorio, Ragib Hasan, Mainul Mizan |
| 2013 | CICLING | The Use of Orthogonal Similarity Relations in the Prediction of Authorship. | Upendra Sapkota, Thamar Solorio, Manuel Montes-y-Gmez, Paolo Rosso |
| 2012 | Interspeech | Evaluating NLP Features for Automatic Prediction of Language Impairment Using Child Speech Transcripts. | Khairun-nisa Hassanali, Yang Liu, Thamar Solorio |
| 2011 | ACL | Local Histograms of Character N-grams for Authorship Attribution. | Hugo Jair Escalante, Thamar Solorio, Manuel Montes-y-Gmez |
| 2011 | IJCNLP | Modality Specific Meta Features for Authorship Attribution in Web Forum Posts. | Thamar Solorio, Sangita Pillay, Sindhu Raghavan, Manuel Montes-y-Gmez |
| 2010 | CCS | Lexical feature based phishing URL detection using online learning. | Aaron Blum, Brad Wardman, Thamar Solorio, Gary Warner |
| 2010 | IRI | A supervised machine learning approach of extracting coexpression relationship among genes from literature. | Richa Tiwari, Chengcui Zhang, Thamar Solorio |
| 2009 | NAACL | A Corpus-Based Approach for the Prediction of Language Impairment in Monolingual English and Spanish-English Bilingual Children. | Keyur Gabani, Melissa Sherman, Thamar Solorio, Yang Liu, Lisa Bedore, Elizabeth Pea |
| 2008 | EMNLP | Learning to Predict Code-Switching Points. | Thamar Solorio, Yang Liu |
| 2008 | EMNLP | Part-of-Speech Tagging for English-Spanish Code-Switched Text. | Thamar Solorio, Yang Liu |
| 2007 | CICLING | Baby-Steps Towards Building a Spanglish Language Model. | Juan Carlos Franco, Thamar Solorio |
| 2007 | NAACL | A Filter-Based Approach to Detect End-of-Utterances from Prosody in Dialog Systems. | Olac Fuentes, David Vera, Thamar Solorio |
| 2006 | CICLING | An Unsupervised Language Independent Method of Name Discrimination Using Second Order Co-occurrence Features. | Ted Pedersen, Anagha Kulkarni, Roxana Angheluta, Zornitsa Kozareva, Thamar Solorio |
| 2006 | Interspeech | Prosodic feature generation for back-channel prediction. | Thamar Solorio, Olac Fuentes, Nigel G. Ward, Yaffa Al Bayyari |
| 2005 | ACL | Exploiting Named Entity Taggers in a Second Language. | Thamar Solorio |
| 2005 | CICLING | Learning Named Entity Recognition in Portuguese from Spanish. | Thamar Solorio, Aurelio Lpez-Lpez |
| 2005 | CICLING | Question Classification in Spanish and Portuguese. | Thamar Solorio, Manuel Alberto Prez-Coutio, Manuel Montes-y-Gmez, Luis Villaseor-Pineda, Aurelio Lpez-Lpez |
| 2004 | CICLING | Learning Named Entity Classifiers Using Support Vector Machines. | Thamar Solorio, Aurelio Lpez-Lpez |
| 2004 | COLING | A Language Independent Method for Question Classification. | Thamar Solorio, Manuel Alberto Prez-Coutio, Manuel Montes-y-Gmez, Luis Villaseor-Pineda, Aurelio Lpez-Lpez |