Shafiq Joty
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
76
Venues
9
Active years
2023–2026
Best venue rank
A*
Where they publish
Papers
76 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | Lost in Translation: Do LVLM Judges Generalize Across Languages? | Md. Tahmid Rahman Laskar, Mohammed Saidul Islam, Mir Tafseer Nayeem, Amran Bhuiyan, Mizanur Rahman, Shafiq Joty, Enamul Hoque, Jimmy Huang |
| 2026 | ACL | Hard2Verify: A Step-Level Verification Benchmark for Open-Ended Frontier Math. | Shrey Pandit, Austin Xu, Xuan-Phi Nguyen, Yifei Ming, Caiming Xiong, Shafiq Joty |
| 2026 | ACL | Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction. | Zhenmei Shi, Yifei Ming, Xuan-Phi Nguyen, Yingyu Liang, Shafiq Joty |
| 2026 | ACL | J4R: Learning to Judge with Equivalent Initial State Group Relative Policy Optimization. | Austin Xu, Yilun Zhou, Xuan-Phi Nguyen, Caiming Xiong, Shafiq Joty |
| 2026 | EACL | DashboardQA: Benchmarking Multimodal Agents for Question Answering on Interactive Dashboards. | Aaryaman Kartha, Ahmed Masry, Mohammed Saidul Islam, Thinh Lang, Shadikur Rahman, Ridwan Mahbub, Mizanur Rahman, Mahir Ahmed, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty |
| 2026 | EACL | Aligning Text, Code, and Vision: A Multi-Objective Reinforcement Learning Framework for Text-to-Visualization. | Mizanur Rahman, Mohammed Saidul Islam, Md. Tahmid Rahman Laskar, Shafiq Joty, Enamul Hoque |
| 2025 | ACL | Why Vision Language Models Struggle with Visual Arithmetic? Towards Enhanced Chart and Geometry Understanding. | Kung-Hsiang Huang, Can Qin, Haoyi Qiu, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2025 | ACL | Judging the Judges: Can Large Vision-Language Models Fairly Evaluate Chart Comprehension and Reasoning? | Md. Tahmid Rahman Laskar, Mohammed Saidul Islam, Ridwan Mahbub, Ahmed Masry, Mizanur Rahman, Amran Bhuiyan, Mir Tafseer Nayeem, Shafiq Joty, Enamul Hoque, Jimmy Huang |
| 2025 | ACL | Can We Further Elicit Reasoning in LLMs? Critic-Guided Planning with Retrieval-Augmentation for Solving Challenging Tasks. | Xingxuan Li, Weiwen Xu, Ruochen Zhao, Fangkai Jiao, Shafiq Joty, Lidong Bing |
| 2025 | ACL | What Makes a Good Natural Language Prompt? | Do Xuan Long, Duy Dinh, Ngoc-Hai Nguyen, Kenji Kawaguchi, Nancy F. Chen, Shafiq Joty, Min-Yen Kan |
| 2025 | ACL | Beyond In-Context Learning: Aligning Long-form Generation of Large Language Models via Task-Inherent Attribute Guidelines. | Do Xuan Long, Duong Ngoc Yen, Do Xuan Trong, Anh Tuan Luu, Kenji Kawaguchi, Shafiq Joty, Min-Yen Kan, Nancy F. Chen |
| 2025 | ACL | ChartQAPro: A More Diverse and Challenging Benchmark for Chart Question Answering. | Ahmed Masry, Mohammed Saidul Islam, Mahir Ahmed, Aayush Bajaj, Firoz Kabir, Aaryaman Kartha, Md. Tahmid Rahman Laskar, Mizanur Rahman, Shadikur Rahman, Mehrad Shahmohammadi, Megh Thakkar, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty |
| 2025 | ACL | Beyond Output Matching: Bidirectional Alignment for Enhanced In-Context Learning. | Chengwei Qin, Wenhan Xia, Fangkai Jiao, Chen Chen, Yuchen Hu, Bosheng Ding, Ruirui Chen, Shafiq Joty |
| 2025 | ACL | Relevant or Random: Can LLMs Truly Perform Analogical Reasoning? | Chengwei Qin, Wenhan Xia, Tan Wang, Fangkai Jiao, Yuchen Hu, Bosheng Ding, Ruirui Chen, Shafiq Joty |
| 2025 | ACL | Learning Auxiliary Tasks Improves Reference-Free Hallucination Detection in Open-Domain Long-Form Generation. | Chengwei Qin, Wenxuan Zhou, Karthik Abinav Sankararaman, Nanshu Wang, Tengyu Xu, Alexander Radovic, Eryk Helenowski, Arya Talebzadeh, Aditya Tayade, Sinong Wang, Shafiq Joty, Han Fang, Hao Ma |
| 2025 | ACL | Does Context Matter? ContextualJudgeBench for Evaluating LLM-based Judges in Contextual Settings. | Austin Xu, Srijan Bansal, Yifei Ming, Semih Yavuz, Shafiq Joty |
| 2025 | COLING | DnA-Eval: Enhancing Large Language Model Evaluation through Decomposition and Aggregation. | Minzhi Li, Zhengyuan Liu, Shumin Deng, Shafiq Joty, Nancy F. Chen, Min-Yen Kan |
| 2025 | COLING | ChartGemma: Visual Instruction-tuning for Chart Reasoning in the Wild. | Ahmed Masry, Megh Thakkar, Aayush Bajaj, Aaryaman Kartha, Enamul Hoque, Shafiq Joty |
| 2025 | EMNLP | CEMTM: Contextual Embedding-based Multimodal Topic Modeling. | Amirhossein Abaskohi, Raymond Li, Chuyuan Li, Shafiq Joty, Giuseppe Carenini |
| 2025 | EMNLP | Demystifying Domain-adaptive Post-training for Financial LLMs. | Zixuan Ke, Yifei Ming, Xuan-Phi Nguyen, Caiming Xiong, Shafiq Joty |
| 2025 | EMNLP | Deploying Tiny LVLM Judges for Real-World Evaluation of Chart Models: Lessons Learned and Best Practices. | Md. Tahmid Rahman Laskar, Mohammed Saidul Islam, Ridwan Mahbub, Mizanur Rahman, Amran Bhuiyan, Israt Jahan, Mir Tafseer Nayeem, Shafiq Joty, Enamul Hoque, Jimmy Huang |
| 2025 | EMNLP | Topic-Guided Reinforcement Learning with LLMs for Enhancing Multi-Document Summarization. | Chuyuan Li, Austin Xu, Shafiq Joty, Giuseppe Carenini |
| 2025 | EMNLP | From Charts to Fair Narratives: Uncovering and Mitigating Geo-Economic Biases in Chart-to-Text. | Ridwan Mahbub, Mohammed Saidul Islam, Mir Tafseer Nayeem, Md. Tahmid Rahman Laskar, Mizanur Rahman, Shafiq Joty, Enamul Hoque |
| 2025 | EMNLP | Text2Vis: A Challenging and Diverse Benchmark for Generating Multimodal Visualizations from Text. | Mizanur Rahman, Md. Tahmid Rahman Laskar, Shafiq Joty, Enamul Hoque |
| 2025 | EMNLP | Direct Judgement Preference Optimization. | Peifeng Wang, Austin Xu, Yilun Zhou, Caiming Xiong, Shafiq Joty |
| 2025 | ICLR | Preference Optimization for Reasoning with Pseudo Feedback. | Fangkai Jiao, Geyang Guo, Xingxing Zhang, Nancy F. Chen, Shafiq Joty, Furu Wei |
| 2025 | ICLR | FaithEval: Can Your Language Model Stay Faithful to Context, Even If "The Moon is Made of Marshmallows". | Yifei Ming, Senthil Purushwalkam, Shrey Pandit, Zixuan Ke, Xuan-Phi Nguyen, Caiming Xiong, Shafiq Joty |
| 2025 | ICML | Evaluating Judges as Evaluators: The JETTS Benchmark of LLM-as-Judges as Test-Time Scaling Evaluators. | Yilun Zhou, Austin Xu, Peifeng Wang, Caiming Xiong, Shafiq Joty |
| 2025 | NAACL | ParaICL: Towards Parallel In-Context Learning. | Xingxuan Li, Xuan-Phi Nguyen, Shafiq Joty, Lidong Bing |
| 2025 | NAACL | ReIFE: Re-evaluating Instruction-Following Evaluation. | Yixin Liu, Kejian Shi, Alexander R. Fabbri, Yilun Zhao, Peifeng Wang, Chien-Sheng Wu, Shafiq Joty, Arman Cohan |
| 2025 | NAACL | LLMs Are Biased Towards Output Formats! Systematically Evaluating and Mitigating Output Format Bias of LLMs. | Do Xuan Long, Ngoc-Hai Nguyen, Tiviatis Sim, Hieu Dao, Shafiq Joty, Kenji Kawaguchi, Nancy F. Chen, Min-Yen Kan |
| 2025 | NAACL | On Positional Bias of Faithfulness for Long-form Summarization. | David Wan, Jesse Vig, Mohit Bansal, Shafiq Joty |
| 2024 | ACL | Data Augmentation using LLMs: Data Perspectives, Learning Paradigms and Challenges. | Bosheng Ding, Chengwei Qin, Ruochen Zhao, Tianze Luo, Xinze Li, Guizhen Chen, Wenhan Xia, Junjie Hu, Anh Tuan Luu, Shafiq Joty |
| 2024 | ACL | XCodeEval: An Execution-based Large Scale Multilingual Multitask Benchmark for Code Understanding, Generation, Translation and Retrieval. | Mohammad Abdullah Matin Khan, M. Saiful Bari, Xuan Do Long, Weishi Wang, Md. Rizwan Parvez, Shafiq Joty |
| 2024 | ACL | ChartInstruct: Instruction Tuning for Chart Comprehension and Reasoning. | Ahmed Masry, Mehrad Shahmohammadi, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty |
| 2024 | ACL | Democratizing LLMs for Low-Resource Languages by Leveraging their English Dominant Abilities with Linguistically-Diverse Prompts. | Xuan-Phi Nguyen, Mahani Aljunied, Shafiq Joty, Lidong Bing |
| 2024 | ACL | On Context Utilization in Summarization with Large Language Models. | Mathieu Ravaut, Aixin Sun, Nancy F. Chen, Shafiq Joty |
| 2024 | ACL | XL-HeadTags: Leveraging Multimodal Retrieval Augmentation for the Multilingual Generation of News Headlines and Tags. | Faisal Tareque Shohan, Mir Tafseer Nayeem, Samsul Islam, Abu Ubaida Akash, Shafiq Joty |
| 2024 | CVPR | Diffusion Model Alignment Using Direct Preference Optimization. | Bram Wallace, Meihua Dang, Rafael Rafailov, Linqi Zhou, Aaron Lou, Senthil Purushwalkam, Stefano Ermon, Caiming Xiong, Shafiq Joty, Nikhil Naik |
| 2024 | EACL | Efficiently Aligned Cross-Lingual Transfer Learning for Conversational Tasks using Prompt-Tuning. | Lifu Tu, Jin Qu, Semih Yavuz, Shafiq Joty, Wenhao Liu, Caiming Xiong, Yingbo Zhou |
| 2024 | EACL | Explaining Language Model Predictions with High-Impact Concepts. | Ruochen Zhao, Tan Wang, Yongjie Wang, Shafiq Joty |
| 2024 | ECCV | X-InstructBLIP: A Framework for Aligning Image, 3D, Audio, Video to LLMs and its Emergent Cross-Modal Reasoning. | Artemis Panagopoulou, Le Xue, Ning Yu, Junnan Li, Dongxu Li, Shafiq Joty, Ran Xu, Silvio Savarese, Caiming Xiong, Juan Carlos Niebles |
| 2024 | ECCV | BootPIG: Bootstrapping Zero-Shot Personalized Image Generation Capabilities in Pretrained Diffusion Models. | Senthil Purushwalkam, Akash Gokul, Shafiq Joty, Nikhil Naik |
| 2024 | EMNLP | Prompt Leakage effect and mitigation strategies for multi-turn LLM Applications. | Divyansh Agarwal, Alexander R. Fabbri, Ben Risher, Philippe Laban, Shafiq Joty, Chien-Sheng Wu |
| 2024 | EMNLP | FOLIO: Natural Language Reasoning with First-Order Logic. | Simeng Han, Hailey Schoelkopf, Yilun Zhao, Zhenting Qi, Martin Riddell, Wenfei Zhou, James Coady, David Peng, Yujie Qiao, Luke Benson, Lucy Sun, Alexander Wardle-Solano, Hannah Szab, Ekaterina Zubova, Matthew Burtell, Jonathan Fan, Yixin Liu, Brian Wong, Malcolm Sailor, Ansong Ni, Linyong Nan, Jungo Kasai, Tao Yu, Rui Zhang, Alexander R. Fabbri, Wojciech Kryscinski, Semih Yavuz, Ye Liu, Xi Victoria Lin, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Rex Ying, Arman Cohan, Dragomir Radev |
| 2024 | EMNLP | P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains. | Simeng Han, Aaron Yu, Rui Shen, Zhenting Qi, Martin Riddell, Wenfei Zhou, Yujie Qiao, Yilun Zhao, Semih Yavuz, Ye Liu, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Dragomir Radev, Rex Ying, Arman Cohan |
| 2024 | EMNLP | DataNarrative: Automated Data-Driven Storytelling with Visualizations and Texts. | Mohammed Saidul Islam, Md. Tahmid Rahman Laskar, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty |
| 2024 | EMNLP | Open-RAG: Enhanced Retrieval Augmented Reasoning with Open-Source Large Language Models. | Shayekh Bin Islam, Md. Asib Rahman, K. S. M. Tozammel Hossain, Enamul Hoque, Shafiq Joty, Md. Rizwan Parvez |
| 2024 | EMNLP | Learning Planning-based Reasoning by Trajectories Collection and Process Reward Synthesizing. | Fangkai Jiao, Chengwei Qin, Zhengyuan Liu, Nancy F. Chen, Shafiq Joty |
| 2024 | EMNLP | A Systematic Survey and Critical Review on Evaluating Large Language Models: Challenges, Limitations, and Recommendations. | Md. Tahmid Rahman Laskar, Sawsan Alqahtani, M. Saiful Bari, Mizanur Rahman, Mohammad Abdullah Matin Khan, Haidar Khan, Israt Jahan, Amran Bhuiyan, Chee-Wei Tan, Md. Rizwan Parvez, Enamul Hoque, Shafiq Joty, Jimmy Huang |
| 2024 | EMNLP | Evaluating Psychological Safety of Large Language Models. | Xingxuan Li, Yutong Li, Lin Qiu, Shafiq Joty, Lidong Bing |
| 2024 | ICLR | CodeChain: Towards Modular Code Generation Through Chain of Self-revisions with Representative Sub-modules. | Hung Le, Hailin Chen, Amrita Saha, Akash Gokul, Doyen Sahoo, Shafiq Joty |
| 2024 | ICLR | Chain-of-Knowledge: Grounding Large Language Models via Dynamic Knowledge Adapting over Heterogeneous Sources. | Xingxuan Li, Ruochen Zhao, Yew Ken Chia, Bosheng Ding, Shafiq Joty, Soujanya Poria, Lidong Bing |
| 2024 | NAACL | Embrace Divergence for Richer Insights: A Multi-document Summarization Benchmark and a Case Study on Summarizing Diverse Information from News Articles. | Kung-Hsiang Huang, Philippe Laban, Alexander R. Fabbri, Prafulla Kumar Choubey, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2024 | NAACL | Exploring Self-supervised Logic-enhanced Training for Large Language Models. | Fangkai Jiao, Zhiyang Teng, Bosheng Ding, Zhengyuan Liu, Nancy F. Chen, Shafiq Joty |
| 2024 | NAACL | Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization. | Yixin Liu, Alexander R. Fabbri, Jiawen Chen, Yilun Zhao, Simeng Han, Shafiq Joty, Pengfei Liu, Dragomir Radev, Chien-Sheng Wu, Arman Cohan |
| 2024 | NAACL | Lifelong Event Detection with Embedding Space Separation and Compaction. | Chengwei Qin, Ruirui Chen, Ruochen Zhao, Wenhan Xia, Shafiq Joty |
| 2024 | NAACL | AdaPT: A Set of Guidelines for Hyperbolic Multimodal Multilingual NLP. | Ramit Sawhney, Shrey Pandit, Vishwa Shah, Megh Thakkar, Shafiq Joty |
| 2024 | NAACL | DIVKNOWQA: Assessing the Reasoning Ability of LLMs via Open-Domain Question Answering over Knowledge Base and Text. | Wenting Zhao, Ye Liu, Tong Niu, Yao Wan, Philip S. Yu, Shafiq Joty, Yingbo Zhou, Semih Yavuz |
| 2023 | ACL | Is GPT-3 a Good Data Annotator? | Bosheng Ding, Chengwei Qin, Linlin Liu, Yew Ken Chia, Boyang Li, Shafiq Joty, Lidong Bing |
| 2023 | ACL | SWiPE: A Dataset for Document-Level Simplification of Wikipedia Pages. | Philippe Laban, Jesse Vig, Wojciech Kryscinski, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2023 | ACL | A Systematic Study and Comprehensive Evaluation of ChatGPT on Benchmark Datasets. | Md. Tahmid Rahman Laskar, M. Saiful Bari, Mizanur Rahman, Md Amran Hossen Bhuiyan, Shafiq Joty, Jimmy Xiangji Huang |
| 2023 | ACL | Contrastive Learning with Generated Representations for Inductive Knowledge Graph Embedding. | Qian Li, Shafiq Joty, Daling Wang, Shi Feng, Yifei Zhang, Chengwei Qin |
| 2023 | ACL | Revisiting the Gold Standard: Grounding Summarization Evaluation with Robust Human Evaluation. | Yixin Liu, Alexander R. Fabbri, Pengfei Liu, Yilun Zhao, Linyong Nan, Ruilin Han, Simeng Han, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev |
| 2023 | ACL | Towards Robust Low-Resource Fine-Tuning with Multi-View Compressed Representations. | Linlin Liu, Xingxuan Li, Megh Thakkar, Xin Li, Shafiq Joty, Luo Si, Lidong Bing |
| 2023 | ACL | Did You Read the Instructions? Rethinking the Effectiveness of Task Definitions in Instruction Learning. | Fan Yin, Jesse Vig, Philippe Laban, Shafiq Joty, Caiming Xiong, Chien-Sheng Wu |
| 2023 | ACL | Verify-and-Edit: A Knowledge-Enhanced Chain-of-Thought Framework. | Ruochen Zhao, Xingxuan Li, Shafiq Joty, Chengwei Qin, Lidong Bing |
| 2023 | EMNLP | Personalized Distillation: Empowering Open-Sourced LLMs with Adaptive Learning for Code Generation. | Hailin Chen, Amrita Saha, Steven Chu-Hong Hoi, Shafiq Joty |
| 2023 | EMNLP | NLP+Vis: NLP Meets Visualization. | Shafiq Joty, Enamul Hoque, Jesse Vig |
| 2023 | EMNLP | SummEdits: Measuring LLM Ability at Factual Reasoning Through The Lens of Summarization. | Philippe Laban, Wojciech Kryscinski, Divyansh Agarwal, Alexander R. Fabbri, Caiming Xiong, Shafiq Joty, Chien-Sheng Wu |
| 2023 | EMNLP | Towards Interpretable and Efficient Automatic Reference-Based Summarization Evaluation. | Yixin Liu, Alexander R. Fabbri, Yilun Zhao, Pengfei Liu, Shafiq Joty, Chien-Sheng Wu, Caiming Xiong, Dragomir Radev |
| 2023 | EMNLP | HPE: Answering Complex Questions over Text by Hybrid Question Parsing and Execution. | Ye Liu, Semih Yavuz, Rui Meng, Dragomir Radev, Caiming Xiong, Shafiq Joty, Yingbo Zhou |
| 2023 | EMNLP | UniChart: A Universal Vision-language Pretrained Model for Chart Comprehension and Reasoning. | Ahmed Masry, Parsa Kavehzadeh, Do Xuan Long, Enamul Hoque, Shafiq Joty |
| 2023 | EMNLP | Lifelong Sequence Generation with Dynamic Module Expansion and Adaptation. | Chengwei Qin, Chen Chen, Shafiq Joty |
| 2023 | EMNLP | Towards Low-Resource Automatic Program Repair with Meta-Learning and Pretrained Language Models. | Weishi Wang, Yue Wang, Steven C. H. Hoi, Shafiq Joty |
| 2023 | EMNLP | Retrieving Multimodal Information for Augmented Generation: A Survey. | Ruochen Zhao, Hailin Chen, Weishi Wang, Fangkai Jiao, Do Xuan Long, Chengwei Qin, Bosheng Ding, Xiaobao Guo, Minzhi Li, Xingxuan Li, Shafiq Joty |