Arman Cohan
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
131
Venues
12
Active years
2015–2026
Best venue rank
A*
Where they publish
Papers
131 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | ACL | SciMDR: Advancing Scientific Multimodal Document Reasoning. | Ziyu Chen, Yilun Zhao, Chengye Wang, Rilyn Han, Manasi Patwardhan, Arman Cohan |
| 2026 | ACL | Evaluating Legal Reasoning Traces with Legal Issue Tree Rubrics. | Jinu Lee, Kyoung-Woon On, Sophia Simeng Han, Arman Cohan, Julia Hockenmaier |
| 2026 | ACL | MultiFinBen: Benchmarking Large Language Models for Multilingual and Multimodal Financial Application. | Xueqing Peng, Lingfei Qian, Yan Wang, Ruoyu Xiang, Yueru He, Yang Ren, Mingyang Jiang, Vincent Jim Zhang, Yuqing Guo, Jeff Zhao, Huan He, Yi Han, Yun Feng, Yuechen Jiang, Yupeng Cao, Haohang Li, Yangyang Yu, Xiaoyu Wang, Penglei Gao, Shengyuan Lin, Keyi Wang, Shanshan Yang, Yilun Zhao, Zhiwei Liu, Peng Lu, Jerry Huang, Suyuchen Wang, Triantafillos Papadopoulos, Polydoros Giannouris, Efstathia Soufleri, Nuo Chen, Zhiyang Deng, Heming Fu, Yijia Zhao, Mingquan Lin, Meikang Qiu, Kaleb E. Smith, Arman Cohan, Xiao-Yang Liu, Jimin Huang, Guojun Xiong, Alejandro Lopez-Lira, Xi Chen, Junichi Tsujii, Jian-Yun Nie, Sophia Ananiadou, Qianqian Xie |
| 2026 | ACL | CPTCoder: A Reliable LLM System for Medical Procedure Code Prediction. | Benlu Wang, Ziyao Shangguan, Kyle Tegtmeyer, Zhenyu Zhang, Sophie Chheang, Arman Cohan |
| 2026 | ACL | Anchor: Branch-Point Data Generation for GUI Agents. | Jinbiao Wei, Yilun Zhao, Kangqi Ni, Arman Cohan |
| 2026 | ACL | Can AI Be a Good Peer Reviewer? A Survey of Peer Review Process, Evaluation, and the Future. | Sihong Wu, Owen Jiang, Yilun Zhao, Tiansheng Hu, Yiling Ma, Kaiyan Zhang, Manasi Patwardhan, Arman Cohan |
| 2026 | ACL | RbtAct: Rebuttal as Supervision for Actionable Review Feedback Generation. | Sihong Wu, Yiling Ma, Yilun Zhao, Tiansheng Hu, Owen Jiang, Manasi Patwardhan, Arman Cohan |
| 2026 | ACL | MMSciCode: Real-world Evaluation of Multilingual Multi-Discipline Scientific Research Coding. | Xue Xia, Zheyuan Yang, Arman Cohan, Yilun Zhao |
| 2026 | ACL | A Survey of Multimodal Mathematical Reasoning: From Perception, Alignment to Reasoning. | Tianyu Yang, Sihong Wu, Yilun Zhao, Zhenwen Liang, Lisen Dai, Chen Zhao, Minhao Cheng, Arman Cohan, Xiangliang Zhang |
| 2026 | ACL | A Survey on Evaluation of LLM-based Agents. | Asaf Yehudai, Lilach Eden, Alan Li, Guy Uziel, Yilun Zhao, Roy Bar-Haim, Arman Cohan, Michal Shmueli-Scheuer |
| 2026 | ACL | Rethinking Reasoning-Intensive Retrieval: Evaluating and Advancing Retrievers in Agentic Search Systems. | Yilun Zhao, Jinbiao Wei, Tingyu Song, Siyue Zhang, Chen Zhao, Arman Cohan |
| 2026 | EACL | SciRAG: Adaptive, Citation-Aware, and Outline-Guided Retrieval and Synthesis for Scientific Literature. | Hang Ding, Yilun Zhao, Tiansheng Hu, Manasi Patwardhan, Arman Cohan |
| 2026 | EACL | Patient-Similarity Cohort Reasoning in Clinical Text-to-SQL. | Yifei Shen, Yilun Zhao, Justice Ou, Tinglin Huang, Arman Cohan |
| 2026 | ECIR | Investigating Retrieval-Augmented Generation Systems on Unanswerable, Uncheatable, Realistic, Multi-hop Queries. | Gabrielle Kaili-May Liu, Bryan Li, Arman Cohan, William Gantt Walden, Eugene Yang |
| 2025 | AAAI | RouterRetriever: Routing over a Mixture of Expert Embedding Models. | Hyunji Lee, Luca Soldaini, Arman Cohan, Minjoon Seo, Kyle Lo |
| 2025 | ACL | AbGen: Evaluating Large Language Models in Ablation Study Design and Evaluation for Scientific Research. | Yilun Zhao, Weiyuan Chen, Zhijian Xu, Manasi Patwardhan, Chengye Wang, Yixin Liu, Lovekesh Vig, Arman Cohan |
| 2025 | ACL | Can Multimodal Foundation Models Understand Schematic Diagrams? An Empirical Study on Information-Seeking QA over Scientific Papers. | Yilun Zhao, Chengye Wang, Chuhan Li, Arman Cohan |
| 2025 | ACL | LocAgent: Graph-Guided LLM Agents for Code Localization. | Zhaoling Chen, Robert Tang, Gangda Deng, Fang Wu, Jialong Wu, Zhiwei Jiang, Viktor K. Prasanna, Arman Cohan, Xingyao Wang |
| 2025 | ACL | Physics: Benchmarking Foundation Models on University-Level Physics Problem Solving. | Kaiyue Feng, Yilun Zhao, Yixin Liu, Tianyu Yang, Chen Zhao, John Sous, Arman Cohan |
| 2025 | ACL | MIR: Methodology Inspiration Retrieval for Scientific Research Problems. | Aniketh Garikaparthi, Manasi Patwardhan, Aditya Sanjiv Kanade, Aman Hassan, Lovekesh Vig, Arman Cohan |
| 2025 | ACL | IRIS: Interactive Research Ideation System for Accelerating Scientific Discovery. | Aniketh Garikaparthi, Manasi Patwardhan, Lovekesh Vig, Arman Cohan |
| 2025 | ACL | MDCure: A Scalable Pipeline for Multi-Document Instruction-Following. | Gabrielle Kaili-May Liu, Bowen Shi, Avi Caciularu, Idan Szpektor, Arman Cohan |
| 2025 | ACL | TESS 2: A Large-Scale Generalist Diffusion Language Model. | Jaesung Tae, Hamish Ivison, Sachin Kumar, Arman Cohan |
| 2025 | ACL | SciVer: Evaluating Foundation Models for Multimodal Scientific Claim Verification. | Chengye Wang, Yifei Shen, Zexi Kuang, Arman Cohan, Yilun Zhao |
| 2025 | ACL | Ref-Long: Benchmarking the Long-context Referencing Capability of Long-context Language Models. | Junjie Wu, Gefei Gu, Yanan Zheng, Dit-Yan Yeung, Arman Cohan |
| 2025 | ACL | Can LLMs Identify Critical Limitations within Scientific Research? A Systematic Evaluation on AI Research Papers. | Zhijian Xu, Yilun Zhao, Manasi Patwardhan, Lovekesh Vig, Arman Cohan |
| 2025 | ACL | HumanEval Pro and MBPP Pro: Evaluating Large Language Models on Self-invoking Code Generation Task. | Zhaojian Yu, Yilun Zhao, Arman Cohan, Xiaoping Zhang |
| 2025 | CVPR | MMVU: Measuring Expert-Level Multi-Discipline Video Understanding. | Yilun Zhao, Haowei Zhang, Lujing Xie, Tongyan Hu, Guo Gan, Yitao Long, Zhiyuan Hu, Weiyuan Chen, Chuhan Li, Zhijian Xu, Chengye Wang, Ziyao Shangguan, Zhenwen Liang, Yixin Liu, Chen Zhao, Arman Cohan |
| 2025 | ECIR | mFollowIR: A Multilingual Benchmark for Instruction Following in Retrieval. | Orion Weller, Benjamin Chang, Eugene Yang, Mahsa Yarmohammadi, Samuel Barham, Sean MacAvaney, Arman Cohan, Luca Soldaini, Benjamin Van Durme, Dawn J. Lawrie |
| 2025 | EMNLP | CourtReasoner: Can LLM Agents Reason Like Judges? | Sophia Simeng Han, Yoshiki Takashima, Shannon Zejiang Shen, Chen Liu, Yixin Liu, Roque K. Thuo, Sonia Knowlton, Ruzica Piskac, Scott J. Shapiro, Arman Cohan |
| 2025 | EMNLP | FinTrust: A Comprehensive Benchmark of Trustworthiness Evaluation in Finance Domain. | Tiansheng Hu, Tongyan Hu, Liuyang Bai, Yilun Zhao, Arman Cohan, Chen Zhao |
| 2025 | EMNLP | MCTS-RAG: Enhancing Retrieval-Augmented Generation with Monte Carlo Tree Search. | Yunhai Hu, Yilun Zhao, Chen Zhao, Arman Cohan |
| 2025 | EMNLP | MedTutor: A Retrieval-Augmented LLM System for Case-Based Medical Education. | Dongsuk Jang, Ziyao Shangguan, Kyle Tegtmeyer, Anurag Gupta, Jan Czerminski, Sophie Chheang, Arman Cohan |
| 2025 | EMNLP | MetaFaith: Faithful Natural Language Uncertainty Expression in LLMs. | Gabrielle Kaili-May Liu, Gal Yona, Avi Caciularu, Idan Szpektor, Tim G. J. Rudner, Arman Cohan |
| 2025 | EMNLP | FinLFQA: Evaluating Attributed Text Generation of LLMs in Financial Long-Form Question Answering. | Yitao Long, Tiansheng Hu, Yilun Zhao, Arman Cohan, Chen Zhao |
| 2025 | EMNLP | Judging with Many Minds: Do More Perspectives Mean Less Prejudice? On Bias Amplification and Resistance in Multi-Agent Based LLM-as-Judge. | Chiyu Ma, Enpei Zhang, Yilun Zhao, Wenjun Liu, Yaning Jia, Peijun Qing, Lin Shi, Arman Cohan, Yujun Yan, Soroush Vosoughi |
| 2025 | EMNLP | LimRank: Less is More for Reasoning-Intensive Information Reranking. | Tingyu Song, Yilun Zhao, Siyue Zhang, Chen Zhao, Arman Cohan |
| 2025 | EMNLP | SciRIFF: A Resource to Enhance Language Model Instruction-Following over Scientific Literature. | David Wadden, Kejian Shi, Jacob Morrison, Alan Li, Aakanksha Naik, Shruti Singh, Nitzan Barzilay, Kyle Lo, Tom Hope, Luca Soldaini, Shannon Zejiang Shen, Doug Downey, Hannaneh Hajishirzi, Arman Cohan |
| 2025 | EMNLP | SciSketch: An Open-source Framework for Automated Schematic Diagram Generation in Scientific Papers. | Zihang Wang, Yilun Zhao, Kaiyan Zhang, Chen Zhao, Manasi Patwardhan, Arman Cohan |
| 2025 | EMNLP | From Scores to Steps: Diagnosing and Improving LLM Performance in Evidence-Based Medical Calculations. | Benlu Wang, Iris Xia, Yifan Zhang, Junda Wang, Feiyun Ouyang, Shuo Han, Arman Cohan, Hong Yu, Zonghai Yao |
| 2025 | EMNLP | Table-R1: Inference-Time Scaling for Table Reasoning Tasks. | Zheyuan Yang, Lyuhao Chen, Arman Cohan, Yilun Zhao |
| 2025 | EMNLP | Z1: Efficient Test-time Scaling with Code. | Zhaojian Yu, Yinghao Wu, Yilun Zhao, Arman Cohan, Xiao-Ping Zhang |
| 2025 | EMNLP | Diffusion vs. Autoregressive Language Models: A Text Embedding Perspective. | Siyue Zhang, Yilun Zhao, Liyuan Geng, Arman Cohan, Anh Tuan Luu, Chen Zhao |
| 2025 | ICLR | TOMATO: Assessing Visual Temporal Reasoning Capabilities in Multimodal Foundation Models. | Ziyao Shangguan, Chuhan Li, Yuxuan Ding, Yanan Zheng, Yilun Zhao, Tesca Fitzgerald, Arman Cohan |
| 2025 | ICLR | ChemAgent: Self-updating Memories in Large Language Models Improves Chemical Reasoning. | Xiangru Tang, Tianyu Hu, Muyang Ye, Yanjun Shao, Xunjian Yin, Siru Ouyang, Wangchunshu Zhou, Pan Lu, Zhuosheng Zhang, Yilun Zhao, Arman Cohan, Mark Gerstein |
| 2025 | NAACL | Re-evaluating Automatic LLM System Ranking for Alignment with Human Preference. | Mingqi Gao, Yixin Liu, Xinyu Hu, Xiaojun Wan, Jonathan Bragg, Arman Cohan |
| 2025 | NAACL | Understanding Reference Policies in Direct Preference Optimization. | Yixin Liu, Pengfei Liu, Arman Cohan |
| 2025 | NAACL | ReIFE: Re-evaluating Instruction-Following Evaluation. | Yixin Liu, Kejian Shi, Alexander R. Fabbri, Yilun Zhao, Peifeng Wang, Chien-Sheng Wu, Shafiq Joty, Arman Cohan |
| 2025 | NAACL | SCIURus: Shared Circuits for Interpretable Uncertainty Representations in Language Models. | Carter Teplica, Yixin Liu, Arman Cohan, Tim G. J. Rudner |
| 2025 | NAACL | FollowIR: Evaluating and Teaching Information Retrieval Models to Follow Instructions. | Orion Weller, Benjamin Chang, Sean MacAvaney, Kyle Lo, Arman Cohan, Benjamin Van Durme, Dawn J. Lawrie, Luca Soldaini |
| 2025 | NAACL | Are Multimodal LLMs Robust Against Adversarial Perturbations? RoMMath: A Systematic Evaluation on Multimodal Math Reasoning. | Yilun Zhao, Guo Gan, Chen Zhao, Arman Cohan |
| 2025 | SIGIR | A Large-Scale Study of Reranker Relevance Feedback at Inference. | Revanth Gangi Reddy, Pradeep Dasigi, Md. Arafat Sultan, Arman Cohan, Avirup Sil, Heng Ji, Hannaneh Hajishirzi |
| 2024 | ACL | TaPERA: Enhancing Faithfulness and Interpretability in Long-Form Table QA by Content Planning and Execution-based Reasoning. | Yilun Zhao, Lyuhao Chen, Arman Cohan, Chen Zhao |
| 2024 | ACL | DocMath-Eval: Evaluating Math Reasoning Capabilities of LLMs in Understanding Financial Documents. | Yilun Zhao, Yitao Long, Hongjun Liu, Ryo Kamoi, Linyong Nan, Lyuhao Chen, Yixin Liu, Xiangru Tang, Rui Zhang, Arman Cohan |
| 2024 | ACL | KnowledgeFMath: A Knowledge-Intensive Math Reasoning Dataset in Finance Domains. | Yilun Zhao, Hongjun Liu, Yitao Long, Rui Zhang, Chen Zhao, Arman Cohan |
| 2024 | ACL | Unveiling the Spectrum of Data Contamination in Language Model: A Survey from Detection to Remediation. | Chunyuan Deng, Yilun Zhao, Yuzhao Heng, Yitong Li, Jiannan Cao, Xiangru Tang, Arman Cohan |
| 2024 | ACL | OLMo: Accelerating the Science of Language Models. | Dirk Groeneveld, Iz Beltagy, Evan Pete Walsh, Akshita Bhagia, Rodney Kinney, Oyvind Tafjord, Ananya Harsh Jha, Hamish Ivison, Ian Magnusson, Yizhong Wang, Shane Arora, David Atkinson, Russell Authur, Khyathi Raghavi Chandu, Arman Cohan, Jennifer Dumas, Yanai Elazar, Yuling Gu, Jack Hessel, Tushar Khot, William Merrill, Jacob Morrison, Niklas Muennighoff, Aakanksha Naik, Crystal Nam, Matthew E. Peters, Valentina Pyatkin, Abhilasha Ravichander, Dustin Schwenk, Saurabh Shah, Will Smith, Emma Strubell, Nishant Subramani, Mitchell Wortsman, Pradeep Dasigi, Nathan Lambert, Kyle Richardson, Luke Zettlemoyer, Jesse Dodge, Kyle Lo, Luca Soldaini, Noah A. Smith, Hannaneh Hajishirzi |
| 2024 | ACL | Rethinking Efficient Multilingual Text Summarization Meta-Evaluation. | Rilyn Han, Jiawen Chen, Yixin Liu, Arman Cohan |
| 2024 | ACL | Quantifying Contamination in Evaluating Code Generation Capabilities of Language Models. | Martin Riddell, Ansong Ni, Arman Cohan |
| 2024 | ACL | MedAgents: Large Language Models as Collaborators for Zero-shot Medical Reasoning. | Xiangru Tang, Anni Zou, Zhuosheng Zhang, Ziming Li, Yilun Zhao, Xingyao Zhang, Arman Cohan, Mark Gerstein |
| 2024 | EACL | On the Benefits of Fine-Grained Loss Truncation: A Case Study on Factuality in Summarization. | Lorenzo Jaime Flores, Arman Cohan |
| 2024 | EACL | TESS: Text-to-Text Self-Conditioned Simplex Diffusion. | Rabeeh Karimi Mahabadi, Hamish Ivison, Jaesung Tae, James Henderson, Iz Beltagy, Matthew E. Peters, Arman Cohan |
| 2024 | EACL | When do Generative Query and Document Expansions Fail? A Comprehensive Study Across Methods, Retrievers, and Datasets. | Orion Weller, Kyle Lo, David Wadden, Dawn J. Lawrie, Benjamin Van Durme, Arman Cohan, Luca Soldaini |
| 2024 | EMNLP | FinDVer: Explainable Claim Verification over Long and Hybrid-content Financial Documents. | Yilun Zhao, Yitao Long, Tintin Jiang, Chengye Wang, Weiyuan Chen, Hongjun Liu, Xiangru Tang, Yiming Zhang, Chen Zhao, Arman Cohan |
| 2024 | EMNLP | OpenT2T: An Open-Source Toolkit for Table-to-Text Generation. | Haowei Zhang, Shengyun Si, Yilun Zhao, Lujing Xie, Zhijian Xu, Lyuhao Chen, Linyong Nan, Pengcheng Wang, Xiangru Tang, Arman Cohan |
| 2024 | EMNLP | Bayesian Calibration of Win Rate Estimation with LLM Evaluators. | Yicheng Gao, Gonghan Xu, Zhe Wang, Arman Cohan |
| 2024 | EMNLP | TAIL: A Toolkit for Automatic and Realistic Long-Context Large Language Model Evaluation. | Gefei Gu, Yilun Zhao, Ruoxi Ning, Yanan Zheng, Arman Cohan |
| 2024 | EMNLP | FOLIO: Natural Language Reasoning with First-Order Logic. | Simeng Han, Hailey Schoelkopf, Yilun Zhao, Zhenting Qi, Martin Riddell, Wenfei Zhou, James Coady, David Peng, Yujie Qiao, Luke Benson, Lucy Sun, Alexander Wardle-Solano, Hannah Szab, Ekaterina Zubova, Matthew Burtell, Jonathan Fan, Yixin Liu, Brian Wong, Malcolm Sailor, Ansong Ni, Linyong Nan, Jungo Kasai, Tao Yu, Rui Zhang, Alexander R. Fabbri, Wojciech Kryscinski, Semih Yavuz, Ye Liu, Xi Victoria Lin, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Rex Ying, Arman Cohan, Dragomir Radev |
| 2024 | EMNLP | P-FOLIO: Evaluating and Improving Logical Reasoning with Abundant Human-Written Reasoning Chains. | Simeng Han, Aaron Yu, Rui Shen, Zhenting Qi, Martin Riddell, Wenfei Zhou, Yujie Qiao, Yilun Zhao, Semih Yavuz, Ye Liu, Shafiq Joty, Yingbo Zhou, Caiming Xiong, Dragomir Radev, Rex Ying, Arman Cohan |
| 2024 | EMNLP | Calibrating Long-form Generations From Large Language Models. | Yukun Huang, Yixin Liu, Raghuveer Thirukovalluru, Arman Cohan, Bhuwan Dhingra |
| 2024 | EMNLP | M3SciQA: A Multi-Modal Multi-Document Scientific QA Benchmark for Evaluating Foundation Models. | Chuhan Li, Ziyao Shangguan, Yilun Zhao, Deyuan Li, Yixin Liu, Arman Cohan |
| 2024 | EMNLP | OMG-QA: Building Open-Domain Multi-Modal Generative Question Answering Systems. | Linyong Nan, Weining Fang, Aylin Rasteh, Pouya Lahabi, Weijin Zou, Yilun Zhao, Arman Cohan |
| 2024 | EMNLP | SciDQA: A Deep Reading Comprehension Dataset over Scientific Papers. | Shruti Singh, Nandan Sarkar, Arman Cohan |
| 2024 | EMNLP | MIMIR: A Customizable Agent Tuning Platform for Enhanced Scientific Applications. | Xiangru Tang, Chunyuan Deng, Hanming Wang, Haoran Wang, Yilun Zhao, Wenqi Shi, May Fung, Wangchunshu Zhou, Jiannan Cao, Heng Ji, Arman Cohan, Mark Gerstein |
| 2024 | ICML | Observable Propagation: Uncovering Feature Vectors in Transformers. | Jacob Dunefsky, Arman Cohan |
| 2024 | ICML | NExT: Teaching Large Language Models to Reason about Code Execution. | Ansong Ni, Miltiadis Allamanis, Arman Cohan, Yinlin Deng, Kensen Shi, Charles Sutton, Pengcheng Yin |
| 2024 | NAACL | Investigating Data Contamination in Modern Benchmarks for Large Language Models. | Chunyuan Deng, Yilun Zhao, Xiangru Tang, Mark Gerstein, Arman Cohan |
| 2024 | NAACL | Benchmarking Generation and Evaluation Capabilities of Large Language Models for Instruction Controllable Summarization. | Yixin Liu, Alexander R. Fabbri, Jiawen Chen, Yilun Zhao, Simeng Han, Shafiq Joty, Pengfei Liu, Dragomir Radev, Chien-Sheng Wu, Arman Cohan |
| 2024 | NAACL | On Learning to Summarize with Large Language Models as References. | Yixin Liu, Kejian Shi, Katherine He, Longtian Ye, Alexander R. Fabbri, Pengfei Liu, Dragomir Radev, Arman Cohan |
| 2024 | NAACL | On Evaluating the Integration of Reasoning and Action in LLM Agents with Database Question Answering. | Linyong Nan, Ellen Zhang, Weijin Zou, Yilun Zhao, Wenfei Zhou, Arman Cohan |
| 2024 | NAACL | Struc-Bench: Are Large Language Models Good at Generating Complex Structured Tabular Data? | Xiangru Tang, Yiming Zong, Jason Phang, Yilun Zhao, Wangchunshu Zhou, Arman Cohan, Mark Gerstein |
| 2023 | ACL | Peek Across: Improving Multi-Document Modeling via Cross-Document Question-Answering. | Avi Caciularu, Matthew E. Peters, Jacob Goldberger, Ido Dagan, Arman Cohan |
| 2023 | ACL | OpenRT: An Open-source Framework for Reasoning Over Tabular Data. | Yilun Zhao, Boyu Mi, Zhenting Qi, Linyong Nan, Minghao Guo, Arman Cohan, Dragomir Radev |
| 2023 | EACL | LongEval: Guidelines for Human Evaluation of Faithfulness in Long-form Summarization. | Kalpesh Krishna, Erin Bransom, Bailey Kuehl, Mohit Iyyer, Pradeep Dasigi, Arman Cohan, Kyle Lo |
| 2023 | EACL | Embedding Recycling for Language Models. | Jon Saad-Falcon, Amanpreet Singh, Luca Soldaini, Mike D'Arcy, Arman Cohan, Doug Downey |
| 2023 | EMNLP | QTSumm: Query-Focused Summarization over Tabular Data. | Yilun Zhao, Zhenting Qi, Linyong Nan, Boyu Mi, Yixin Liu, Weijin Zou, Simeng Han, Ruizhe Chen, Xiangru Tang, Yumo Xu, Dragomir Radev, Arman Cohan |
| 2023 | EMNLP | Investigating Table-to-Text Generation Capabilities of Large Language Models in Real-World Information Seeking Scenarios. | Yilun Zhao, Haowei Zhang, Shengyun Si, Linyong Nan, Xiangru Tang, Arman Cohan |
| 2023 | EMNLP | Medical Text Simplification: Optimizing for Readability with Unlikelihood Training and Reranked Beam Search Decoding. | Lorenzo Jaime Yu Flores, Heyuan Huang, Kejian Shi, Sophie Chheang, Arman Cohan |
| 2023 | EMNLP | Open Domain Multi-document Summarization: A Comprehensive Study of Model Brittleness under Retrieval. | John M. Giorgi, Luca Soldaini, Bo Wang, Gary D. Bader, Kyle Lo, Lucy Lu Wang, Arman Cohan |
| 2023 | EMNLP | Enhancing Text-to-SQL Capabilities of Large Language Models: A Study on Prompt Design Strategies. | Linyong Nan, Yilun Zhao, Weijin Zou, Narutatsu Ri, Jaesung Tae, Ellen Zhang, Arman Cohan, Dragomir Radev |
| 2023 | EMNLP | A Question Answering Framework for Decontextualizing User-facing Snippets from Scientific Documents. | Benjamin Newman, Luca Soldaini, Raymond Fok, Arman Cohan, Kyle Lo |
| 2023 | EMNLP | SciRepEval: A Multi-Format Benchmark for Scientific Document Representations. | Amanpreet Singh, Mike D'Arcy, Arman Cohan, Doug Downey, Sergey Feldman |
| 2022 | ACL | Generating Scientific Claims for Zero-Shot Scientific Fact Checking. | Dustin Wright, David Wadden, Kyle Lo, Bailey Kuehl, Arman Cohan, Isabelle Augenstein, Lucy Lu Wang |
| 2022 | ACL | Zero- and Few-Shot NLP with Pretrained Language Models. | Iz Beltagy, Arman Cohan, Robert L. Logan IV, Sewon Min, Sameer Singh |
| 2022 | ACL | Improving the Generalizability of Depression Detection by Leveraging Clinical Questionnaires. | Thong Nguyen, Andrew Yates, Ayah Zirikly, Bart Desmet, Arman Cohan |
| 2022 | ACL | PRIMERA: Pyramid-based Masked Sentence Pre-training for Multi-document Summarization. | Wen Xiao, Iz Beltagy, Giuseppe Carenini, Arman Cohan |
| 2022 | COLING | Overview of the Third Workshop on Scholarly Document Processing. | Arman Cohan, Guy Feigenblat, Dayne Freitag, Tirthankar Ghosal, Drahomira Herrmannova, Petr Knoth, Kyle Lo, Philipp Mayr, Michal Shmueli-Scheuer, Anita de Waard, Lucy Lu Wang |
| 2022 | COLING | Overview of the First Shared Task on Multi Perspective Scientific Document Summarization (MuP). | Arman Cohan, Guy Feigenblat, Tirthankar Ghosal, Michal Shmueli-Scheuer |
| 2022 | EMNLP | SciFact-Open: Towards open-domain scientific claim verification. | David Wadden, Kyle Lo, Bailey Kuehl, Arman Cohan, Iz Beltagy, Lucy Lu Wang, Hannaneh Hajishirzi |
| 2022 | NAACL | Long Context Question Answering via Supervised Contrastive Learning. | Avi Caciularu, Ido Dagan, Jacob Goldberger, Arman Cohan |
| 2022 | NAACL | MultiCite: Modeling realistic citations requires moving beyond the single-sentence single-label setting. | Anne Lauscher, Brandon Ko, Bailey Kuehl, Sophie Johnson, Arman Cohan, David Jurgens, Kyle Lo |
| 2022 | NAACL | Multi-Vector Models with Textual Guidance for Fine-Grained Scientific Document Similarity. | Sheshera Mysore, Arman Cohan, Tom Hope |
| 2022 | NAACL | MultiVerS: Improving scientific claim verification with weak supervision and full-document context. | David Wadden, Kyle Lo, Lucy Lu Wang, Arman Cohan, Iz Beltagy, Hannaneh Hajishirzi |
| 2021 | AAAI | On Generating Extended Summaries of Long Documents. | Sajad Sotudeh, Arman Cohan, Nazli Goharian |
| 2021 | EMNLP | CDLM: Cross-Document Language Modeling. | Avi Caciularu, Arman Cohan, Iz Beltagy, Matthew E. Peters, Arie Cattan, Ido Dagan |
| 2021 | NAACL | A Dataset of Information-Seeking Questions and Answers Anchored in Research Papers. | Pradeep Dasigi, Kyle Lo, Iz Beltagy, Arman Cohan, Noah A. Smith, Matt Gardner |
| 2021 | SIGIR | Simplified Data Wrangling with ir_datasets. | Sean MacAvaney, Andrew Yates, Sergey Feldman, Doug Downey, Arman Cohan, Nazli Goharian |
| 2020 | ACL | SPECTER: Document-level Representation Learning using Citation-informed Transformers. | Arman Cohan, Sergey Feldman, Iz Beltagy, Doug Downey, Daniel S. Weld |
| 2020 | ACL | SUPP.AI: finding evidence for supplement-drug interactions. | Lucy Lu Wang, Oyvind Tafjord, Arman Cohan, Sarthak Jain, Sam Skjonsberg, Carissa Schoenick, Nick Botner, Waleed Ammar |
| 2020 | ECIR | Ranking Significant Discrepancies in Clinical Reports. | Sean MacAvaney, Arman Cohan, Nazli Goharian, Ross W. Filice |
| 2020 | EMNLP | TLDR: Extreme Summarization of Scientific Documents. | Isabel Cachola, Kyle Lo, Arman Cohan, Daniel S. Weld |
| 2020 | EMNLP | GUIR @ LongSumm 2020: Learning to Generate Long Summaries from Scientific Documents. | Sajad Sotudeh Gharebagh, Arman Cohan, Nazli Goharian |
| 2020 | EMNLP | SLEDGE-Z: A Zero-Shot Baseline for COVID-19 Literature Search. | Sean MacAvaney, Arman Cohan, Nazli Goharian |
| 2020 | EMNLP | Fact or Fiction: Verifying Scientific Claims. | David Wadden, Shanchuan Lin, Kyle Lo, Lucy Lu Wang, Madeleine van Zuylen, Arman Cohan, Hannaneh Hajishirzi |
| 2019 | EMNLP | SciBERT: A Pretrained Language Model for Scientific Text. | Iz Beltagy, Kyle Lo, Arman Cohan |
| 2019 | EMNLP | Pretrained Language Models for Sequential Sentence Classification. | Arman Cohan, Iz Beltagy, Daniel King, Bhavana Dalvi, Daniel S. Weld |
| 2019 | NAACL | Structural Scaffolds for Citation Intent Classification in Scientific Publications. | Arman Cohan, Waleed Ammar, Madeleine van Zuylen, Field Cady |
| 2019 | SIGIR | Ontology-Aware Clinical Abstractive Summarization. | Sean MacAvaney, Sajad Sotudeh, Arman Cohan, Nazli Goharian, Ish A. Talati, Ross W. Filice |
| 2019 | SIGIR | CEDR: Contextualized Embeddings for Document Ranking. | Sean MacAvaney, Andrew Yates, Arman Cohan, Nazli Goharian |
| 2018 | COLING | SMHD: a Large-Scale Resource for Exploring Online Language Usage for Multiple Mental Health Conditions. | Arman Cohan, Bart Desmet, Andrew Yates, Luca Soldaini, Sean MacAvaney, Nazli Goharian |
| 2018 | NAACL | A Discourse-Aware Attention Model for Abstractive Summarization of Long Documents. | Arman Cohan, Franck Dernoncourt, Doo Soon Kim, Trung Bui, Seokhwan Kim, Walter Chang, Nazli Goharian |
| 2018 | SIGIR | Characterizing Question Facets for Complex Answer Retrieval. | Sean MacAvaney, Andrew Yates, Arman Cohan, Luca Soldaini, Kai Hui, Nazli Goharian, Ophir Frieder |
| 2018 | SIGIR | Overcoming Low-Utility Facets for Complex Answer Retrieval. | Sean MacAvaney, Andrew Yates, Arman Cohan, Luca Soldaini, Kai Hui, Nazli Goharian, Ophir Frieder |
| 2017 | ECIR | A Neural Attention Model for Categorizing Patient Safety Events. | Arman Cohan, Allan Fong, Nazli Goharian, Raj M. Ratwani |
| 2017 | EMNLP | Depression and Self-Harm Risk Assessment in Online Forums. | Andrew Yates, Arman Cohan, Nazli Goharian |
| 2017 | SIGIR | Contextualizing Citations for Scientific Summarization using Word Embeddings and Domain Knowledge. | Arman Cohan, Nazli Goharian |
| 2016 | LREC | Revisiting Summarization Evaluation for Scientific Articles. | Arman Cohan, Nazli Goharian |
| 2016 | NAACL | Triaging Mental Health Forum Posts. | Arman Cohan, Sydney Young, Nazli Goharian |
| 2015 | ECIR | Retrieving Medical Literature for Clinical Decision Support. | Luca Soldaini, Arman Cohan, Andrew Yates, Nazli Goharian, Ophir Frieder |
| 2015 | EMNLP | Scientific Article Summarization Using Citation-Context and Article's Discourse Structure. | Arman Cohan, Nazli Goharian |
| 2015 | NAACL | Matching Citation Text and Cited Spans in Biomedical Literature: a Search-Oriented Approach. | Arman Cohan, Luca Soldaini, Nazli Goharian |