| 2026 | ACL | Addressing Overthinking in Large Vision-Language Models via Gated Perception-Reasoning Optimization. | Xingjian Diao, Zheyuan Liu, Chunhui Zhang, Weiyi Wu, Keyi Kong, Lin Shi, Kaize Ding, Soroush Vosoughi, Jiang Gui |
| 2026 | ACL | What Makes a Good Curriculum? Disentangling the Effects of Data Ordering on LLM Mathematical Reasoning. | Yaning Jia, Chunhui Zhang, Xingjian Diao, Xiangchi Yuan, Zhongyu Ouyang, Chiyu Ma, Soroush Vosoughi |
| 2026 | ACL | KinyaProp: Fine-Grained Propaganda Annotation in Kinyarwanda. | Manzi Fabrice Niyigaba, Ivory Yang, Soroush Vosoughi |
| 2026 | ACL | What Makes LLMs Effective Sequential Recommenders? A Study on Preference Intensity and Temporal Context. | Zhongyu Ouyang, Qianlong Wen, Chunhui Zhang, Yanfang Ye, Soroush Vosoughi |
| 2026 | ACL | Representing Lean Proofs as Trajectories in Latent Space. | Elisaveta Samoylov, Soroush Vosoughi |
| 2026 | ACL | Music Audio-Visual Question Answering Requires Specialized Multimodal Designs. | Wenhao You, Xingjian Diao, Wenjun Huang, Chunhui Zhang, Keyi Kong, Weiyi Wu, Chiyu Ma, Zhongyu Ouyang, Tingxuan Wu, Ming Cheng, Soroush Vosoughi, Jiang Gui |
| 2026 | ACL | Behavior Knowledge Merge in Reinforced Agentic Models. | Xiangchi Yuan, Dachuan Shi, Chunhui Zhang, Zheyuan Liu, Shenglong Yao, Soroush Vosoughi, Wenke Lee |
| 2026 | ACL | When Debiasing Backfires: Counterintuitive Side Effects of Preprocessing-Based Stereotype Mitigation. | Yahan Zheng, John J. Guerrerio, Soroush Vosoughi, Weicheng Ma |
| 2026 | EACL | Tailoring Memory Granularity for Multi-Hop Reasoning over Long Contexts. | Peijun Qing, Xingjian Diao, Chiyu Ma, Saeed Hassanpour, Soroush Vosoughi |
| 2025 | ACL | Serial Position Effects of Large Language Models. | Xiaobo Guo, Soroush Vosoughi |
| 2025 | ACL | Visibility as Survival: Generalizing NLP for Native Alaskan Language Identification. | Ivory Yang, Chunhui Zhang, Yuxin Wang, Zhongyu Ouyang, Soroush Vosoughi |
| 2025 | ACL | Growing Through Experience: Scaling Episodic Grounding in Language Models. | Chunhui Zhang, Sirui Wang, Zhongyu Ouyang, Xiangchi Yuan, Soroush Vosoughi |
| 2025 | COLING | NshuRescue: Reviving the Endangered Nshu Language with AI. | Ivory Yang, Weicheng Ma, Soroush Vosoughi |
| 2025 | EMNLP | ProtoVQA: An Adaptable Prototypical Framework for Explainable Fine-Grained Visual Question Answering. | Xingjian Diao, Weiyi Wu, Keyi Kong, Peijun Qing, Xinwen Xu, Ming Cheng, Soroush Vosoughi, Jiang Gui |
| 2025 | EMNLP | SoundMind: RL-Incentivized Logic Reasoning for Audio-Language Models. | Xingjian Diao, Chunhui Zhang, Keyi Kong, Weiyi Wu, Chiyu Ma, Zhongyu Ouyang, Peijun Qing, Soroush Vosoughi, Jiang Gui |
| 2025 | EMNLP | A Generalizable Rhetorical Strategy Annotation Model Using LLM-based Debate Simulation and Labelling. | Shiyu Ji, Farnoosh Hashemi, Joice Chen, Juanwen Pan, Weicheng Ma, Hefan Zhang, Sophia Pan, Ming Cheng, Shubham Mohole, Saeed Hassanpour, Soroush Vosoughi, Michael Macy |
| 2025 | EMNLP | Scalable and Culturally Specific Stereotype Dataset Construction via Human-LLM Collaboration. | Weicheng Ma, John J. Guerrerio, Soroush Vosoughi |
| 2025 | EMNLP | Enhancing LLM-Based Persuasion Simulations with Cultural and Speaker-Specific Information. | Weicheng Ma, Hefan Zhang, Shiyu Ji, Farnoosh Hashemi, Qichao Wang, Ivory Yang, Joice Chen, Juanwen Pan, Michael Macy, Saeed Hassanpour, Soroush Vosoughi |
| 2025 | EMNLP | Judging with Many Minds: Do More Perspectives Mean Less Prejudice? On Bias Amplification and Resistance in Multi-Agent Based LLM-as-Judge. | Chiyu Ma, Enpei Zhang, Yilun Zhao, Wenjun Liu, Yaning Jia, Peijun Qing, Lin Shi, Arman Cohan, Yujun Yan, Soroush Vosoughi |
| 2025 | EMNLP | Recontextualizing Revitalization: A Mixed Media Approach to Reviving the Nshu Language. | Ivory Yang, Xiaobo Guo, Yuxin Wang, Hefan Zhang, Yaning Jia, William Dinauer, Soroush Vosoughi |
| 2025 | EMNLP | Superficial Self-Improved Reasoners Benefit from Model Merging. | Xiangchi Yuan, Chunhui Zhang, Zheyuan Liu, Dachuan Shi, Leyan Pan, Soroush Vosoughi, Wenke Lee |
| 2025 | EMNLP | Knowing More, Acting Better: Hierarchical Representation for Embodied Decision-Making. | Chunhui Zhang, Zhongyu Ouyang, Xingjian Diao, Zheyuan Liu, Soroush Vosoughi |
| 2025 | ICLR | ImpScore: A Learnable Metric For Quantifying The Implicitness Level of Sentences. | Yuxin Wang, Xiaomeng Zhu, Weimin Lyu, Saeed Hassanpour, Soroush Vosoughi |
| 2025 | ICML | Overcoming Multi-step Complexity in Multimodal Theory-of-Mind Reasoning: A Scalable Bayesian Planner. | Chunhui Zhang, Zhongyu Ouyang, Kwonjoon Lee, Nakul Agarwal, Sean Dae Houlihan, Soroush Vosoughi, Shao-Yuan Lo |
| 2025 | IJCAI | DECASTE: Unveiling Caste Stereotypes in Large Language Models Through Multi-Dimensional Bias Analysis. | Prashanth Vijayaraghavan, Soroush Vosoughi, Lamogha Chiazor, Raya Horesh, Rogrio Abreu de Paula, Ehsan Degan, Vandana V. Mukherjee |
| 2025 | IJCNLP | Judging the Judges: A Systematic Study of Position Bias in LLM-as-a-Judge. | Lin Shi, Chiyu Ma, Wenhua Liang, Xingjian Diao, Weicheng Ma, Soroush Vosoughi |
| 2025 | ICWSM | Scaled Supervision is an Implicit Lipschitz Regularizer. | Zhongyu Ouyang, Chunhui Zhang, Yaning Jia, Soroush Vosoughi |
| 2025 | NAACL | Temporal Working Memory: Query-Guided Segment Refinement for Enhanced Multimodal Understanding. | Xingjian Diao, Chunhui Zhang, Weiyi Wu, Zhongyu Ouyang, Peijun Qing, Ming Cheng, Soroush Vosoughi, Jiang Gui |
| 2025 | NAACL | Communication Makes Perfect: Persuasion Dataset Construction via Multi-LLM Communication. | Weicheng Ma, Hefan Zhang, Ivory Yang, Shiyu Ji, Joice Chen, Farnoosh Hashemi, Shubham Mohole, Ethan Gearey, Michael Macy, Saeed Hassanpour, Soroush Vosoughi |
| 2025 | NAACL | What is it? Towards a Generalizable Native American Language Identification System. | Ivory Yang, Weicheng Ma, Carlos Guerrero Alvarez, William Dinauer, Soroush Vosoughi |
| 2025 | NAACL | Is It Navajo? Accurate Language Detection for Endangered Athabaskan Languages. | Ivory Yang, Weicheng Ma, Chunhui Zhang, Soroush Vosoughi |
| 2025 | NAACL | Pretrained Image-Text Models are Secretly Video Captioners. | Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi |
| 2025 | RecSys | Non-parametric Graph Convolution for Re-ranking in Recommendation Systems. | Zhongyu Ouyang, Mingxuan Ju, Soroush Vosoughi, Yanfang Ye |
| 2024 | ACL | MODABS: Multi-Objective Learning for Dynamic Aspect-Based Summarization. | Xiaobo Guo, Soroush Vosoughi |
| 2024 | ACL | Expedited Training of Visual Conditioned Language Generation via Redundancy Reduction. | Yiren Jian, Tingkai Liu, Yunzhe Tao, Chunhui Zhang, Soroush Vosoughi, Hongxia Yang |
| 2024 | ACL | Simulated Misinformation Susceptibility (SMISTS): Enhancing Misinformation Research with Large Language Model Simulations. | Weicheng Ma, Chunyuan Deng, Aram Moossavi, Lili Wang, Soroush Vosoughi, Diyi Yang |
| 2024 | ACL | MentalManip: A Dataset For Fine-grained Analysis of Mental Manipulation in Conversations. | Yuxin Wang, Ivory Yang, Saeed Hassanpour, Soroush Vosoughi |
| 2024 | EMNLP | The Computational Anatomy of Humility: Modeling Intellectual Humility in Online Public Discourse. | Xiaobo Guo, Neil Potnis, Melody Yu, Nabeel Gillani, Soroush Vosoughi |
| 2024 | EMNLP | Disordered-DABS: A Benchmark for Dynamic Aspect-Based Summarization in Disordered Texts. | Xiaobo Guo, Soroush Vosoughi |
| 2024 | EMNLP | AlphaLoRA: Assigning LoRA Experts Based on Layer Training Quality. | Peijun Qing, Chongyang Gao, Yefan Zhou, Xingjian Diao, Yaoqing Yang, Soroush Vosoughi |
| 2024 | EMNLP | Working Memory Identifies Reasoning Limits in Language Models. | Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi |
| 2024 | EMNLP | Is GPT-4V (ision) All You Need for Automating Academic Data Visualization? Exploring Vision-Language Models' Capability in Reproducing Academic Charts. | Zhehao Zhang, Weicheng Ma, Soroush Vosoughi |
| 2024 | ICLR | Aligning Relational Learning with Lipschitz Fairness. | Yaning Jia, Chunhui Zhang, Soroush Vosoughi |
| 2024 | ICLR | Training Socially Aligned Language Models on Simulated Social Interactions. | Ruibo Liu, Ruixin Yang, Chenyan Jia, Ge Zhang, Diyi Yang, Soroush Vosoughi |
| 2024 | ICPR | Knowledge from Large-Scale Protein Contact Prediction Models Can Be Transferred to the Data-Scarce RNA Contact Prediction Task. | Yiren Jian, Chongyang Gao, Chen Zeng, Yunjie Zhao, Soroush Vosoughi |
| 2024 | IJCAI | GEM: Generating Engaging Multimodal Content. | Chongyang Gao, Yiren Jian, Natalia Denisenko, Soroush Vosoughi, V. S. Subrahmanian |
| 2024 | NAACL | Addressing Healthcare-related Racial and LGBTQ+ Biases in Pretrained Language Models. | Sean Xie, Saeed Hassanpour, Soroush Vosoughi |
| 2024 | PAKDD | Enhancing Network Role Modeling: Introducing Attributed Multiplex Structural Role Embedding for Complex Networks. | Lili Wang, Chenghan Huang, Ruiye Yao, Chongyang Gao, Weicheng Ma, Soroush Vosoughi |
| 2023 | ACL | Improving Syntactic Probing Correctness and Robustness with Control Tasks. | Weicheng Ma, Brian Wang, Hefan Zhang, Lili Wang, Rolando Coto-Solano, Saeed Hassanpour, Soroush Vosoughi |
| 2023 | EMNLP | Length Does Matter: Summary Length can Bias Summarization Metrics. | Xiaobo Guo, Soroush Vosoughi |
| 2023 | EMNLP | Intersectional Stereotypes in Large Language Models: Dataset and Analysis. | Weicheng Ma, Brian Chiang, Tong Wu, Lili Wang, Soroush Vosoughi |
| 2023 | EMNLP | Deciphering Stereotypes in Pre-Trained Language Models. | Weicheng Ma, Henry Scheible, Brian Wang, Goutham Veeramachaneni, Pratim Chowdhary, Alan Sun, Andrew Koulogeorge, Lili Wang, Diyi Yang, Soroush Vosoughi |
| 2023 | EMNLP | Proto-lm: A Prototypical Network-Based Framework for Built-in Interpretability in Large Language Models. | Sean Xie, Soroush Vosoughi, Saeed Hassanpour |
| 2023 | ICCV | Improving Representation Learning for Histopathologic Images with Cluster Constraints. | Weiyi Wu, Chongyang Gao, Joseph DiPalma, Soroush Vosoughi, Saeed Hassanpour |
| 2023 | ICDM | Hyperbolic Node Structural Role Embedding. | Lili Wang, Chenghan Huang, Weicheng Ma, Zhongyang Li, Soroush Vosoughi |
| 2023 | ICLR | Mind's Eye: Grounded Language Model Reasoning through Simulation. | Ruibo Liu, Jason Wei, Shixiang Shane Gu, Te-Yen Wu, Soroush Vosoughi, Claire Cui, Denny Zhou, Andrew M. Dai |
| 2023 | ICLR | Language models are multilingual chain-of-thought reasoners. | Freda Shi, Mirac Suzgun, Markus Freitag, Xuezhi Wang, Suraj Srivats, Soroush Vosoughi, Hyung Won Chung, Yi Tay, Sebastian Ruder, Denny Zhou, Dipanjan Das, Jason Wei |
| 2023 | PAKDD | Joint Latent Topic Discovery and Expectation Modeling for Financial Markets. | Lili Wang, Chenghan Huang, Chongyang Gao, Weicheng Ma, Soroush Vosoughi |
| 2023 | WWW | Graph-Level Embedding for Time-Evolving Graphs. | Lili Wang, Chenghan Huang, Xinyuan Cao, Weicheng Ma, Soroush Vosoughi |
| 2022 | ACL | EnCBP: A New Benchmark Dataset for Finer-Grained Cultural Background Prediction in English. | Weicheng Ma, Samiha Datta, Lili Wang, Soroush Vosoughi |
| 2022 | EMNLP | Capturing Topic Framing via Masked Language Modeling. | Xiaobo Guo, Weicheng Ma, Soroush Vosoughi |
| 2022 | ICLR | Non-Parallel Text Style Transfer with Self-Parallel Supervision. | Ruibo Liu, Chongyang Gao, Chenyan Jia, Guangxuan Xu, Soroush Vosoughi |
| 2022 | ICLR | Knowledge Infused Decoding. | Ruibo Liu, Guoqing Zheng, Shashank Gupta, Radhika Gaonkar, Chongyang Gao, Soroush Vosoughi, Milad Shokouhi, Ahmed Hassan Awadallah |
| 2022 | ICPR | Going Beyond Accuracy: Interpretability Metrics for CNN Representations of Physiological Signals. | Kang Gu, Temiloluwa Prioleau, Soroush Vosoughi |
| 2022 | ICPR | Towards Interpretable Deep Reinforcement Learning Models via Inverse Reinforcement Learning. | Yuansheng Xie, Soroush Vosoughi, Saeed Hassanpour |
| 2022 | ICWSM | Measuring Media Bias via Masked Language Modeling. | Xiaobo Guo, Weicheng Ma, Soroush Vosoughi |
| 2022 | ICWSM | A Large-Scale Longitudinal Multimodal Dataset of State-Backed Information Operations on Twitter. | Xiaobo Guo, Soroush Vosoughi |
| 2022 | NAACL | Embedding Hallucination for Few-shot Language Fine-tuning. | Yiren Jian, Chongyang Gao, Soroush Vosoughi |
| 2022 | NAACL | Contrastive Learning for Prompt-based Few-shot Language Learners. | Yiren Jian, Chongyang Gao, Soroush Vosoughi |
| 2022 | NAACL | Aligning Generative Language Models with Human Values. | Ruibo Liu, Ge Zhang, Xinyu Feng, Soroush Vosoughi |
| 2022 | NAACL | TWEETSPIN: Fine-grained Propaganda Detection in Social Media Using Multi-View Representations. | Prashanth Vijayaraghavan, Soroush Vosoughi |
| 2021 | AAAI | Mitigating Political Bias in Language Models through Reinforced Calibration. | Ruibo Liu, Chenyan Jia, Jason Wei, Guangxuan Xu, Lili Wang, Soroush Vosoughi |
| 2021 | AAAI | Embedding Heterogeneous Networks into Hyperbolic Space Without Meta-path. | Lili Wang, Chongyang Gao, Chenghan Huang, Ruibo Liu, Weicheng Ma, Soroush Vosoughi |
| 2021 | ACL | A Survey of Data Augmentation Approaches for NLP. | Steven Y. Feng, Varun Gangal, Jason Wei, Sarath Chandar, Soroush Vosoughi, Teruko Mitamura, Eduard H. Hovy |
| 2021 | ACL | Modulating Language Models with Emotions. | Ruibo Liu, Jason Wei, Chenyan Jia, Soroush Vosoughi |
| 2021 | ACL | Language Model Augmented Relevance Score. | Ruibo Liu, Jason Wei, Soroush Vosoughi |
| 2021 | ACL | Contributions of Transformer Attention Heads in Multi- and Cross-lingual Tasks. | Weicheng Ma, Kai Zhang, Renze Lou, Lili Wang, Soroush Vosoughi |
| 2021 | CIKM | Graph Embedding via Diffusion-Wavelets-Based Node Feature Distribution Characterization. | Lili Wang, Chenghan Huang, Weicheng Ma, Xinyuan Cao, Soroush Vosoughi |
| 2021 | CIKM | Embedding Node Structural Role Identity Using Stress Majorization. | Lili Wang, Chenghan Huang, Weicheng Ma, Ying Lu, Soroush Vosoughi |
| 2021 | EACL | Text Augmentation in a Multi-Task View. | Jason Wei, Chengyu Huang, Shiqi Xu, Soroush Vosoughi |
| 2021 | EMNLP | GradTS: A Gradient-Based Automatic Auxiliary Task Selection Method Based on Transformer Networks. | Weicheng Ma, Renze Lou, Kai Zhang, Lili Wang, Soroush Vosoughi |
| 2021 | ICWSM | Political Depolarization of News Articles Using Attribute-Aware Word Embeddings. | Ruibo Liu, Lili Wang, Chenyan Jia, Soroush Vosoughi |
| 2021 | NAACL | Linguistic Complexity Loss in Text-Based Therapy. | Jason Wei, Kelly Finn, Emma Templeton, Thalia Wheatley, Soroush Vosoughi |
| 2021 | NAACL | Few-Shot Text Classification with Triplet Networks, Data Augmentation, and Curriculum Learning. | Jason Wei, Chengyu Huang, Soroush Vosoughi, Yu Cheng, Shiqi Xu |
| 2020 | CIKM | Embedding Node Structural Role Identity into Hyperbolic Space. | Lili Wang, Ying Lu, Chenghan Huang, Soroush Vosoughi |
| 2020 | EMNLP | Data Boost: Text Data Augmentation Through Reinforcement Learning Guided Conditional Generation. | Ruibo Liu, Guangxuan Xu, Chenyan Jia, Weicheng Ma, Lili Wang, Soroush Vosoughi |
| 2020 | EMNLP | Multi-resolution Annotations for Emoji Prediction. | Weicheng Ma, Ruibo Liu, Lili Wang, Soroush Vosoughi |
| 2020 | ICPR | Multi-Modal Identification of State-Sponsored Propaganda on Social Media. | Xiaobo Guo, Soroush Vosoughi |
| 2018 | WWW | Me, My Echo Chamber, and I: Introspection on Social Media Polarization. | Nabeel Gillani, Ann Yuan, Martin Saveski, Soroush Vosoughi, Deb Roy |
| 2017 | ACL | Twitter Demographic Classification Using Deep Multi-modal Multi-task Learning. | Prashanth Vijayaraghavan, Soroush Vosoughi, Deb Roy |
| 2017 | ICWSM | Mapping Twitter Conversation Landscapes. | Soroush Vosoughi, Prashanth Vijayaraghavan, Ann Yuan, Deb Roy |
| 2017 | IUI | TweetVista: An AI-Powered Interactive Tool for Exploring Conversations on Twitter. | Prashanth Vijayaraghavan, Soroush Vosoughi, Ann Yuan, Deb Roy |
| 2016 | ICWSM | Automatic Detection and Categorization of Election-Related Tweets. | Prashanth Vijayaraghavan, Soroush Vosoughi, Deb Roy |
| 2016 | ICWSM | A Semi-Automatic Method for Efficient Detection of Stories on Social Media. | Soroush Vosoughi, Deb Roy |
| 2016 | ICWSM | Tweet Acts: A Speech Act Classifier for Twitter. | Soroush Vosoughi, Deb Roy |
| 2016 | WWW | Human Atlas: A Tool for Mapping Social Networks. | Martin Saveski, Eric Chu, Soroush Vosoughi, Deb Roy |
| 2016 | SIGIR | Tweet2Vec: Learning Tweet Embeddings Using Character-level CNN-LSTM Encoder-Decoder. | Soroush Vosoughi, Prashanth Vijayaraghavan, Deb Roy |
| 2015 | ICDM | A Human-Machine Collaborative System for Identifying Rumors on Twitter. | Soroush Vosoughi, Deb Roy |
| 2014 | CHI | Improving automatic speech recognition through head pose driven visual grounding. | Soroush Vosoughi |
| 2014 | Interspeech | Grounding language models in spatiotemporal context. | Brandon C. Roy, Soroush Vosoughi, Deb Roy |
| 2012 | ICMI | A portable audio/video recorder for longitudinal study of child development. | Soroush Vosoughi, Matthew S. Goodwin, Bill Washabaugh, Deb Roy |
| 2012 | Interspeech | An Automatic Child-Directed Speech Detector for the Study of Child Language Development. | Soroush Vosoughi, Deb Roy |
| 2010 | Interspeech | Automatic estimation of transcription accuracy and difficulty. | Brandon Roy, Soroush Vosoughi, Deb Roy |
| 2008 | HRI | Object schemas for responsive robotic language use. | Kai-yuh Hsiao, Soroush Vosoughi, Stefanie Tellex, Rony Kubat, Deb Roy |