| 2025 | EMNLP | InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning. | Xiaotian Han, Yiren Jian, Xuefeng Hu, Haogeng Liu, Yiqi Wang, Qihang Fan, Yuang Ai, Huaibo Huang, Ran He, Zhenheng Yang, Quanzeng You |
| 2025 | NAACL | Pretrained Image-Text Models are Secretly Video Captioners. | Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi |
| 2024 | ACL | Expedited Training of Visual Conditioned Language Generation via Redundancy Reduction. | Yiren Jian, Tingkai Liu, Yunzhe Tao, Chunhui Zhang, Soroush Vosoughi, Hongxia Yang |
| 2024 | ACL | InfiMM: Advancing Multimodal Understanding with an Open-Sourced Visual Language Model. | Haogeng Liu, Quanzeng You, Yiqi Wang, Xiaotian Han, Bohan Zhai, Yongfei Liu, Wentao Chen, Yiren Jian, Yunzhe Tao, Jianbo Yuan, Ran He, Hongxia Yang |
| 2024 | EMNLP | Working Memory Identifies Reasoning Limits in Language Models. | Chunhui Zhang, Yiren Jian, Zhongyu Ouyang, Soroush Vosoughi |
| 2024 | ICPR | Knowledge from Large-Scale Protein Contact Prediction Models Can Be Transferred to the Data-Scarce RNA Contact Prediction Task. | Yiren Jian, Chongyang Gao, Chen Zeng, Yunjie Zhao, Soroush Vosoughi |
| 2024 | IJCAI | GEM: Generating Engaging Multimodal Content. | Chongyang Gao, Yiren Jian, Natalia Denisenko, Soroush Vosoughi, V. S. Subrahmanian |
| 2022 | AAAI | Label Hallucination for Few-Shot Classification. | Yiren Jian, Lorenzo Torresani |
| 2022 | KDD | T-Cell Receptor-Peptide Interaction Prediction with Physical Model Augmented Pseudo-Labeling. | Yiren Jian, Erik Kruus, Martin Renqiang Min |
| 2022 | NAACL | Embedding Hallucination for Few-shot Language Fine-tuning. | Yiren Jian, Chongyang Gao, Soroush Vosoughi |
| 2022 | NAACL | Contrastive Learning for Prompt-based Few-shot Language Learners. | Yiren Jian, Chongyang Gao, Soroush Vosoughi |