Skip to content

Serena Yeung-Levy

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

17

Venues

9

Active years

2024–2026

Best venue rank

A*

Where they publish

Papers

17 indexed papers, newest first.

YearVenueTitleAuthors
2026EACLPaperSearchQA: Learning to Search and Reason over Scientific Papers with RLVR.James Burgess, Jan N. Hansen, Duo Peng, Yuhui Zhang, Alejandro Lozano, Min Woo Sun, Emma Lundberg, Serena Yeung-Levy
2025ACLNegVQA: Can Vision Language Models Understand Negation?Yuhui Zhang, Yuchang Su, Yiming Liu, Serena Yeung-Levy
2025CVPRMicroVQA: A Multimodal Reasoning Benchmark for Microscopy-Based Scientific Research.James Burgess, Jeffrey J. Nirschl, Laura Bravo-Snchez, Alejandro Lozano, Sanket Rajan Gupte, Jesus G. Galaz-Montoya, Yuhui Zhang, Yuchang Su, Disha Bhowmik, Zachary Coman, Sarina M. Hasan, Alexandra Johannesson, William D. Leineweber, Malvika G. Nair, Ridhi Yarlagadda, Connor Zuraski, Wah Chiu, Sarah Cohen, Jan N. Hansen, Manuel D. Leonetti, Chad Liu, Emma Lundberg, Serena Yeung-Levy
2025CVPRBIOMEDICA: An Open Biomedical Image-Caption Archive, Dataset, and Vision-Language Models Derived from Scientific Literature.Alejandro Lozano, Min Woo Sun, James Burgess, Liangyu Chen, Jeffrey J. Nirschl, Jeffrey Gu, Ivan Lopez, Josiah Aklilu, Anita Rau, Austin Wolfgang Katzer, Yuhui Zhang, Collin Chiu, Xiaohan Wang, Alfred Seunghoon Song, Robert Tibshirani, Serena Yeung-Levy
2025CVPRAutomated Generation of Challenging Multiple-Choice Questions for Vision Language Model Evaluation.Yuhui Zhang, Yuchang Su, Yiming Liu, Xiaohan Wang, James Burgess, Elaine Sui, Chenyu Wang, Josiah Aklilu, Alejandro Lozano, Anjiang Wei, Ludwig Schmidt, Serena Yeung-Levy
2025CVPRApollo: An Exploration of Video Understanding in Large Multimodal Models.Orr Zohar, Xiaohan Wang, Yann Dubois, Nikhil Mehta, Tong Xiao, Philippe Hansen-Estruch, Licheng Yu, Xiaofang Wang, Felix Juefei-Xu, Ning Zhang, Serena Yeung-Levy, Xide Xia
2025EMNLPData or Language Supervision: What Makes CLIP Better than DINO?Yiming Liu, Yuhui Zhang, Dhruba Ghosh, Ludwig Schmidt, Serena Yeung-Levy
2025ICCVFeather the Throttle: Revisiting Visual Token Pruning for Vision-Language Model Acceleration.Mark Endo, Xiaohan Wang, Serena Yeung-Levy
2025ICLRVideo Action Differencing.James Burgess, Xiaohan Wang, Yuhui Zhang, Anita Rau, Alejandro Lozano, Lisa Dunlap, Trevor Darrell, Serena Yeung-Levy
2025ICLRFoundation Models Secretly Understand Neural Network Weights: Enhancing Hypernetwork Architectures with Foundation Models.Jeffrey Gu, Serena Yeung-Levy
2025ICLRVideo-STaR: Self-Training Enables Video Instruction Tuning with Any Supervision.Orr Zohar, Xiaohan Wang, Yonatan Bitton, Idan Szpektor, Serena Yeung-Levy
2025ICMLCellFlux: Simulating Cellular Morphology Changes via Flow Matching.Yuhui Zhang, Yuchang Su, Chenyu Wang, Tianhong Li, Zoe Wefers, Jeffrey J. Nirschl, James Burgess, Daisy Ding, Alejandro Lozano, Emma Lundberg, Serena Yeung-Levy
2025WACVJust Shift It: Test-Time Prototype Shifting for Zero-Shot Generalization with Vision-Language Models.Elaine Sui, Xiaohan Wang, Serena Yeung-Levy
2024CVPRDescribing Differences in Image Sets with Natural Language.Lisa Dunlap, Yuhui Zhang, Xiaohan Wang, Ruiqi Zhong, Trevor Darrell, Jacob Steinhardt, Joseph E. Gonzalez, Serena Yeung-Levy
2024ECCVViewpoint Textual Inversion: Discovering Scene Representations and 3D View Control in 2D Diffusion Models.James Burgess, Kuan-Chieh Wang, Serena Yeung-Levy
2024ECCVDepth-Guided NeRF Training via Earth Mover's Distance.Anita Rau, Josiah Aklilu, F. Christopher Holsinger, Serena Yeung-Levy
2024ECCVVideoAgent: Long-Form Video Understanding with Large Language Model as Agent.Xiaohan Wang, Yuhui Zhang, Orr Zohar, Serena Yeung-Levy