Jiuxiang Gu
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
62
Venues
15
Active years
2017–2026
Best venue rank
A*
Where they publish
Papers
62 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | OIDA-QA: A Multimodal Benchmark for Analyzing the Opioid Industry Documents Archive. | Xuan Shen, Brian Wingenroth, Zichao Wang, Jason Kuen, Wanrong Zhu, Ruiyi Zhang, Yiwei Wang, Lichun Ma, Anqi Liu, Hongfu Liu, Tong Sun, Kevin S. Hawkins, Kate Tasker, G. Caleb Alexander, Jiuxiang Gu |
| 2026 | AAAI | VipAct: Visual-Perception Enhancement via Specialized VLM Agent Collaboration and Tool-use. | Zhehao Zhang, Ryan A. Rossi, Tong Yu, Franck Dernoncourt, Ruiyi Zhang, Jiuxiang Gu, Sungchul Kim, Xiang Chen, Zichao Wang, Nedim Lipka |
| 2026 | ACL | MENTOR: Efficient Autoregressive Image Generation with Balanced Multimodal Control. | Haozhe Zhao, Zefan Cai, Shuzheng Si, Liang Chen, Jiuxiang Gu, Wen Xiao, Minjia Zhang, Junjie Hu |
| 2026 | ACL | Unveiling Inherent Visual Grounding in Multimodal LLMs for Text-Rich Images. | Shijie Zhou, Jihyung Kil, Ming Li, Jiuxiang Gu, Curtis Wigington, Rajiv Jain, Changyou Chen, Ruiyi Zhang |
| 2026 | EACL | A Survey on LLM-based Conversational User Simulation. | Bo Ni, Yu Wang, Leyao Wang, Branislav Kveton, Franck Dernoncourt, Yu Xia, Hongjie Chen, Reuben Luera, Samyadeep Basu, Subhojyoti Mukherjee, Puneet Mathur, Nesreen K. Ahmed, Junda Wu, Li Li, Huixin Zhang, Ruiyi Zhang, Tong Yu, Sungchul Kim, Jiuxiang Gu, Zhengzhong Tu, Alexa F. Siu, Zichao Wang, Seunghyun Yoon, Nedim Lipka, Namyong Park, Zihao Lin, Trung Bui, Yue Zhao, Tyler Derr, Ryan A. Rossi |
| 2025 | AAAI | LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers. | Xuan Shen, Zhao Song, Yufa Zhou, Bo Chen, Yanyu Li, Yifan Gong, Kai Zhang, Hao Tan, Jason Kuen, Henghui Ding, Zhihao Shu, Wei Niu, Pu Zhao, Yanzhi Wang, Jiuxiang Gu |
| 2025 | AAAI | Numerical Pruning for Efficient Autoregressive Models. | Xuan Shen, Zhao Song, Yufa Zhou, Bo Chen, Jing Liu, Ruiyi Zhang, Ryan A. Rossi, Hao Tan, Tong Yu, Xiang Chen, Yufan Zhou, Tong Sun, Pu Zhao, Yanzhi Wang, Jiuxiang Gu |
| 2025 | ACL | METAL: A Multi-Agent Framework for Chart Generation with Test-Time Scaling. | Bingxuan Li, Yiwei Wang, Jiuxiang Gu, Kai-Wei Chang, Nanyun Peng |
| 2025 | ACL | From Selection to Generation: A Survey of LLM-based Active Learning. | Yu Xia, Subhojyoti Mukherjee, Zhouhang Xie, Junda Wu, Xintong Li, Ryan Aponte, Hanjia Lyu, Joe Barrow, Hongjie Chen, Franck Dernoncourt, Branislav Kveton, Tong Yu, Ruiyi Zhang, Jiuxiang Gu, Nesreen K. Ahmed, Yu Wang, Xiang Chen, Hanieh Deilamsalehy, Sungchul Kim, Zhengmian Hu, Yue Zhao, Nedim Lipka, Seunghyun Yoon, Ting-Hao 'Kenneth' Huang, Zichao Wang, Puneet Mathur, Soumyabrata Pal, Koyel Mukherjee, Zhehao Zhang, Namyong Park, Thien Huu Nguyen, Jiebo Luo, Ryan A. Rossi, Julian J. McAuley |
| 2025 | CVPR | MegaSynth: Scaling Up 3D Scene Reconstruction with Synthesized Data. | Hanwen Jiang, Zexiang Xu, Desai Xie, Ziwen Chen, Haian Jin, Fujun Luan, Zhixin Shu, Kai Zhang, Sai Bi, Xin Sun, Jiuxiang Gu, Qixing Huang, Georgios Pavlakos, Hao Tan |
| 2025 | CVPR | QuartDepth: Post-Training Quantization for Real-Time Depth Estimation on the Edge. | Xuan Shen, Weize Ma, Jing Liu, Changdi Yang, Rui Ding, Quanyi Wang, Henghui Ding, Wei Niu, Yanzhi Wang, Pu Zhao, Jun Lin, Jiuxiang Gu |
| 2025 | EMNLP | CoMMIT: Coordinated Multimodal Instruction Tuning. | Xintong Li, Junda Wu, Tong Yu, Rui Wang, Yu Wang, Xiang Chen, Jiuxiang Gu, Lina Yao, Julian J. McAuley, Jingbo Shang |
| 2025 | ICCV | Refer to Any Segmentation Mask Group with Vision-Language Prompts. | Shengcao Cao, Zijun Wei, Jason Kuen, Kangning Liu, Lingzhi Zhang, Jiuxiang Gu, Hyunjoon Jung, Liang-Yan Gui, Yu-Xiong Wang |
| 2025 | ICCV | DiffIP: Representation Fingerprints for Robust IP Protection of Diffusion Models. | Zhuoling Li, Haoxuan Qu, Jason Kuen, Jiuxiang Gu, Qiuhong Ke, Jun Liu, Hossein Rahmani |
| 2025 | ICCV | Multimodal LLMs as Customized Reward Models for Text-to-Image Generation. | Shijie Zhou, Ruiyi Zhang, Huaisheng Zhu, Branislav Kveton, Yufan Zhou, Jiuxiang Gu, Jian Chen, Changyou Chen |
| 2025 | ICLR | ImageFolder: Autoregressive Image Generation with Folded Tokens. | Xiang Li, Kai Qiu, Hao Chen, Jason Kuen, Jiuxiang Gu, Bhiksha Raj, Zhe Lin |
| 2025 | ICLR | SV-RAG: LoRA-Contextualizing Adaptation of MLLMs for Long Document Understanding. | Jian Chen, Ruiyi Zhang, Yufan Zhou, Tong Yu, Franck Dernoncourt, Jiuxiang Gu, Ryan A. Rossi, Changyou Chen, Tong Sun |
| 2025 | NAACL | Self-Debiasing Large Language Models: Zero-Shot Recognition and Reduction of Stereotypes. | Isabel O. Gallegos, Ryan Aponte, Ryan A. Rossi, Joe Barrow, Md. Mehrab Tanjim, Tong Yu, Hanieh Deilamsalehy, Ruiyi Zhang, Sungchul Kim, Franck Dernoncourt, Nedim Lipka, Deonna M. Owens, Jiuxiang Gu |
| 2025 | RANLP | A Survey on Small Language Models. | Chien Van Nguyen, Xuan Shen, Ryan Aponte, Yu Xia, Samyadeep Basu, Zhengmian Hu, Jian Chen, Mihir Parmar, Sasidhar Kunapuli, Joe Barrow, Junda Wu, Ashish Singh, Yu Wang, Jiuxiang Gu, Nesreen K. Ahmed, Nedim Lipka, Ruiyi Zhang, Xiang Chen, Tong Yu, Sungchul Kim, Hanieh Deilamsalehy, Namyong Park, Michael Rimer, Zhehao Zhang, Huanrui Yang, Puneet Mathur, Gang Wu, Franck Dernoncourt, Ryan A. Rossi, Thien Huu Nguyen |
| 2025 | RANLP | Multi-LLM Debiasing Framework. | Deonna M. Owens, Ryan A. Rossi, Sungchul Kim, Tong Yu, Franck Dernoncourt, Xiang Chen, Ruiyi Zhang, Jiuxiang Gu, Hanieh Deilamsalehy, Nedim Lipka |
| 2025 | WACV | Differential Privacy Mechanisms in Neural Tangent Kernel Regression. | Jiuxiang Gu, Yingyu Liang, Zhizhou Sha, Zhenmei Shi, Zhao Song |
| 2025 | WACV | ARTIST: Improving the Generation of Text-Rich Images with Disentangled Diffusion Models and Large Language Models. | Jianyi Zhang, Yufan Zhou, Jiuxiang Gu, Curtis Wigington, Tong Yu, Yiran Chen, Tong Sun, Ruiyi Zhang |
| 2024 | ACL | Selective Reflection-Tuning: Student-Selected Data Recycling for LLM Instruction-Tuning. | Ming Li, Lichang Chen, Jiuhai Chen, Shwai He, Jiuxiang Gu, Tianyi Zhou |
| 2024 | COLING | DocScript: Document-level Script Event Prediction. | Puneet Mathur, Vlad I. Morariu, Aparna Garimella, Franck Dernoncourt, Jiuxiang Gu, Ramit Sawhney, Preslav Nakov, Dinesh Manocha, Rajiv Jain |
| 2024 | CVPR | TRINS: Towards Multimodal Language Models that Can Read. | Ruiyi Zhang, Yanzhe Zhang, Jian Chen, Yufan Zhou, Jiuxiang Gu, Changyou Chen, Tong Sun |
| 2024 | CVPR | Customization Assistant for Text-to-image Generation. | Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, Tong Sun |
| 2024 | EMNLP | Advancing Vision-Language Models with Adapter Ensemble Strategies. | Yue Bai, Handong Zhao, Zhe Lin, Ajinkya Kale, Jiuxiang Gu, Tong Yu, Sungchul Kim, Yun Fu |
| 2024 | EMNLP | TextLap: Customizing Language Models for Text-to-Layout Planning. | Jian Chen, Ruiyi Zhang, Yufan Zhou, Jennifer Healey, Jiuxiang Gu, Zhiqiang Xu, Changyou Chen |
| 2024 | ICLR | SOHES: Self-supervised Open-world Hierarchical Entity Segmentation. | Shengcao Cao, Jiuxiang Gu, Jason Kuen, Hao Tan, Ruiyi Zhang, Handong Zhao, Ani Nenkova, Liangyan Gui, Tong Sun, Yu-Xiong Wang |
| 2024 | ICLR | ADOPD: A Large-Scale Document Page Decomposition Dataset. | Jiuxiang Gu, Xiangxi Shi, Jason Kuen, Lu Qi, Ruiyi Zhang, Anqi Liu, Ani Nenkova, Tong Sun |
| 2024 | ICLR | LRM: Large Reconstruction Model for Single Image to 3D. | Yicong Hong, Kai Zhang, Jiuxiang Gu, Sai Bi, Yang Zhou, Difan Liu, Feng Liu, Kalyan Sunkavalli, Trung Bui, Hao Tan |
| 2024 | ICML | Category-Aware Active Domain Adaptation. | Wenxiao Xiao, Jiuxiang Gu, Hongfu Liu |
| 2024 | NAACL | Self-Cleaning: Improving a Named Entity Recognizer Trained on Noisy Data with a Few Clean Instances. | Zhendong Chu, Ruiyi Zhang, Tong Yu, Rajiv Jain, Vlad I. Morariu, Jiuxiang Gu, Ani Nenkova |
| 2023 | AAAI | DocEdit: Language-Guided Document Editing. | Puneet Mathur, Rajiv Jain, Jiuxiang Gu, Franck Dernoncourt, Dinesh Manocha, Vlad I. Morariu |
| 2023 | EMNLP | A Critical Analysis of Document Out-of-Distribution Detection. | Jiuxiang Gu, Yifei Ming, Yi Zhou, Jason Kuen, Vlad I. Morariu, Handong Zhao, Ruiyi Zhang, Nikolaos Barmpalios, Anqi Liu, Yixuan Li, Tong Sun, Ani Nenkova |
| 2023 | EMNLP | Learning the Visualness of Text Using Large Vision-Language Models. | Gaurav Verma, Ryan A. Rossi, Christopher Tensmeyer, Jiuxiang Gu, Ani Nenkova |
| 2023 | ICCV | High Quality Entity Segmentation. | Lu Qi, Jason Kuen, Tiancheng Shen, Jiuxiang Gu, Wenbo Li, Weidong Guo, Jiaya Jia, Zhe Lin, Ming-Hsuan Yang |
| 2023 | WACV | LayerDoc: Layer-wise Extraction of Spatial Hierarchical Structure in Visually-Rich Documents. | Puneet Mathur, Rajiv Jain, Ashutosh Mehra, Jiuxiang Gu, Franck Dernoncourt, Anandhavelu Natarajan, Quan Hung Tran, Verena Kaynig-Fittkau, Ani Nenkova, Dinesh Manocha, Vlad I. Morariu |
| 2022 | AAAI | UNISON: Unpaired Cross-Lingual Image Captioning. | Jiahui Gao, Yi Zhou, Philip L. H. Yu, Shafiq R. Joty, Jiuxiang Gu |
| 2022 | AAAI | TiGAN: Text-Based Interactive Image Generation and Manipulation. | Yufan Zhou, Ruiyi Zhang, Jiuxiang Gu, Chris Tensmeyer, Tong Yu, Changyou Chen, Jinhui Xu, Tong Sun |
| 2022 | ACL | Learning Adaptive Axis Attentions in Fine-tuning: Beyond Fixed Sparse Attention Patterns. | Zihan Wang, Jiuxiang Gu, Jason Kuen, Handong Zhao, Vlad I. Morariu, Ruiyi Zhang, Ani Nenkova, Tong Sun, Jingbo Shang |
| 2022 | CVPR | Open-Vocabulary Instance Segmentation via Robust Cross-Modal Pseudo-Labeling. | Dat Huynh, Jason Kuen, Zhe Lin, Jiuxiang Gu, Ehsan Elhamifar |
| 2022 | CVPR | EI-CLIP: Entity-aware Interventional Contrastive Learning for E-commerce Cross-modal Retrieval. | Haoyu Ma, Handong Zhao, Zhe Lin, Ajinkya Kale, Zhangyang Wang, Tong Yu, Jiuxiang Gu, Sunav Choudhary, Xiaohui Xie |
| 2022 | CVPR | Towards Language-Free Training for Text-to-Image Generation. | Yufan Zhou, Ruiyi Zhang, Changyou Chen, Chunyuan Li, Chris Tensmeyer, Tong Yu, Jiuxiang Gu, Jinhui Xu, Tong Sun |
| 2022 | ECCV | CA-SSL: Class-Agnostic Semi-Supervised Learning for Detection and Segmentation. | Lu Qi, Jason Kuen, Zhe Lin, Jiuxiang Gu, Fengyun Rao, Dian Li, Weidong Guo, Zhen Wen, Ming-Hsuan Yang, Jiaya Jia |
| 2022 | ECCV | Improving the Reliability for Confidence Estimation. | Haoxuan Qu, Yanchao Li, Lin Geng Foo, Jason Kuen, Jiuxiang Gu, Jun Liu |
| 2022 | ECCV | Meta Spatio-Temporal Debiasing for Video Scene Graph Generation. | Li Xu, Haoxuan Qu, Jason Kuen, Jiuxiang Gu, Jun Liu |
| 2022 | EMNLP | MGDoc: Pre-training with Multi-granular Hierarchy for Document Image Understanding. | Zilong Wang, Jiuxiang Gu, Chris Tensmeyer, Nikolaos Barmpalios, Ani Nenkova, Tong Sun, Jingbo Shang, Vlad I. Morariu |
| 2022 | Interspeech | DocLayoutTTS: Dataset and Baselines for Layout-informed Document-level Neural Speech Synthesis. | Puneet Mathur, Franck Dernoncourt, Quan Hung Tran, Jiuxiang Gu, Ani Nenkova, Vlad I. Morariu, Rajiv Jain, Dinesh Manocha |
| 2022 | NAACL | DocTime: A Document-level Temporal Dependency Graph Parser. | Puneet Mathur, Vlad I. Morariu, Verena Kaynig-Fittkau, Jiuxiang Gu, Franck Dernoncourt, Quan Hung Tran, Ani Nenkova, Dinesh Manocha, Rajiv Jain |
| 2022 | WWW | FedKC: Federated Knowledge Composition for Multilingual Natural Language Understanding. | Haoyu Wang, Handong Zhao, Yaqing Wang, Tong Yu, Jiuxiang Gu, Jing Gao |
| 2021 | CVPR | SelfDoc: Self-Supervised Document Representation Learning. | Peizhao Li, Jiuxiang Gu, Jason Kuen, Vlad I. Morariu, Handong Zhao, Rajiv Jain, Varun Manjunatha, Hongfu Liu |
| 2021 | CVPR | Multi-Scale Aligned Distillation for Low-Resolution Detection. | Lu Qi, Jason Kuen, Jiuxiang Gu, Zhe Lin, Yi Wang, Yukang Chen, Yanwei Li, Jiaya Jia |
| 2021 | CVPR | Exploiting Semantic Embedding and Visual Feature for Facial Action Unit Detection. | Huiyuan Yang, Lijun Yin, Yi Zhou, Jiuxiang Gu |
| 2021 | NAACL | Towards Interpreting and Mitigating Shortcut Learning Behavior of NLU models. | Mengnan Du, Varun Manjunatha, Rajiv Jain, Ruchi Deshpande, Franck Dernoncourt, Jiuxiang Gu, Tong Sun, Xia Hu |
| 2020 | ECCV | Finding It at Another Side: A Viewpoint-Adapted Matching Encoder for Change Captioning. | Xiangxi Shi, Xu Yang, Jiuxiang Gu, Shafiq R. Joty, Jianfei Cai |
| 2019 | CVPR | Scene Graph Generation With External Knowledge and Image Reconstruction. | Jiuxiang Gu, Handong Zhao, Zhe Lin, Sheng Li, Jianfei Cai, Mingyang Ling |
| 2019 | ICCV | Unpaired Image Captioning via Scene Graph Alignments. | Jiuxiang Gu, Shafiq R. Joty, Jianfei Cai, Handong Zhao, Xu Yang, Gang Wang |
| 2018 | AAAI | Stack-Captioning: Coarse-to-Fine Learning for Image Captioning. | Jiuxiang Gu, Jianfei Cai, Gang Wang, Tsuhan Chen |
| 2018 | CVPR | Look, Imagine and Match: Improving Textual-Visual Cross-Modal Retrieval With Generative Models. | Jiuxiang Gu, Jianfei Cai, Shafiq R. Joty, Li Niu, Gang Wang |
| 2018 | ECCV | Unpaired Image Captioning by Language Pivoting. | Jiuxiang Gu, Shafiq R. Joty, Jianfei Cai, Gang Wang |
| 2017 | ICCV | An Empirical Study of Language CNN for Image Captioning. | Jiuxiang Gu, Gang Wang, Jianfei Cai, Tsuhan Chen |