Skip to content

Zhi-Qi Cheng

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

35

Venues

12

Active years

2017–2026

Best venue rank

A*

Where they publish

Papers

35 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSign-Language Datasets at Scale: A Comprehensive Survey on Resources, Benchmarks, and Annotation Standards.Yiming Ni, Zhi-Qi Cheng, Jiayu Li, Wei Cheng
2026ACLGoViG: Goal-Conditioned Visual Navigation Instruction Generation via Multimodal Reasoning.Fengyi Wu, Yifei Dong, Yilong Dai, Guangyu Chen, Qifeng Wu, Huiting Huang, Hang Wang, Qi Dai, Alexander G. Hauptmann, Zhi-Qi Cheng
2025AAAIA Video-grounded Dialogue Dataset and Metric for Event-driven Activities.Wiradee Imrattanatrai, Masaki Asada, Kimihiro Hasegawa, Zhi-Qi Cheng, Ken Fukuda, Teruko Mitamura
2025AAAIPOPoS: Improving Efficient and Robust Facial Landmark Detection with Parallel Optimal Position Search.Chong-Yang Xiang, Jun-Yan He, Zhi-Qi Cheng, Xiao Wu, Xian-Sheng Hua
2025CVPRSecuring the Skies: A Comprehensive Survey on Anti-UAV Methods, Benchmarking, and Future Directions.Yifei Dong, Fengyi Wu, Sanjian Zhang, Guangyu Chen, Yuzhi Hu, Masumi Yano, Jingdong Sun, Siyu Huang, Feng Liu, Qi Dai, Zhi-Qi Cheng
2025CVPRWhy We Feel: Breaking Boundaries in Emotional Reasoning with Multimodal Large Language Models.Yuxiang Lin, Jingdong Sun, Zhi-Qi Cheng, Jue Wang, Haomin Liang, Zebang Cheng, Yifei Dong, Jun-Yan He, Xiaojiang Peng, Xian-Sheng Hua
2025CVPRStableAnimator: High-Quality Identity-Preserving Human Image Animation.Shuyuan Tu, Zhen Xing, Xintong Han, Zhi-Qi Cheng, Qi Dai, Chong Luo, Zuxuan Wu
2025CVPREmphasizing Discriminative Features for Dataset Distillation in Complex Scenarios.Kai Wang, Zekai Li, Zhi-Qi Cheng, Samir Khaki, Ahmad Sajedi, Ramakrishna Vedantam, Konstantinos N. Plataniotis, Alexander Hauptmann, Yang You
2025EMNLPLarge Language Model Agents in Finance: A Survey Bridging Research, Practice, and Real-World Deployment.Yifei Dong, Fengyi Wu, Kunlin Zhang, Yilong Dai, Sanjian Zhang, Wanghao Ye, Sihan Chen, Zhi-Qi Cheng
2025ICASSPUMETTS: A Unified Framework for Emotional Text-to-Speech Synthesis with Multimodal Prompts.Xiang Li, Zhi-Qi Cheng, Jun-Yan He, Junyao Chen, Xiaomao Fan, Xiaojiang Peng, Alexander G. Hauptmann
2025ICASSPDeformAvatar: Point-Based Human Avatar Re-targeting and Rendering.Renyi Zhan, Zhi-Qi Cheng, Junyao Chen, Xiaojiang Peng
2025ICCVMotionFollower: Editing Video Motion via Score-Guided Diffusion.Shuyuan Tu, Qi Dai, Zihao Zhang, Sicheng Xie, Zhi-Qi Cheng, Chong Luo, Xintong Han, Zuxuan Wu, Yu-Gang Jiang
2025ICLRMetaDesigner: Advancing Artistic Typography through AI-Driven, User-Centric, and Multilingual WordArt Synthesis.Jun-Yan He, Zhi-Qi Cheng, Chenyang Li, Jingdong Sun, Qi He, Wangmeng Xiang, Hanyuan Chen, Jin-Peng Lan, Xianhui Lin, Kang Zhu, Bin Luo, Yifeng Geng, Xuansong Xie, Alexander G. Hauptmann
2025NAACLProMQA: Question Answering Dataset for Multimodal Procedural Activity Understanding.Kimihiro Hasegawa, Wiradee Imrattanatrai, Zhi-Qi Cheng, Masaki Asada, Susan Holm, Yuran Wang, Ken Fukuda, Teruko Mitamura
2025WACVDyRoNet: Dynamic Routing and Low-Rank Adapters for Autonomous Driving Streaming Perception.Xiang Huang, Zhi-Qi Cheng, Jun-Yan He, Chenyang Li, Wangmeng Xiang, Baigui Sun
2025WACVUCDR-Adapter: Exploring Adaptation of Pre-Trained Vision-Language Models for Universal Cross-Domain Retrieval.Haoyu Jiang, Zhi-Qi Cheng, Gabriel Moreira, Jiawen Zhu, Jingdong Sun, Bukun Ren, Jun-Yan He, Qi Dai, Xian-Sheng Hua
2024CIKMMusic2P: A Multi-Modal AI-Driven Tool for Simplifying Album Cover Design.Joong Ho Choi, Geonyeong Choi, Ji Eun Han, Wonjin Yang, Zhi-Qi Cheng
2024CVPRBlockGCN: Redefine Topology Awareness for Skeleton-Based Action Recognition.Yuxuan Zhou, Xudong Yan, Zhi-Qi Cheng, Yan Yan, Qi Dai, Xian-Sheng Hua
2024CVPRProS: Prompting-to-Simulate Generalized Knowledge for Universal Cross-Domain Retrieval.Kaipeng Fang, Jingkuan Song, Lianli Gao, Pengpeng Zeng, Zhi-Qi Cheng, Xiyao Li, Heng Tao Shen
2024CVPRMotionEditor: Editing Video Motion via Content-Aware Diffusion.Shuyuan Tu, Qi Dai, Zhi-Qi Cheng, Han Hu, Xintong Han, Zuxuan Wu, Yu-Gang Jiang
2024CVPRFaceChain-ImagineID: Freely Crafting High-Fidelity Diverse Talking Faces from Disentangled Audio.Chao Xu, Yang Liu, Jiazheng Xing, Weida Wang, Mingze Sun, Jun Dan, Tianxin Huang, Siyuan Li, Zhi-Qi Cheng, Ying Tai, Baigui Sun
2024EMNLPSHIELD: LLM-Driven Schema Induction for Predictive Analytics in EV Battery Supply Chain Disruptions.Zhi-Qi Cheng, Yifei Dong, Aike Shi, Wei Liu, Yuzhi Hu, Jason O'Connor, Alexander G. Hauptmann, Kate Whitefoot
2024ICRADCPT: Darkness Clue-Prompted Tracking in Nighttime UAVs.Jiawen Zhu, Huayi Tang, Zhi-Qi Cheng, Jun-Yan He, Bin Luo, Shihao Qiu, Shengming Li, Huchuan Lu
2023EMNLPWordArt Designer: User-Driven Artistic Typography Synthesis using Large Language Models.Jun-Yan He, Zhi-Qi Cheng, Chenyang Li, Jingdong Sun, Wangmeng Xiang, Xianhui Lin, Xiaoyang Kang, Zengke Jin, Yusen Hu, Bin Luo, Yifeng Geng, Xuansong Xie
2023ICASSPProcontext: Exploring Progressive Context Transformer for Tracking.Jin-Peng Lan, Zhi-Qi Cheng, Jun-Yan He, Chenyang Li, Bin Luo, Xu Bao, Wangmeng Xiang, Yifeng Geng, Xuansong Xie
2023ICASSPLongshortnet: Exploring Temporal and Semantic Features Fusion In Streaming Perception.Chenyang Li, Zhi-Qi Cheng, Jun-Yan He, Pengyu Li, Bin Luo, Han-Yuan Chen, Yifeng Geng, Jin-Peng Lan, Xuansong Xie
2023ICCVChartReader: A Unified Framework for Chart Derendering and Comprehension without Heuristic Rules.Zhi-Qi Cheng, Qi Dai, Alexander G. Hauptmann
2023ICCVImplicit Temporal Modeling with Learnable Alignment for Video Recognition.Shuyuan Tu, Qi Dai, Zuxuan Wu, Zhi-Qi Cheng, Han Hu, Yu-Gang Jiang
2023IJCAIHDFormer: High-order Directed Transformer for 3D Human Pose Estimation.Han-Yuan Chen, Jun-Yan He, Wangmeng Xiang, Zhi-Qi Cheng, Wei Liu, Hanbing Liu, Bin Luo, Yifeng Geng, Xuansong Xie
2023IJCAIDAMO-StreamNet: Optimizing Streaming Perception in Autonomous Driving.Jun-Yan He, Zhi-Qi Cheng, Chenyang Li, Wangmeng Xiang, Binghui Chen, Bin Luo, Yifeng Geng, Xuansong Xie
2022CVPRRethinking Spatial Invariance of Convolutional Networks for Object Counting.Zhi-Qi Cheng, Qi Dai, Hong Li, Jingkuan Song, Xiao Wu, Alexander G. Hauptmann
2020ICASSPStacked Pooling for Boosting Scale Invariance of Crowd Counting.Siyu Huang, Xi Li, Zhi-Qi Cheng, Zhongfei Zhang, Alexander G. Hauptmann
2020IJCAIGenerating Person Images with Appearance-aware Pose Stylizer.Siyu Huang, Haoyi Xiong, Zhi-Qi Cheng, Qingzhong Wang, Xingran Zhou, Bihan Wen, Jun Huan, Dejing Dou
2019ICCVLearning Spatial Awareness to Improve Crowd Counting.Zhi-Qi Cheng, Jun-Xiu Li, Qi Dai, Xiao Wu, Alexander G. Hauptmann
2017CVPRVideo2Shop: Exact Matching Clothes in Videos to Online Shopping Images.Zhi-Qi Cheng, Xiao Wu, Yang Liu, Xian-Sheng Hua