Skip to content

Zhenheng Yang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

25

Venues

10

Active years

2016–2026

Best venue rank

A*

Where they publish

Papers

25 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIUniAPO: Unified Multimodal Automated Prompt Optimization.Qipeng Zhu, Yanzhe Chen, Huasong Zhong, Jie Chen, Yan Li, Zhixin Zhang, Junping Zhang, Zhenheng Yang
2026KDDDynamic Content Moderation in Livestreams: Combining Supervised Classification with MLLM-Boosted Similarity Matching.Wei Chee Yew, Hailun Xu, Sanjay Saha, Xiaotian Fan, Hiok Hian Ong, David Yuchen Wang, Kanchan Sarkar, Zhenheng Yang, Danhui Guan
2025CVPRInstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption.Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Zhenheng Yang, Chaoyou Fu, Xiang Li, Jian Yang, Ying Tai
2025CVPRParallelized Autoregressive Visual Generation.Yuqing Wang, Shuhuai Ren, Zhijie Lin, Yujin Han, Haoyuan Guo, Zhenheng Yang, Difan Zou, Jiashi Feng, Xihui Liu
2025EMNLPInfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning.Xiaotian Han, Yiren Jian, Xuefeng Hu, Haogeng Liu, Yiqi Wang, Qihang Fan, Yuang Ai, Huaibo Huang, Ran He, Zhenheng Yang, Quanzeng You
2025ICCVLong Context Tuning for Video Generation.Yuwei Guo, Ceyuan Yang, Ziyan Yang, Zhibei Ma, Zhijie Lin, Zhenheng Yang, Dahua Lin, Lu Jiang
2025ICCVStar: Spatial-Temporal Augmentation with Text-to-Video Models for Real-World Video Super-Resolution.Rui Xie, Yinhong Liu, Penghao Zhou, Chen Zhao, Jun Zhou, Kai Zhang, Zhenyu Zhang, Jian Yang, Zhenheng Yang, Ying Tai
2025ICLROpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation.Kepan Nan, Rui Xie, Penghao Zhou, Tiehan Fan, Zhenheng Yang, Zhijie Chen, Xiang Li, Jian Yang, Ying Tai
2025ICLRShow-o: One Single Transformer to Unify Multimodal Understanding and Generation.Jinheng Xie, Weijia Mao, Zechen Bai, David Junhao Zhang, Weihao Wang, Kevin Qinghong Lin, Yuchao Gu, Zhijie Chen, Zhenheng Yang, Mike Zheng Shou
2025KDDUntitled recordXin Dong, Sen Jia, Ming Rui Wang, Yan Li, Zhenheng Yang, Bingfeng Deng, Hongyu Xiong
2021CVPRWeakly Supervised Instance Segmentation for Videos With Temporal Mask Consistency.Qing Liu, Vignesh Ramanathan, Dhruv Mahajan, Alan L. Yuille, Zhenheng Yang
2020ECCVSPAN: Spatial Pyramid Attention Network for Image Manipulation Localization.Xuefeng Hu, Zhihan Zhang, Zhenye Jiang, Syomantak Chaudhuri, Zhenheng Yang, Ram Nevatia
2019CVPRUnOS: Unified Unsupervised Optical-Flow and Stereo-Depth Estimation by Watching Videos.Yang Wang, Peng Wang, Zhenheng Yang, Chenxu Luo, Yi Yang, Wei Xu
2019CVPRActivity Driven Weakly Supervised Object Detection.Zhenheng Yang, Dhruv Mahajan, Deepti Ghadiyaram, Ram Nevatia, Vignesh Ramanathan
2018AAAIUnsupervised Learning of Geometry From Videos With Edge-Aware Depth-Normal Consistency.Zhenheng Yang, Peng Wang, Wei Xu, Liang Zhao, Ramakant Nevatia
2018CVPROcclusion Aware Unsupervised Learning of Optical Flow.Yang Wang, Yi Yang, Zhenheng Yang, Liang Zhao, Peng Wang, Wei Xu
2018CVPRLEGO: Learning Edge With Geometry All at Once by Watching Videos.Zhenheng Yang, Peng Wang, Yang Wang, Wei Xu, Ram Nevatia
2018ECCVEvery Pixel Counts: Unsupervised Geometry Learning with Holistic 3D Motion Understanding.Zhenheng Yang, Peng Wang, Yang Wang, Wei Xu, Ram Nevatia
2018WACVFace and Body Association for Video-Based Face Recognition.KangGeon Kim, Zhenheng Yang, Iacopo Masi, Ramakant Nevatia, Grard G. Medioni
2017BMVCCascaded Boundary Regression for Temporal Action Detection.Jiyang Gao, Zhenheng Yang, Ram Nevatia
2017BMVCRED: Reinforced Encoder-Decoder Networks for Action Anticipation.Jiyang Gao, Zhenheng Yang, Ram Nevatia
2017BMVCSpatio-Temporal Action Detection with Cascade Proposal and Location Anticipation.Zhenheng Yang, Jiyang Gao, Ram Nevatia
2017ICCVTALL: Temporal Activity Localization via Language Query.Jiyang Gao, Chen Sun, Zhenheng Yang, Ram Nevatia
2017ICCVTURN TAP: Temporal Unit Regression Network for Temporal Action Proposals.Jiyang Gao, Zhenheng Yang, Chen Sun, Kan Chen, Ram Nevatia
2016ICPRA multi-scale cascade fully convolutional network face detector.Zhenheng Yang, Ramakant Nevatia