Zhenheng Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
25
Venues
10
Active years
2016–2026
Best venue rank
A*
Where they publish
Papers
25 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | UniAPO: Unified Multimodal Automated Prompt Optimization. | Qipeng Zhu, Yanzhe Chen, Huasong Zhong, Jie Chen, Yan Li, Zhixin Zhang, Junping Zhang, Zhenheng Yang |
| 2026 | KDD | Dynamic Content Moderation in Livestreams: Combining Supervised Classification with MLLM-Boosted Similarity Matching. | Wei Chee Yew, Hailun Xu, Sanjay Saha, Xiaotian Fan, Hiok Hian Ong, David Yuchen Wang, Kanchan Sarkar, Zhenheng Yang, Danhui Guan |
| 2025 | CVPR | InstanceCap: Improving Text-to-Video Generation via Instance-aware Structured Caption. | Tiehan Fan, Kepan Nan, Rui Xie, Penghao Zhou, Zhenheng Yang, Chaoyou Fu, Xiang Li, Jian Yang, Ying Tai |
| 2025 | CVPR | Parallelized Autoregressive Visual Generation. | Yuqing Wang, Shuhuai Ren, Zhijie Lin, Yujin Han, Haoyuan Guo, Zhenheng Yang, Difan Zou, Jiashi Feng, Xihui Liu |
| 2025 | EMNLP | InfiMM-WebMath-40B: Advancing Multimodal Pre-Training for Enhanced Mathematical Reasoning. | Xiaotian Han, Yiren Jian, Xuefeng Hu, Haogeng Liu, Yiqi Wang, Qihang Fan, Yuang Ai, Huaibo Huang, Ran He, Zhenheng Yang, Quanzeng You |
| 2025 | ICCV | Long Context Tuning for Video Generation. | Yuwei Guo, Ceyuan Yang, Ziyan Yang, Zhibei Ma, Zhijie Lin, Zhenheng Yang, Dahua Lin, Lu Jiang |
| 2025 | ICCV | Star: Spatial-Temporal Augmentation with Text-to-Video Models for Real-World Video Super-Resolution. | Rui Xie, Yinhong Liu, Penghao Zhou, Chen Zhao, Jun Zhou, Kai Zhang, Zhenyu Zhang, Jian Yang, Zhenheng Yang, Ying Tai |
| 2025 | ICLR | OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation. | Kepan Nan, Rui Xie, Penghao Zhou, Tiehan Fan, Zhenheng Yang, Zhijie Chen, Xiang Li, Jian Yang, Ying Tai |
| 2025 | ICLR | Show-o: One Single Transformer to Unify Multimodal Understanding and Generation. | Jinheng Xie, Weijia Mao, Zechen Bai, David Junhao Zhang, Weihao Wang, Kevin Qinghong Lin, Yuchao Gu, Zhijie Chen, Zhenheng Yang, Mike Zheng Shou |
| 2025 | KDD | Untitled record | Xin Dong, Sen Jia, Ming Rui Wang, Yan Li, Zhenheng Yang, Bingfeng Deng, Hongyu Xiong |
| 2021 | CVPR | Weakly Supervised Instance Segmentation for Videos With Temporal Mask Consistency. | Qing Liu, Vignesh Ramanathan, Dhruv Mahajan, Alan L. Yuille, Zhenheng Yang |
| 2020 | ECCV | SPAN: Spatial Pyramid Attention Network for Image Manipulation Localization. | Xuefeng Hu, Zhihan Zhang, Zhenye Jiang, Syomantak Chaudhuri, Zhenheng Yang, Ram Nevatia |
| 2019 | CVPR | UnOS: Unified Unsupervised Optical-Flow and Stereo-Depth Estimation by Watching Videos. | Yang Wang, Peng Wang, Zhenheng Yang, Chenxu Luo, Yi Yang, Wei Xu |
| 2019 | CVPR | Activity Driven Weakly Supervised Object Detection. | Zhenheng Yang, Dhruv Mahajan, Deepti Ghadiyaram, Ram Nevatia, Vignesh Ramanathan |
| 2018 | AAAI | Unsupervised Learning of Geometry From Videos With Edge-Aware Depth-Normal Consistency. | Zhenheng Yang, Peng Wang, Wei Xu, Liang Zhao, Ramakant Nevatia |
| 2018 | CVPR | Occlusion Aware Unsupervised Learning of Optical Flow. | Yang Wang, Yi Yang, Zhenheng Yang, Liang Zhao, Peng Wang, Wei Xu |
| 2018 | CVPR | LEGO: Learning Edge With Geometry All at Once by Watching Videos. | Zhenheng Yang, Peng Wang, Yang Wang, Wei Xu, Ram Nevatia |
| 2018 | ECCV | Every Pixel Counts: Unsupervised Geometry Learning with Holistic 3D Motion Understanding. | Zhenheng Yang, Peng Wang, Yang Wang, Wei Xu, Ram Nevatia |
| 2018 | WACV | Face and Body Association for Video-Based Face Recognition. | KangGeon Kim, Zhenheng Yang, Iacopo Masi, Ramakant Nevatia, Grard G. Medioni |
| 2017 | BMVC | Cascaded Boundary Regression for Temporal Action Detection. | Jiyang Gao, Zhenheng Yang, Ram Nevatia |
| 2017 | BMVC | RED: Reinforced Encoder-Decoder Networks for Action Anticipation. | Jiyang Gao, Zhenheng Yang, Ram Nevatia |
| 2017 | BMVC | Spatio-Temporal Action Detection with Cascade Proposal and Location Anticipation. | Zhenheng Yang, Jiyang Gao, Ram Nevatia |
| 2017 | ICCV | TALL: Temporal Activity Localization via Language Query. | Jiyang Gao, Chen Sun, Zhenheng Yang, Ram Nevatia |
| 2017 | ICCV | TURN TAP: Temporal Unit Regression Network for Temporal Action Proposals. | Jiyang Gao, Zhenheng Yang, Chen Sun, Kan Chen, Ram Nevatia |
| 2016 | ICPR | A multi-scale cascade fully convolutional network face detector. | Zhenheng Yang, Ramakant Nevatia |