Skip to content

Xitong Yang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

24

Venues

7

Active years

2015–2025

Best venue rank

A*

Where they publish

Papers

24 indexed papers, newest first.

YearVenueTitleAuthors
2025CVPRProgress-Aware Video Frame Captioning.Zihui Xue, Joungbin An, Xitong Yang, Kristen Grauman
2025DATEHyIMC: Analog-Digital Hybrid In-Memory Computing SoC for High-Quality Low-Latency Speech Enhancement.Wanru Mao, Hanjie Liu, Guangyao Wang, Tianshuo Bai, Jingcheng Gu, Han Zhang, Xitong Yang, Aifei Zhang, Xiaohang Wei, Meng Wang, Wang Kang
2024CVPREgo-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives.Kristen Grauman, Andrew Westbury, Lorenzo Torresani, Kris Kitani, Jitendra Malik, Triantafyllos Afouras, Kumar Ashutosh, Vijay Baiyya, Siddhant Bansal, Bikram Boote, Eugene Byrne, Zachary Chavis, Joya Chen, Feng Cheng, Fu-Jen Chu, Sean Crane, Avijit Dasgupta, Jing Dong, Mara Escobar, Cristhian Forigua, Abrham Gebreselasie, Sanjay Haresh, Jing Huang, Md Mohaiminul Islam, Suyog Dutt Jain, Rawal Khirodkar, Devansh Kukreja, Kevin J. Liang, Jia-Wei Liu, Sagnik Majumder, Yongsen Mao, Miguel Martin, Effrosyni Mavroudi, Tushar Nagarajan, Francesco Ragusa, Santhosh Kumar Ramakrishnan, Luigi Seminara, Arjun Somayazulu, Yale Song, Shan Su, Zihui Xue, Edward Zhang, Jinxu Zhang, Angela Castillo, Changan Chen, Xinzhu Fu, Ryosuke Furuta, Cristina Gonzlez, Prince Gupta, Jiabo Hu, Yifei Huang, Yiming Huang, Weslie Khoo, Anush Kumar, Robert Kuo, Sach Lakhavani, Miao Liu, Mi Luo, Zhengyi Luo, Brighid Meredith, Austin Miller, Oluwatumininu Oguntola, Xiaqing Pan, Penny Peng, Shraman Pramanick, Merey Ramazanova, Fiona Ryan, Wei Shan, Kiran K. Somasundaram, Chenan Song, Audrey Southerland, Masatoshi Tateno, Huiyu Wang, Yuchen Wang, Takuma Yagi, Mingfei Yan, Xitong Yang, Zecheng Yu, Shengxin Cindy Zha, Chen Zhao, Ziwei Zhao, Zhifan Zhu, Jeff Zhuo, Pablo Arbelez, Gedas Bertasius, Dima Damen, Jakob J. Engel, Giovanni Maria Farinella, Antonino Furnari, Bernard Ghanem, Judy Hoffman, C. V. Jawahar, Richard A. Newcombe, Hyun Soo Park, James M. Rehg, Yoichi Sato, Manolis Savva, Jianbo Shi, Mike Zheng Shout, Michael Wray
2024CVPRVideo ReCap: Recursive Captioning of Hour-Long Videos.Md Mohaiminul Islam, Ngan Ho, Xitong Yang, Tushar Nagarajan, Lorenzo Torresani, Gedas Bertasius
2024CVPRLearning to Segment Referred Objects from Narrated Egocentric Videos.Yuhan Shen, Huiyu Wang, Xitong Yang, Matt Feiszli, Ehsan Elhamifar, Lorenzo Torresani, Effrosyni Mavroudi
2024CVPREgoSG: Learning 3D Scene Graphs from Egocentric RGB-D Sequences.Chaoyi Zhang, Xitong Yang, Ji Hou, Kris Kitani, Weidong Cai, Fu-Jen Chu
2024ECCVPropose, Assess, Search: Harnessing LLMs for Goal-Oriented Planning in Instructional Videos.Md Mohaiminul Islam, Tushar Nagarajan, Huiyu Wang, Fu-Jen Chu, Kris Kitani, Gedas Bertasius, Xitong Yang
2023CVPRTowards Scalable Neural Representation for Diverse Videos.Bo He, Xitong Yang, Hanyu Wang, Zuxuan Wu, Hao Chen, Shuaiyi Huang, Yixuan Ren, Ser-Nam Lim, Abhinav Shrivastava
2023CVPRVision Transformers are Good Mask Auto-Labelers.Shiyi Lan, Xitong Yang, Zhiding Yu, Zuxuan Wu, Jos M. lvarez, Anima Anandkumar
2023CVPRRelational Space-Time Query in Long-Form Videos.Xitong Yang, Fu-Jen Chu, Matt Feiszli, Raghav Goyal, Lorenzo Torresani, Du Tran
2023ICMLOpen-VCLIP: Transforming CLIP to an Open-vocabulary Video Model via Interpolated Weight Optimization.Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang
2022CVPRASM-Loc: Action-aware Segment Modeling for Weakly-Supervised Temporal Action Localization.Bo He, Xitong Yang, Le Kang, Zhiyu Cheng, Xin Zhou, Abhinav Shrivastava
2022ECCVEfficient Video Transformers with Spatial-Temporal Token Selection.Junke Wang, Xitong Yang, Hengduo Li, Li Liu, Zuxuan Wu, Yu-Gang Jiang
2022ECCVSemi-supervised Vision Transformers.Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang
2021BMVCGTA: Global Temporal Attention for Video Action Understanding.Bo He, Xitong Yang, Zuxuan Wu, Hao Chen, Ser-Nam Lim, Abhinav Shrivastava
2021BMVCHierarchical Contrastive Motion Learning for Video Action Recognition.Xitong Yang, Xiaodong Yang, Sifei Liu, Deqing Sun, Larry Davis, Jan Kautz
2021CVPRBeyond Short Clips: End-to-End Video-Level Learning With Collaborative Memories.Xitong Yang, Haoqi Fan, Lorenzo Torresani, Larry S. Davis, Heng Wang
2020ECCVA Generic Visualization Approach for Convolutional Neural Networks.Ahmed Taha, Xitong Yang, Abhinav Shrivastava, Larry Davis
2019CVPRSTEP: Spatio-Temporal Progressive Learning for Video Action Detection.Xitong Yang, Xiaodong Yang, Ming-Yu Liu, Fanyi Xiao, Larry S. Davis, Jan Kautz
2019ICCVCross-X Learning for Fine-Grained Visual Categorization.Wei Luo, Xitong Yang, Xianjie Mo, Yuheng Lu, Larry Davis, Jun Li, Jian Yang, Ser-Nam Lim
2018AAAITowards Perceptual Image Dehazing by Physics-Based Disentanglement and Adversarial Training.Xitong Yang, Zheng Xu, Jiebo Luo
2018BMVCStrong Baseline for Single Image Dehazing with Deep Features and Instance Normalization.Zheng Xu, Xitong Yang, Xue Li, Xiaoshuai Sun
2017CVPRDeep Multimodal Representation Learning from Temporal Data.Xitong Yang, Palghat Ramesh, Radha Chitta, Sriganesh Madhvanath, Edgar A. Bernal, Jiebo Luo
2015ICCVSemantic Video Entity Linking Based on Visual Content and Metadata.Yuncheng Li, Xitong Yang, Jiebo Luo