Xitong Yang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
24
Venues
7
Active years
2015–2025
Best venue rank
A*
Where they publish
Papers
24 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | CVPR | Progress-Aware Video Frame Captioning. | Zihui Xue, Joungbin An, Xitong Yang, Kristen Grauman |
| 2025 | DATE | HyIMC: Analog-Digital Hybrid In-Memory Computing SoC for High-Quality Low-Latency Speech Enhancement. | Wanru Mao, Hanjie Liu, Guangyao Wang, Tianshuo Bai, Jingcheng Gu, Han Zhang, Xitong Yang, Aifei Zhang, Xiaohang Wei, Meng Wang, Wang Kang |
| 2024 | CVPR | Ego-Exo4D: Understanding Skilled Human Activity from First- and Third-Person Perspectives. | Kristen Grauman, Andrew Westbury, Lorenzo Torresani, Kris Kitani, Jitendra Malik, Triantafyllos Afouras, Kumar Ashutosh, Vijay Baiyya, Siddhant Bansal, Bikram Boote, Eugene Byrne, Zachary Chavis, Joya Chen, Feng Cheng, Fu-Jen Chu, Sean Crane, Avijit Dasgupta, Jing Dong, Mara Escobar, Cristhian Forigua, Abrham Gebreselasie, Sanjay Haresh, Jing Huang, Md Mohaiminul Islam, Suyog Dutt Jain, Rawal Khirodkar, Devansh Kukreja, Kevin J. Liang, Jia-Wei Liu, Sagnik Majumder, Yongsen Mao, Miguel Martin, Effrosyni Mavroudi, Tushar Nagarajan, Francesco Ragusa, Santhosh Kumar Ramakrishnan, Luigi Seminara, Arjun Somayazulu, Yale Song, Shan Su, Zihui Xue, Edward Zhang, Jinxu Zhang, Angela Castillo, Changan Chen, Xinzhu Fu, Ryosuke Furuta, Cristina Gonzlez, Prince Gupta, Jiabo Hu, Yifei Huang, Yiming Huang, Weslie Khoo, Anush Kumar, Robert Kuo, Sach Lakhavani, Miao Liu, Mi Luo, Zhengyi Luo, Brighid Meredith, Austin Miller, Oluwatumininu Oguntola, Xiaqing Pan, Penny Peng, Shraman Pramanick, Merey Ramazanova, Fiona Ryan, Wei Shan, Kiran K. Somasundaram, Chenan Song, Audrey Southerland, Masatoshi Tateno, Huiyu Wang, Yuchen Wang, Takuma Yagi, Mingfei Yan, Xitong Yang, Zecheng Yu, Shengxin Cindy Zha, Chen Zhao, Ziwei Zhao, Zhifan Zhu, Jeff Zhuo, Pablo Arbelez, Gedas Bertasius, Dima Damen, Jakob J. Engel, Giovanni Maria Farinella, Antonino Furnari, Bernard Ghanem, Judy Hoffman, C. V. Jawahar, Richard A. Newcombe, Hyun Soo Park, James M. Rehg, Yoichi Sato, Manolis Savva, Jianbo Shi, Mike Zheng Shout, Michael Wray |
| 2024 | CVPR | Video ReCap: Recursive Captioning of Hour-Long Videos. | Md Mohaiminul Islam, Ngan Ho, Xitong Yang, Tushar Nagarajan, Lorenzo Torresani, Gedas Bertasius |
| 2024 | CVPR | Learning to Segment Referred Objects from Narrated Egocentric Videos. | Yuhan Shen, Huiyu Wang, Xitong Yang, Matt Feiszli, Ehsan Elhamifar, Lorenzo Torresani, Effrosyni Mavroudi |
| 2024 | CVPR | EgoSG: Learning 3D Scene Graphs from Egocentric RGB-D Sequences. | Chaoyi Zhang, Xitong Yang, Ji Hou, Kris Kitani, Weidong Cai, Fu-Jen Chu |
| 2024 | ECCV | Propose, Assess, Search: Harnessing LLMs for Goal-Oriented Planning in Instructional Videos. | Md Mohaiminul Islam, Tushar Nagarajan, Huiyu Wang, Fu-Jen Chu, Kris Kitani, Gedas Bertasius, Xitong Yang |
| 2023 | CVPR | Towards Scalable Neural Representation for Diverse Videos. | Bo He, Xitong Yang, Hanyu Wang, Zuxuan Wu, Hao Chen, Shuaiyi Huang, Yixuan Ren, Ser-Nam Lim, Abhinav Shrivastava |
| 2023 | CVPR | Vision Transformers are Good Mask Auto-Labelers. | Shiyi Lan, Xitong Yang, Zhiding Yu, Zuxuan Wu, Jos M. lvarez, Anima Anandkumar |
| 2023 | CVPR | Relational Space-Time Query in Long-Form Videos. | Xitong Yang, Fu-Jen Chu, Matt Feiszli, Raghav Goyal, Lorenzo Torresani, Du Tran |
| 2023 | ICML | Open-VCLIP: Transforming CLIP to an Open-vocabulary Video Model via Interpolated Weight Optimization. | Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | CVPR | ASM-Loc: Action-aware Segment Modeling for Weakly-Supervised Temporal Action Localization. | Bo He, Xitong Yang, Le Kang, Zhiyu Cheng, Xin Zhou, Abhinav Shrivastava |
| 2022 | ECCV | Efficient Video Transformers with Spatial-Temporal Token Selection. | Junke Wang, Xitong Yang, Hengduo Li, Li Liu, Zuxuan Wu, Yu-Gang Jiang |
| 2022 | ECCV | Semi-supervised Vision Transformers. | Zejia Weng, Xitong Yang, Ang Li, Zuxuan Wu, Yu-Gang Jiang |
| 2021 | BMVC | GTA: Global Temporal Attention for Video Action Understanding. | Bo He, Xitong Yang, Zuxuan Wu, Hao Chen, Ser-Nam Lim, Abhinav Shrivastava |
| 2021 | BMVC | Hierarchical Contrastive Motion Learning for Video Action Recognition. | Xitong Yang, Xiaodong Yang, Sifei Liu, Deqing Sun, Larry Davis, Jan Kautz |
| 2021 | CVPR | Beyond Short Clips: End-to-End Video-Level Learning With Collaborative Memories. | Xitong Yang, Haoqi Fan, Lorenzo Torresani, Larry S. Davis, Heng Wang |
| 2020 | ECCV | A Generic Visualization Approach for Convolutional Neural Networks. | Ahmed Taha, Xitong Yang, Abhinav Shrivastava, Larry Davis |
| 2019 | CVPR | STEP: Spatio-Temporal Progressive Learning for Video Action Detection. | Xitong Yang, Xiaodong Yang, Ming-Yu Liu, Fanyi Xiao, Larry S. Davis, Jan Kautz |
| 2019 | ICCV | Cross-X Learning for Fine-Grained Visual Categorization. | Wei Luo, Xitong Yang, Xianjie Mo, Yuheng Lu, Larry Davis, Jun Li, Jian Yang, Ser-Nam Lim |
| 2018 | AAAI | Towards Perceptual Image Dehazing by Physics-Based Disentanglement and Adversarial Training. | Xitong Yang, Zheng Xu, Jiebo Luo |
| 2018 | BMVC | Strong Baseline for Single Image Dehazing with Deep Features and Instance Normalization. | Zheng Xu, Xitong Yang, Xue Li, Xiaoshuai Sun |
| 2017 | CVPR | Deep Multimodal Representation Learning from Temporal Data. | Xitong Yang, Palghat Ramesh, Radha Chitta, Sriganesh Madhvanath, Edgar A. Bernal, Jiebo Luo |
| 2015 | ICCV | Semantic Video Entity Linking Based on Visual Content and Metadata. | Yuncheng Li, Xitong Yang, Jiebo Luo |