Tong He
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
81
Venues
20
Active years
2005–2025
Best venue rank
A*
Where they publish
Papers
81 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | GigaGS: 3D Gaussian Based Planar Representation for Large-Scene Surface Reconstruction. | Junyi Chen, Weicai Ye, Yifan Wang, Danpeng Chen, Di Huang, Wanli Ouyang, Guofeng Zhang, Yu Qiao, Tong He |
| 2025 | AISTATS | Common Learning Constraints Alter Interpretations of Direct Preference Optimization. | Lemin Kong, Xiangkun Hu, Tong He, David Wipf |
| 2025 | CVPR | S4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Model with Spatio-Temporal Visual Representation. | Yichen Xie, Runsheng Xu, Tong He, Jyh-Jing Hwang, Katie Luo, Jingwei Ji, Hubert Lin, Letian Chen, Yiren Lu, Zhaoqi Leng, Dragomir Anguelov, Mingxing Tan |
| 2025 | CVPR | GoalFlow: Goal-Driven Flow Matching for Multimodal Trajectories Generation in End-to-End Autonomous Driving. | Zebin Xing, Xingyu Zhang, Yang Hu, Bo Jiang, Tong He, Qian Zhang, Xiaoxiao Long, Wei Yin |
| 2025 | CVPR | Tra-MoE: Learning Trajectory Prediction Model from Multiple Domains for Adaptive Policy Conditioning. | Jiange Yang, Haoyi Zhu, Yating Wang, Gangshan Wu, Tong He, Limin Wang |
| 2025 | ICCV | EgoAgent: A Joint Predictive Agent Model in Egocentric Worlds. | Lu Chen, Yizhou Wang, Shixiang Tang, Qianhong Ma, Tong He, Wanli Ouyang, Xiaowei Zhou, Hujun Bao, Sida Peng |
| 2025 | ICCV | VQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers. | Yating Wang, Haoyi Zhu, Mingyu Liu, Jiange Yang, Haoshu Fang, Tong He |
| 2025 | ICCV | AETHER: Geometric-Aware Unified World Modeling. | Haoyi Zhu, Yifan Wang, Jianjun Zhou, Wenzheng Chang, Yang Zhou, Zizun Li, Junyi Chen, Chunhua Shen, Jiangmiao Pang, Tong He |
| 2025 | ICLR | Bridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach. | Zechen Bai, Tianjun Xiao, Tong He, Pichao Wang, Zheng Zhang, Thomas Brox, Mike Zheng Shou |
| 2025 | ICLR | MeshAnything: Artist-Created Mesh Generation with Autoregressive Transformers. | Yiwen Chen, Tong He, Di Huang, Weicai Ye, Sijin Chen, Jiaxiang Tang, Zhongang Cai, Lei Yang, Gang Yu, Guosheng Lin, Chi Zhang |
| 2025 | ICLR | Where Am I and What Will I See: An Auto-Regressive Model for Spatial Localization and View Prediction. | Junyi Chen, Di Huang, Weicai Ye, Wanli Ouyang, Tong He |
| 2025 | ICLR | ProAdvPrompter: A Two-Stage Journey to Effective Adversarial Prompting for LLMs. | Hao Di, Tong He, Haishan Ye, Yinghui Huang, Xiangyu Chang, Guang Dai, Ivor W. Tsang |
| 2025 | ICLR | Lumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation. | Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li |
| 2025 | ICLR | ND-SDF: Learning Normal Deflection Fields for High-Fidelity Indoor Reconstruction. | Ziyu Tang, Weicai Ye, Yifan Wang, Di Huang, Hujun Bao, Tong He, Guofeng Zhang |
| 2025 | ICLR | Depth Any Video with Scalable Synthetic Data. | Honghui Yang, Di Huang, Wei Yin, Chunhua Shen, Haifeng Liu, Xiaofei He, Binbin Lin, Wanli Ouyang, Tong He |
| 2025 | ICLR | SPA: 3D Spatial-Awareness Enables Effective Embodied Representation. | Haoyi Zhu, Honghui Yang, Yating Wang, Jiange Yang, Limin Wang, Tong He |
| 2025 | ICML | Explicit Preference Optimization: No Need for an Implicit Reward Model. | Xiangkun Hu, Lemin Kong, Tong He, David Wipf |
| 2025 | ICML | Sparse Autoencoders, Again? | Yin Lu, Xuening Zhu, Tong He, David Wipf |
| 2025 | ICRA | VideoSAM: Open-World Video Segmentation. | Pinxue Guo, Zixu Zhao, Jianxiong Gao, Chongruo Wu, Tong He, Zheng Zhang, Tianjun Xiao, Wenqiang Zhang |
| 2025 | IROS | Enhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models. | Katie Luo, Jingwei Ji, Tong He, Runsheng Xu, Yichen Xie, Dragomir Anguelov, Mingxing Tan |
| 2024 | AAAI | Frozen CLIP Transformer Is an Efficient Point Cloud Encoder. | Xiaoshui Huang, Zhou Huang, Sheng Li, Wentao Qu, Tong He, Yuenan Hou, Yifan Zuo, Wanli Ouyang |
| 2024 | AAAI | Boosting Residual Networks with Group Knowledge. | Shengji Tang, Peng Ye, Baopu Li, Weihao Lin, Tao Chen, Tong He, Chong Yu, Wanli Ouyang |
| 2024 | ACL | CaMML: Context-Aware Multimodal Learner for Large Models. | Yixin Chen, Shuai Zhang, Boran Han, Tong He, Bo Li |
| 2024 | AISTATS | Graph Machine Learning through the Lens of Bilevel Optimization. | Amber Yijia Zheng, Tong He, Yixuan Qiu, Minjie Wang, David Wipf |
| 2024 | CVPR | Point Transformer V3: Simpler, Faster, Stronger. | Xiaoyang Wu, Li Jiang, Peng-Shuai Wang, Zhijian Liu, Xihui Liu, Yu Qiao, Wanli Ouyang, Tong He, Hengshuang Zhao |
| 2024 | CVPR | Adaptive Slot Attention: Object Discovery with Dynamic Slot Number. | Ke Fan, Zechen Bai, Tianjun Xiao, Tong He, Max Horn, Yanwei Fu, Francesco Locatello, Zheng Zhang |
| 2024 | CVPR | TASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation. | Xiaopei Wu, Yuenan Hou, Xiaoshui Huang, Binbin Lin, Tong He, Xinge Zhu, Yuexin Ma, Boxi Wu, Haifeng Liu, Deng Cai, Wanli Ouyang |
| 2024 | CVPR | DreamComposer: Controllable 3D Object Generation via Multi-View Conditions. | Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu |
| 2024 | CVPR | UniPAD: A Universal Pre-Training Paradigm for Autonomous Driving. | Honghui Yang, Sha Zhang, Di Huang, Xiaoyang Wu, Haoyi Zhu, Tong He, Shixiang Tang, Hengshuang Zhao, Qibo Qiu, Binbin Lin, Xiaofei He, Wanli Ouyang |
| 2024 | CVPR | Learning for Transductive Threshold Calibration in Open-World Recognition. | Qin Zhang, Dongsheng An, Tianjun Xiao, Tong He, Qingming Tang, Ying Nian Wu, Joseph Tighe, Yifan Xing |
| 2024 | ECCV | GVGEN: Text-to-3D Generation with Volumetric Representation. | Xianglong He, Junyi Chen, Sida Peng, Di Huang, Yangguang Li, Xiaoshui Huang, Chun Yuan, Wanli Ouyang, Tong He |
| 2024 | ECCV | PredBench: Benchmarking Spatio-Temporal Prediction Across Diverse Disciplines. | Zidong Wang, Zeyu Lu, Di Huang, Tong He, Xihui Liu, Wanli Ouyang, Lei Bai |
| 2024 | ECCV | DetToolChain: A New Prompting Paradigm to Unleash Detection Ability of MLLM. | Yixuan Wu, Yizhou Wang, Shixiang Tang, Wenhao Wu, Tong He, Wanli Ouyang, Philip Torr, Jian Wu |
| 2024 | ECCV | Agent3D-Zero: An Agent for Zero-Shot 3D Understanding. | Sha Zhang, Di Huang, Jiajun Deng, Shixiang Tang, Wanli Ouyang, Tong He, Yanyong Zhang |
| 2024 | ECCV | Pixel-GS: Density Control with Pixel-Aware Gradient for 3D Gaussian Splatting. | Zheng Zhang, Wenbo Hu, Yixing Lao, Tong He, Hengshuang Zhao |
| 2024 | ICLR | Consistent Video-to-Video Transfer Using Synthetic Dataset. | Jiaxin Cheng, Tianjun Xiao, Tong He |
| 2024 | ICLR | Convolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything Model. | Zihan Zhong, Zhiqiang Tang, Tong He, Haoyang Fang, Chun Yuan |
| 2024 | ICRA | STT: Stateful Tracking with Transformers for Autonomous Driving. | Longlong Jing, Ruichi Yu, Xu Chen, Zhengli Zhao, Shiwei Sheng, Colin Graber, Qi Chen, Qinru Li, Shangxuan Wu, Han Deng, Sangjin Lee, Chris Sweeney, Qiurui He, Wei-Chih Hung, Tong He, Xingyi Zhou, Farshid Moussavi, James Guo, Yin Zhou, Mingxing Tan, Weilong Yang, Congcong Li |
| 2024 | ICRA | PVTransformer: Point-to-Voxel Transformer for Scalable 3D Object Detection. | Zhaoqi Leng, Pei Sun, Tong He, Dragomir Anguelov, Mingxing Tan |
| 2023 | CVPR | Crossing the Gap: Domain Generalization for Image Captioning. | Yuchen Ren, Zhendong Mao, Shancheng Fang, Yan Lu, Tong He, Hao Du, Yongdong Zhang, Wanli Ouyang |
| 2023 | CVPR | MM-3DScene: 3D Scene Understanding by Customizing Masked Modeling with Informative-Preserved Reconstruction and Self-Distilled Consistency. | Mingye Xu, Mutian Xu, Tong He, Wanli Ouyang, Yali Wang, Xiaoguang Han, Yu Qiao |
| 2023 | CVPR | PVT-SSD: Single-Stage 3D Object Detector with Point-Voxel Transformer. | Honghui Yang, Wenxiao Wang, Minghao Chen, Binbin Lin, Tong He, Hua Chen, Xiaofei He, Wanli Ouyang |
| 2023 | CVPR | GD-MAE: Generative Decoder for MAE Pre-Training on LiDAR Point Clouds. | Honghui Yang, Tong He, Jiaheng Liu, Hua Chen, Boxi Wu, Binbin Lin, Xiaofei He, Wanli Ouyang |
| 2023 | ICCV | Unsupervised Open-Vocabulary Object Localization in Videos. | Ke Fan, Zechen Bai, Tianjun Xiao, Dominik Zietlow, Max Horn, Zixu Zhao, Carl-Johann Simon-Gabriel, Mike Zheng Shou, Francesco Locatello, Bernt Schiele, Thomas Brox, Zheng Zhang, Yanwei Fu, Tong He |
| 2023 | ICCV | Rethinking Amodal Video Segmentation from Learning Supervised Signals with Object-centric Representation. | Ke Fan, Jingshi Lei, Xuelin Qian, Miaopeng Yu, Tianjun Xiao, Tong He, Zheng Zhang, Yanwei Fu |
| 2023 | ICCV | Coarse-to-Fine Amodal Segmentation with Shape Prior. | Jianxiong Gao, Xuelin Qian, Yikai Wang, Tianjun Xiao, Tong He, Zheng Zhang, Yanwei Fu |
| 2023 | ICCV | Ponder: Point Cloud Pre-training via Neural Rendering. | Di Huang, Sida Peng, Tong He, Honghui Yang, Xiaowei Zhou, Wanli Ouyang |
| 2023 | ICCV | Object-Centric Multiple Object Tracking. | Zixu Zhao, Jiaze Wang, Max Horn, Yizhuo Ding, Tong He, Zechen Bai, Dominik Zietlow, Carl-Johann Simon-Gabriel, Bing Shuai, Zhuowen Tu, Thomas Brox, Bernt Schiele, Yanwei Fu, Francesco Locatello, Zheng Zhang, Tianjun Xiao |
| 2023 | ICDM | Compatible Transformer for Irregularly Sampled Multivariate Time Series. | Yuxi Wei, Juntong Peng, Tong He, Chenxin Xu, Jian Zhang, Shirui Pan, Siheng Chen |
| 2023 | ICLR | Bridging the Gap to Real-World Object-Centric Learning. | Maximilian Seitzer, Max Horn, Andrii Zadaianchuk, Dominik Zietlow, Tianjun Xiao, Carl-Johann Simon-Gabriel, Tong He, Zheng Zhang, Bernhard Schlkopf, Thomas Brox, Francesco Locatello |
| 2023 | ICRA | Lidar Augment: Searching for Scalable 3D LiDAR Data Augmentations. | Zhaoqi Leng, Guowang Li, Chenxi Liu, Ekin Dogus Cubuk, Pei Sun, Tong He, Dragomir Anguelov, Mingxing Tan |
| 2023 | IROS | LEF: Late-to-Early Temporal Fusion for LiDAR 3D Object Detection. | Tong He, Pei Sun, Zhaoqi Leng, Chenxi Liu, Dragomir Anguelov, Mingxing Tan |
| 2022 | CVPR | ResNeSt: Split-Attention Networks. | Hang Zhang, Chongruo Wu, Zhongyue Zhang, Yi Zhu, Haibin Lin, Zhi Zhang, Yue Sun, Tong He, Jonas Mueller, R. Manmatha, Mu Li, Alexander J. Smola |
| 2022 | ECCV | PSS: Progressive Sample Selection for Open-World Visual Representation Learning. | Tianyue Cao, Yongxin Wang, Yifan Xing, Tianjun Xiao, Tong He, Zheng Zhang, Hao Zhou, Joseph Tighe |
| 2022 | ECCV | PointInst3D: Segmenting 3D Instances by Points. | Tong He, Wei Yin, Chunhua Shen, Anton van den Hengel |
| 2022 | SiggraphA | Reconstructing Hand-Held Objects from Monocular Video. | Di Huang, Xiaopeng Ji, Xingyi He, Jiaming Sun, Tong He, Qing Shuai, Wanli Ouyang, Xiaowei Zhou |
| 2021 | CVPR | DyCo3D: Robust Instance Segmentation of 3D Point Clouds Through Dynamic Convolution. | Tong He, Chunhua Shen, Anton van den Hengel |
| 2021 | CVPR | HCRF-Flow: Scene Flow From Point Clouds With Continuous High-Order CRFs and Position-Aware Flow Embedding. | Ruibo Li, Guosheng Lin, Tong He, Fayao Liu, Chunhua Shen |
| 2021 | ICCV | ARCH++: Animation-Ready Clothed Human Reconstruction Revisited. | Tong He, Yuanlu Xu, Shunsuke Saito, Stefano Soatto, Tony Tung |
| 2021 | ICCV | Learning Hierarchical Graph Neural Networks for Image Clustering. | Yifan Xing, Tong He, Tianjun Xiao, Yongxin Wang, Yuanjun Xiong, Wei Xia, David Wipf, Zheng Zhang, Stefano Soatto |
| 2020 | ACCV | DeepVoxels++: Enhancing the Fidelity of Novel View Synthesis from 3D Voxel Embeddings. | Tong He, John P. Collomosse, Hailin Jin, Stefano Soatto |
| 2020 | CoRL | SAM: Squeeze-and-Mimic Networks for Conditional Visual Driving Policy Learning. | Albert Zhao, Tong He, Yitao Liang, Haibin Huang, Guy Van den Broeck, Stefano Soatto |
| 2020 | CVPR | ABCNet: Real-Time Scene Text Spotting With Adaptive Bezier-Curve Network. | Yuliang Liu, Hao Chen, Chunhua Shen, Tong He, Lianwen Jin, Liangwei Wang |
| 2020 | ECCV | Learning and Memorizing Representative Prototypes for 3D Point Cloud Semantic and Instance Segmentation. | Tong He, Dong Gong, Zhi Tian, Chunhua Shen |
| 2020 | ECCV | Instance-Aware Embedding for Point Cloud Instance Segmentation. | Tong He, Yifan Liu, Chunhua Shen, Xinlong Wang, Changming Sun |
| 2019 | AAAI | Mono3D++: Monocular 3D Vehicle Detection with Two-Scale 3D Hypotheses and Task Priors. | Tong He, Stefano Soatto |
| 2019 | CVPR | GeoNet: Deep Geodesic Networks for Point Cloud Analysis. | Tong He, Haibin Huang, Li Yi, Yuqian Zhou, Chihao Wu, Jue Wang, Stefano Soatto |
| 2019 | CVPR | Knowledge Adaptation for Efficient Semantic Segmentation. | Tong He, Chunhua Shen, Zhi Tian, Dong Gong, Changming Sun, Youliang Yan |
| 2019 | CVPR | Bag of Tricks for Image Classification with Convolutional Neural Networks. | Tong He, Zhi Zhang, Hang Zhang, Zhongyue Zhang, Junyuan Xie, Mu Li |
| 2019 | CVPR | Decoders Matter for Semantic Segmentation: Data-Dependent Decoding Enables Flexible Feature Aggregation. | Zhi Tian, Tong He, Chunhua Shen, Youliang Yan |
| 2019 | CVPR | GIF2Video: Color Dequantization and Temporal Interpolation of GIF Images. | Yang Wang, Haibin Huang, Chuan Wang, Tong He, Jue Wang, Minh Hoai |
| 2019 | ICCAD | Analyzing and Modeling In-Storage Computing Workloads On EISC - An FPGA-Based System-Level Emulation Platform. | Zhenyuan Ruan, Tong He, Jason Cong |
| 2019 | ICCV | FCOS: Fully Convolutional One-Stage Object Detection. | Zhi Tian, Chunhua Shen, Hao Chen, Tong He |
| 2019 | USENIX | INSIDER: Designing In-Storage Computing System for Emerging High-Performance Drive. | Zhenyuan Ruan, Tong He, Jason Cong |
| 2018 | CVPR | An End-to-End TextSpotter With Explicit Alignment and Attention. | Tong He, Zhi Tian, Weilin Huang, Chunhua Shen, Yu Qiao, Changming Sun |
| 2018 | FCCM | ST-Accel: A High-Level Programming Platform for Streaming Applications on FPGA. | Zhenyuan Ruan, Tong He, Bojie Li, Peipei Zhou, Jason Cong |
| 2017 | ICCV | Single Shot Text Detector with Regional Attention. | Pan He, Weilin Huang, Tong He, Qile Zhu, Yu Qiao, Xiaolin Li |
| 2017 | ICIG | Shape Recovery of Endoscopic Videos by Shape from Shading Using Mesh Regularization. | Zhihang Ren, Tong He, Lingbing Peng, Shuaicheng Liu, Shuyuan Zhu, Bing Zeng |
| 2016 | ECCV | Detecting Text in Natural Image with Connectionist Text Proposal Network. | Zhi Tian, Weilin Huang, Tong He, Pan He, Yu Qiao |
| 2006 | ISDA | Weighted Rough Graph and Its Application. | Tong He, Yong Chen, Kaiquan Shi |
| 2005 | ACII | Affective Computing Model Based on Rough Sets. | Yong Chen, Tong He |