Skip to content

Tong He

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

81

Venues

20

Active years

2005–2025

Best venue rank

A*

Where they publish

Papers

81 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIGigaGS: 3D Gaussian Based Planar Representation for Large-Scene Surface Reconstruction.Junyi Chen, Weicai Ye, Yifan Wang, Danpeng Chen, Di Huang, Wanli Ouyang, Guofeng Zhang, Yu Qiao, Tong He
2025AISTATSCommon Learning Constraints Alter Interpretations of Direct Preference Optimization.Lemin Kong, Xiangkun Hu, Tong He, David Wipf
2025CVPRS4-Driver: Scalable Self-Supervised Driving Multimodal Large Language Model with Spatio-Temporal Visual Representation.Yichen Xie, Runsheng Xu, Tong He, Jyh-Jing Hwang, Katie Luo, Jingwei Ji, Hubert Lin, Letian Chen, Yiren Lu, Zhaoqi Leng, Dragomir Anguelov, Mingxing Tan
2025CVPRGoalFlow: Goal-Driven Flow Matching for Multimodal Trajectories Generation in End-to-End Autonomous Driving.Zebin Xing, Xingyu Zhang, Yang Hu, Bo Jiang, Tong He, Qian Zhang, Xiaoxiao Long, Wei Yin
2025CVPRTra-MoE: Learning Trajectory Prediction Model from Multiple Domains for Adaptive Policy Conditioning.Jiange Yang, Haoyi Zhu, Yating Wang, Gangshan Wu, Tong He, Limin Wang
2025ICCVEgoAgent: A Joint Predictive Agent Model in Egocentric Worlds.Lu Chen, Yizhou Wang, Shixiang Tang, Qianhong Ma, Tong He, Wanli Ouyang, Xiaowei Zhou, Hujun Bao, Sida Peng
2025ICCVVQ-VLA: Improving Vision-Language-Action Models via Scaling Vector-Quantized Action Tokenizers.Yating Wang, Haoyi Zhu, Mingyu Liu, Jiange Yang, Haoshu Fang, Tong He
2025ICCVAETHER: Geometric-Aware Unified World Modeling.Haoyi Zhu, Yifan Wang, Jianjun Zhou, Wenzheng Chang, Yang Zhou, Zizun Li, Junyi Chen, Chunhua Shen, Jiangmiao Pang, Tong He
2025ICLRBridging Information Asymmetry in Text-video Retrieval: A Data-centric Approach.Zechen Bai, Tianjun Xiao, Tong He, Pichao Wang, Zheng Zhang, Thomas Brox, Mike Zheng Shou
2025ICLRMeshAnything: Artist-Created Mesh Generation with Autoregressive Transformers.Yiwen Chen, Tong He, Di Huang, Weicai Ye, Sijin Chen, Jiaxiang Tang, Zhongang Cai, Lei Yang, Gang Yu, Guosheng Lin, Chi Zhang
2025ICLRWhere Am I and What Will I See: An Auto-Regressive Model for Spatial Localization and View Prediction.Junyi Chen, Di Huang, Weicai Ye, Wanli Ouyang, Tong He
2025ICLRProAdvPrompter: A Two-Stage Journey to Effective Adversarial Prompting for LLMs.Hao Di, Tong He, Haishan Ye, Yinghui Huang, Xiangyu Chang, Guang Dai, Ivor W. Tsang
2025ICLRLumina-T2X: Scalable Flow-based Large Diffusion Transformer for Flexible Resolution Generation.Peng Gao, Le Zhuo, Dongyang Liu, Ruoyi Du, Xu Luo, Longtian Qiu, Yuhang Zhang, Rongjie Huang, Shijie Geng, Renrui Zhang, Junlin Xie, Wenqi Shao, Zhengkai Jiang, Tianshuo Yang, Weicai Ye, Tong He, Jingwen He, Junjun He, Yu Qiao, Hongsheng Li
2025ICLRND-SDF: Learning Normal Deflection Fields for High-Fidelity Indoor Reconstruction.Ziyu Tang, Weicai Ye, Yifan Wang, Di Huang, Hujun Bao, Tong He, Guofeng Zhang
2025ICLRDepth Any Video with Scalable Synthetic Data.Honghui Yang, Di Huang, Wei Yin, Chunhua Shen, Haifeng Liu, Xiaofei He, Binbin Lin, Wanli Ouyang, Tong He
2025ICLRSPA: 3D Spatial-Awareness Enables Effective Embodied Representation.Haoyi Zhu, Honghui Yang, Yating Wang, Jiange Yang, Limin Wang, Tong He
2025ICMLExplicit Preference Optimization: No Need for an Implicit Reward Model.Xiangkun Hu, Lemin Kong, Tong He, David Wipf
2025ICMLSparse Autoencoders, Again?Yin Lu, Xuening Zhu, Tong He, David Wipf
2025ICRAVideoSAM: Open-World Video Segmentation.Pinxue Guo, Zixu Zhao, Jianxiong Gao, Chongruo Wu, Tong He, Zheng Zhang, Tianjun Xiao, Wenqiang Zhang
2025IROSEnhanced Motion Forecasting with Plug-and-Play Multimodal Large Language Models.Katie Luo, Jingwei Ji, Tong He, Runsheng Xu, Yichen Xie, Dragomir Anguelov, Mingxing Tan
2024AAAIFrozen CLIP Transformer Is an Efficient Point Cloud Encoder.Xiaoshui Huang, Zhou Huang, Sheng Li, Wentao Qu, Tong He, Yuenan Hou, Yifan Zuo, Wanli Ouyang
2024AAAIBoosting Residual Networks with Group Knowledge.Shengji Tang, Peng Ye, Baopu Li, Weihao Lin, Tao Chen, Tong He, Chong Yu, Wanli Ouyang
2024ACLCaMML: Context-Aware Multimodal Learner for Large Models.Yixin Chen, Shuai Zhang, Boran Han, Tong He, Bo Li
2024AISTATSGraph Machine Learning through the Lens of Bilevel Optimization.Amber Yijia Zheng, Tong He, Yixuan Qiu, Minjie Wang, David Wipf
2024CVPRPoint Transformer V3: Simpler, Faster, Stronger.Xiaoyang Wu, Li Jiang, Peng-Shuai Wang, Zhijian Liu, Xihui Liu, Yu Qiao, Wanli Ouyang, Tong He, Hengshuang Zhao
2024CVPRAdaptive Slot Attention: Object Discovery with Dynamic Slot Number.Ke Fan, Zechen Bai, Tianjun Xiao, Tong He, Max Horn, Yanwei Fu, Francesco Locatello, Zheng Zhang
2024CVPRTASeg: Temporal Aggregation Network for LiDAR Semantic Segmentation.Xiaopei Wu, Yuenan Hou, Xiaoshui Huang, Binbin Lin, Tong He, Xinge Zhu, Yuexin Ma, Boxi Wu, Haifeng Liu, Deng Cai, Wanli Ouyang
2024CVPRDreamComposer: Controllable 3D Object Generation via Multi-View Conditions.Yunhan Yang, Yukun Huang, Xiaoyang Wu, Yuan-Chen Guo, Song-Hai Zhang, Hengshuang Zhao, Tong He, Xihui Liu
2024CVPRUniPAD: A Universal Pre-Training Paradigm for Autonomous Driving.Honghui Yang, Sha Zhang, Di Huang, Xiaoyang Wu, Haoyi Zhu, Tong He, Shixiang Tang, Hengshuang Zhao, Qibo Qiu, Binbin Lin, Xiaofei He, Wanli Ouyang
2024CVPRLearning for Transductive Threshold Calibration in Open-World Recognition.Qin Zhang, Dongsheng An, Tianjun Xiao, Tong He, Qingming Tang, Ying Nian Wu, Joseph Tighe, Yifan Xing
2024ECCVGVGEN: Text-to-3D Generation with Volumetric Representation.Xianglong He, Junyi Chen, Sida Peng, Di Huang, Yangguang Li, Xiaoshui Huang, Chun Yuan, Wanli Ouyang, Tong He
2024ECCVPredBench: Benchmarking Spatio-Temporal Prediction Across Diverse Disciplines.Zidong Wang, Zeyu Lu, Di Huang, Tong He, Xihui Liu, Wanli Ouyang, Lei Bai
2024ECCVDetToolChain: A New Prompting Paradigm to Unleash Detection Ability of MLLM.Yixuan Wu, Yizhou Wang, Shixiang Tang, Wenhao Wu, Tong He, Wanli Ouyang, Philip Torr, Jian Wu
2024ECCVAgent3D-Zero: An Agent for Zero-Shot 3D Understanding.Sha Zhang, Di Huang, Jiajun Deng, Shixiang Tang, Wanli Ouyang, Tong He, Yanyong Zhang
2024ECCVPixel-GS: Density Control with Pixel-Aware Gradient for 3D Gaussian Splatting.Zheng Zhang, Wenbo Hu, Yixing Lao, Tong He, Hengshuang Zhao
2024ICLRConsistent Video-to-Video Transfer Using Synthetic Dataset.Jiaxin Cheng, Tianjun Xiao, Tong He
2024ICLRConvolution Meets LoRA: Parameter Efficient Finetuning for Segment Anything Model.Zihan Zhong, Zhiqiang Tang, Tong He, Haoyang Fang, Chun Yuan
2024ICRASTT: Stateful Tracking with Transformers for Autonomous Driving.Longlong Jing, Ruichi Yu, Xu Chen, Zhengli Zhao, Shiwei Sheng, Colin Graber, Qi Chen, Qinru Li, Shangxuan Wu, Han Deng, Sangjin Lee, Chris Sweeney, Qiurui He, Wei-Chih Hung, Tong He, Xingyi Zhou, Farshid Moussavi, James Guo, Yin Zhou, Mingxing Tan, Weilong Yang, Congcong Li
2024ICRAPVTransformer: Point-to-Voxel Transformer for Scalable 3D Object Detection.Zhaoqi Leng, Pei Sun, Tong He, Dragomir Anguelov, Mingxing Tan
2023CVPRCrossing the Gap: Domain Generalization for Image Captioning.Yuchen Ren, Zhendong Mao, Shancheng Fang, Yan Lu, Tong He, Hao Du, Yongdong Zhang, Wanli Ouyang
2023CVPRMM-3DScene: 3D Scene Understanding by Customizing Masked Modeling with Informative-Preserved Reconstruction and Self-Distilled Consistency.Mingye Xu, Mutian Xu, Tong He, Wanli Ouyang, Yali Wang, Xiaoguang Han, Yu Qiao
2023CVPRPVT-SSD: Single-Stage 3D Object Detector with Point-Voxel Transformer.Honghui Yang, Wenxiao Wang, Minghao Chen, Binbin Lin, Tong He, Hua Chen, Xiaofei He, Wanli Ouyang
2023CVPRGD-MAE: Generative Decoder for MAE Pre-Training on LiDAR Point Clouds.Honghui Yang, Tong He, Jiaheng Liu, Hua Chen, Boxi Wu, Binbin Lin, Xiaofei He, Wanli Ouyang
2023ICCVUnsupervised Open-Vocabulary Object Localization in Videos.Ke Fan, Zechen Bai, Tianjun Xiao, Dominik Zietlow, Max Horn, Zixu Zhao, Carl-Johann Simon-Gabriel, Mike Zheng Shou, Francesco Locatello, Bernt Schiele, Thomas Brox, Zheng Zhang, Yanwei Fu, Tong He
2023ICCVRethinking Amodal Video Segmentation from Learning Supervised Signals with Object-centric Representation.Ke Fan, Jingshi Lei, Xuelin Qian, Miaopeng Yu, Tianjun Xiao, Tong He, Zheng Zhang, Yanwei Fu
2023ICCVCoarse-to-Fine Amodal Segmentation with Shape Prior.Jianxiong Gao, Xuelin Qian, Yikai Wang, Tianjun Xiao, Tong He, Zheng Zhang, Yanwei Fu
2023ICCVPonder: Point Cloud Pre-training via Neural Rendering.Di Huang, Sida Peng, Tong He, Honghui Yang, Xiaowei Zhou, Wanli Ouyang
2023ICCVObject-Centric Multiple Object Tracking.Zixu Zhao, Jiaze Wang, Max Horn, Yizhuo Ding, Tong He, Zechen Bai, Dominik Zietlow, Carl-Johann Simon-Gabriel, Bing Shuai, Zhuowen Tu, Thomas Brox, Bernt Schiele, Yanwei Fu, Francesco Locatello, Zheng Zhang, Tianjun Xiao
2023ICDMCompatible Transformer for Irregularly Sampled Multivariate Time Series.Yuxi Wei, Juntong Peng, Tong He, Chenxin Xu, Jian Zhang, Shirui Pan, Siheng Chen
2023ICLRBridging the Gap to Real-World Object-Centric Learning.Maximilian Seitzer, Max Horn, Andrii Zadaianchuk, Dominik Zietlow, Tianjun Xiao, Carl-Johann Simon-Gabriel, Tong He, Zheng Zhang, Bernhard Schlkopf, Thomas Brox, Francesco Locatello
2023ICRALidar Augment: Searching for Scalable 3D LiDAR Data Augmentations.Zhaoqi Leng, Guowang Li, Chenxi Liu, Ekin Dogus Cubuk, Pei Sun, Tong He, Dragomir Anguelov, Mingxing Tan
2023IROSLEF: Late-to-Early Temporal Fusion for LiDAR 3D Object Detection.Tong He, Pei Sun, Zhaoqi Leng, Chenxi Liu, Dragomir Anguelov, Mingxing Tan
2022CVPRResNeSt: Split-Attention Networks.Hang Zhang, Chongruo Wu, Zhongyue Zhang, Yi Zhu, Haibin Lin, Zhi Zhang, Yue Sun, Tong He, Jonas Mueller, R. Manmatha, Mu Li, Alexander J. Smola
2022ECCVPSS: Progressive Sample Selection for Open-World Visual Representation Learning.Tianyue Cao, Yongxin Wang, Yifan Xing, Tianjun Xiao, Tong He, Zheng Zhang, Hao Zhou, Joseph Tighe
2022ECCVPointInst3D: Segmenting 3D Instances by Points.Tong He, Wei Yin, Chunhua Shen, Anton van den Hengel
2022SiggraphAReconstructing Hand-Held Objects from Monocular Video.Di Huang, Xiaopeng Ji, Xingyi He, Jiaming Sun, Tong He, Qing Shuai, Wanli Ouyang, Xiaowei Zhou
2021CVPRDyCo3D: Robust Instance Segmentation of 3D Point Clouds Through Dynamic Convolution.Tong He, Chunhua Shen, Anton van den Hengel
2021CVPRHCRF-Flow: Scene Flow From Point Clouds With Continuous High-Order CRFs and Position-Aware Flow Embedding.Ruibo Li, Guosheng Lin, Tong He, Fayao Liu, Chunhua Shen
2021ICCVARCH++: Animation-Ready Clothed Human Reconstruction Revisited.Tong He, Yuanlu Xu, Shunsuke Saito, Stefano Soatto, Tony Tung
2021ICCVLearning Hierarchical Graph Neural Networks for Image Clustering.Yifan Xing, Tong He, Tianjun Xiao, Yongxin Wang, Yuanjun Xiong, Wei Xia, David Wipf, Zheng Zhang, Stefano Soatto
2020ACCVDeepVoxels++: Enhancing the Fidelity of Novel View Synthesis from 3D Voxel Embeddings.Tong He, John P. Collomosse, Hailin Jin, Stefano Soatto
2020CoRLSAM: Squeeze-and-Mimic Networks for Conditional Visual Driving Policy Learning.Albert Zhao, Tong He, Yitao Liang, Haibin Huang, Guy Van den Broeck, Stefano Soatto
2020CVPRABCNet: Real-Time Scene Text Spotting With Adaptive Bezier-Curve Network.Yuliang Liu, Hao Chen, Chunhua Shen, Tong He, Lianwen Jin, Liangwei Wang
2020ECCVLearning and Memorizing Representative Prototypes for 3D Point Cloud Semantic and Instance Segmentation.Tong He, Dong Gong, Zhi Tian, Chunhua Shen
2020ECCVInstance-Aware Embedding for Point Cloud Instance Segmentation.Tong He, Yifan Liu, Chunhua Shen, Xinlong Wang, Changming Sun
2019AAAIMono3D++: Monocular 3D Vehicle Detection with Two-Scale 3D Hypotheses and Task Priors.Tong He, Stefano Soatto
2019CVPRGeoNet: Deep Geodesic Networks for Point Cloud Analysis.Tong He, Haibin Huang, Li Yi, Yuqian Zhou, Chihao Wu, Jue Wang, Stefano Soatto
2019CVPRKnowledge Adaptation for Efficient Semantic Segmentation.Tong He, Chunhua Shen, Zhi Tian, Dong Gong, Changming Sun, Youliang Yan
2019CVPRBag of Tricks for Image Classification with Convolutional Neural Networks.Tong He, Zhi Zhang, Hang Zhang, Zhongyue Zhang, Junyuan Xie, Mu Li
2019CVPRDecoders Matter for Semantic Segmentation: Data-Dependent Decoding Enables Flexible Feature Aggregation.Zhi Tian, Tong He, Chunhua Shen, Youliang Yan
2019CVPRGIF2Video: Color Dequantization and Temporal Interpolation of GIF Images.Yang Wang, Haibin Huang, Chuan Wang, Tong He, Jue Wang, Minh Hoai
2019ICCADAnalyzing and Modeling In-Storage Computing Workloads On EISC - An FPGA-Based System-Level Emulation Platform.Zhenyuan Ruan, Tong He, Jason Cong
2019ICCVFCOS: Fully Convolutional One-Stage Object Detection.Zhi Tian, Chunhua Shen, Hao Chen, Tong He
2019USENIXINSIDER: Designing In-Storage Computing System for Emerging High-Performance Drive.Zhenyuan Ruan, Tong He, Jason Cong
2018CVPRAn End-to-End TextSpotter With Explicit Alignment and Attention.Tong He, Zhi Tian, Weilin Huang, Chunhua Shen, Yu Qiao, Changming Sun
2018FCCMST-Accel: A High-Level Programming Platform for Streaming Applications on FPGA.Zhenyuan Ruan, Tong He, Bojie Li, Peipei Zhou, Jason Cong
2017ICCVSingle Shot Text Detector with Regional Attention.Pan He, Weilin Huang, Tong He, Qile Zhu, Yu Qiao, Xiaolin Li
2017ICIGShape Recovery of Endoscopic Videos by Shape from Shading Using Mesh Regularization.Zhihang Ren, Tong He, Lingbing Peng, Shuaicheng Liu, Shuyuan Zhu, Bing Zeng
2016ECCVDetecting Text in Natural Image with Connectionist Text Proposal Network.Zhi Tian, Weilin Huang, Tong He, Pan He, Yu Qiao
2006ISDAWeighted Rough Graph and Its Application.Tong He, Yong Chen, Kaiquan Shi
2005ACIIAffective Computing Model Based on Rough Sets.Yong Chen, Tong He