Skip to content

Yansong Tang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

66

Venues

14

Active years

2017–2025

Best venue rank

A*

Where they publish

Papers

66 indexed papers, newest first.

YearVenueTitleAuthors
2025AAAIIteRPrimE: Zero-shot Referring Image Segmentation with Iterative Grad-CAM Refinement and Primary Word Emphasis.Yuji Wang, Jingchen Ni, Yong Liu, Chun Yuan, Yansong Tang
2025ACLPonder & Press: Advancing Visual GUI Agent towards General Computer Control.Yiqin Wang, Haoji Zhang, Jingqi Tian, Yansong Tang
2025CVPRCoarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model.Benlin Liu, Yuhao Dong, Yiqin Wang, Zixian Ma, Yansong Tang, Luming Tang, Yongming Rao, Wei-Chiu Ma, Ranjay Krishna
2025CVPRSAM2-LOVE: Segment Anything Model 2 in Language-aided Audio-Visual Scenes.Yuji Wang, Haoran Xu, Yong Liu, Jiaze Li, Yansong Tang
2025CVPRATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models.Xubing Ye, Yukang Gan, Yixiao Ge, Xiao-Ping Zhang, Yansong Tang
2025CVPRVoCo-LLaMA: Towards Vision Compression with Large Language Models.Xubing Ye, Yukang Gan, Xiaoke Huang, Yixiao Ge, Yansong Tang
2025CVPRFADE: Frequency-Aware Diffusion Model Factorization for Video Editing.Yixuan Zhu, Haolin Wang, Shilin Ma, Wenliang Zhao, Yansong Tang, Lei Chen, Jie Zhou
2025ICCVMomentum-Gs: Momentum Gaussian Self-Distillation for High-Quality Large Scene Reconstruction.Jixuan Fan, Wanhua Li, Yifei Han, Tianru Dai, Yansong Tang
2025ICCVScoreHOI: Physically Plausible Reconstruction of Human-Object Interaction via Score-Guided Diffusion.Ao Li, Jinpeng Liu, Yixuan Zhu, Yansong Tang
2025ICCVStepping Out of Similar Semantic Space for Open-Vocabulary Segmentation.Yong Liu, Song-Li Wu, Sule Bai, Jiahao Wang, Yitong Wang, Yansong Tang
2025ICCVGWM: Towards Scalable Gaussian World Models for Robotic Manipulation.Guanxing Lu, Baoxiong Jia, Puhao Li, Yixin Chen, Ziwei Wang, Yansong Tang, Siyuan Huang
2025ICCVAnyBimanual: Transferring Unimanual Policy for General Bimanual Manipulation.Guanxing Lu, Tengbo Yu, Haoyuan Deng, Season Si Chen, Yansong Tang, Ziwei Wang
2025ICCVFlash-Vstream: Efficient Real-Time Understanding for Long Video Streams.Haoji Zhang, Yiqin Wang, Yansong Tang, Yong Liu, Jiashi Feng, Xiaojie Jin
2025ICCVKV-Edit: Training-Free Image Editing for Precise Background Preservation.Tianrui Zhu, Shiyi Zhang, Jiawei Shao, Yansong Tang
2025ICLRWizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct.Haipeng Luo, Qingfeng Sun, Can Xu, Pu Zhao, Jian-Guang Lou, Chongyang Tao, Xiubo Geng, Qingwei Lin, Shifeng Chen, Yansong Tang, Dongmei Zhang
2025ICLRThinkBot: Embodied Instruction Following with Thought Chain Reasoning.Guanxing Lu, Ziwei Wang, Changliu Liu, Jiwen Lu, Yansong Tang
2025ICLRInstaRevive: One-Step Image Enhancement via Dynamic Score Matching.Yixuan Zhu, Haolin Wang, Ao Li, Wenliang Zhao, Yansong Tang, Jingxuan Niu, Lei Chen, Jie Zhou, Jiwen Lu
2025IROSManiGaussian++: General Robotic Bimanual Manipulation with Hierarchical Gaussian World Model.Tengbo Yu, Guanxing Lu, Zaijia Yang, Haoyuan Deng, Season Si Chen, Jiwen Lu, Wenbo Ding, Guoqiang Hu, Yansong Tang, Ziwei Wang
2025IROSPseudo Depth Meets Gaussian: A Feed-forward RGB SLAM Baseline.Linqing Zhao, Xiuwei Xu, Yirui Wang, Hao Wang, Wenzhao Zheng, Yansong Tang, Haibin Yan, Jiwen Lu
2025VTCFlowRadar: Unsupervised Radar Target Detection in Sea Clutter Using Flownet2.Hao Ma, Yansong Tang, Zhenyu Liu
2025SIGGRAPHFlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios.Shiyi Zhang, Junhao Zhuang, Zhaoyang Zhang, Ying Shan, Yansong Tang
2025VCIPGS-3Det: Elevating 3D Gaussian Splatting for Real-Time Multi-View 3D Object Detection.Yifei Han, Jixuan Fan, Sule Bai, Yuji Wang, Yansong Tang
2025VCIPLAMP: Occlusion-Aware LAyered Control for Multi-Person Image Generation.Lihan Zhang, Xin Dong, Wenfeng Deng, Xiaojun Liang, Yang Li, Yansong Tang
2024AAAILearning Multi-Scale Video-Text Correspondence for Weakly Supervised Temporal Article Gronding.Wenjia Geng, Yong Liu, Lei Chen, Sujia Wang, Jie Zhou, Yansong Tang
2024AAAICoSTA: End-to-End Comprehensive Space-Time Entanglement for Spatio-Temporal Video Grounding.Yaoyuan Liang, Xiao Liang, Yansong Tang, Zhao Yang, Ziran Li, Jingang Wang, Wenbo Ding, Shao-Lun Huang
2024CVPRMADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer.Jianjian Cao, Peng Ye, Shengze Li, Chong Yu, Yansong Tang, Jiwen Lu, Tao Chen
2024CVPRSegment and Caption Anything.Xiaoke Huang, Jianfeng Wang, Yansong Tang, Zheng Zhang, Han Hu, Jiwen Lu, Lijuan Wang, Zicheng Liu
2024CVPROpen-Vocabulary Segmentation with Semantic-Assisted Calibration.Yong Liu, Sule Bai, Guanbin Li, Yitong Wang, Yansong Tang
2024CVPRUniversal Segmentation at Arbitrary Granularity with Language Instruction.Yong Liu, Cairong Zhang, Yitong Wang, Jiahao Wang, Yujiu Yang, Yansong Tang
2024CVPRTowards Accurate Post-Training Quantization for Diffusion Models.Changyuan Wang, Ziwei Wang, Xiuwei Xu, Yansong Tang, Jie Zhou, Jiwen Lu
2024CVPROnce for Both: Single Stage of Importance and Sparsity Search for Vision Transformer Compression.Hancheng Ye, Chong Yu, Peng Ye, Renqiu Xia, Yansong Tang, Jiwen Lu, Tao Chen, Bo Zhang
2024CVPRPTM-VQA: Efficient Video Quality Assessment Leveraging Diverse PreTrained Models from the Wild.Kun Yuan, Hongbo Liu, Mading Li, Muyi Sun, Ming Sun, Jiachao Gong, Jinhua Hao, Chao Zhou, Yansong Tang
2024CVPRNarrative Action Evaluation with Prompt-Guided Multimodal Interaction.Shiyi Zhang, Sule Bai, Guangyi Chen, Lei Chen, Jiwen Lu, Junle Wang, Yansong Tang
2024CVPRDPMesh: Exploiting Diffusion Prior for Occluded Human Mesh Recovery.Yixuan Zhu, Ao Li, Yansong Tang, Wenliang Zhao, Jie Zhou, Jiwen Lu
2024CVPRFlowIE: Efficient Image Enhancement via Rectified Flow.Yixuan Zhu, Wenliang Zhao, Ao Li, Yansong Tang, Jie Zhou, Jiwen Lu
2024ECCVMotionLCM: Real-Time Controllable Motion Generation via Latent Consistency Model.Wenxun Dai, Ling-Hao Chen, Jingbo Wang, Jinpeng Liu, Bo Dai, Yansong Tang
2024ECCVLearning Dual-Level Deformable Implicit Representation for Real-World Scale Arbitrary Super-Resolution.Zhiheng Li, Muheng Li, Jixuan Fan, Lei Chen, Yansong Tang, Jiwen Lu, Jie Zhou
2024ECCVPlan, Posture and Go: Towards Open-Vocabulary Text-to-Motion Generation.Jinpeng Liu, Wenxun Dai, Chunyu Wang, Yiji Cheng, Yansong Tang, Xin Tong
2024ECCVManiGaussian: Dynamic Gaussian Splatting for Multi-task Robotic Manipulation.Guanxing Lu, Shiyi Zhang, Ziwei Wang, Changliu Liu, Jiwen Lu, Yansong Tang
2024ECCVPost-training Quantization with Progressive Calibration and Activation Relaxing for Text-to-Image Diffusion Models.Siao Tang, Xin Wang, Hong Chen, Chaoyu Guan, Zewen Wu, Yansong Tang, Wenwu Zhu
2024ECCVRodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models.Bowen Zhang, Yiji Cheng, Chunyu Wang, Ting Zhang, Jiaolong Yang, Yansong Tang, Feng Zhao, Dong Chen, Baining Guo
2024ICASSPLanguage-Free Compositional Action Generation via Decoupling Refinement.Xiao Liu, Guangyi Chen, Yansong Tang, Guangrun Wang, Xiao-Ping Zhang, Ser-Nam Lim
2024VCIPFully Aligned Network for Referring Image Segmentation.Yong Liu, Ruihao Xu, Yansong Tang
2024VCIPLocalization-Aware Multi-Scale Representation Learning for Repetitive Action Counting.Sujia Wang, Xiangwei Shen, Yansong Tang, Xin Dong, Wenjia Geng, Lei Chen
2023AAAISemantics-Aware Dynamic Localization and Refinement for Referring Image Segmentation.Zhao Yang, Jiaqi Wang, Yansong Tang, Kai Chen, Hengshuang Zhao, Philip H. S. Torr
2023CVPRFLAG3D: A 3D Fitness Activity Dataset with Language Instruction.Yansong Tang, Jinpeng Liu, Aoyang Liu, Bin Yang, Wenxun Dai, Yongming Rao, Jiwen Lu, Jie Zhou, Xiu Li
2023CVPRLOGO: A Long-Form Video Dataset for Group Action Quality Assessment.Shiyi Zhang, Wenxun Dai, Sujia Wang, Xiangwei Shen, Jiwen Lu, Jie Zhou, Yansong Tang
2023ICCVTem-adapter: Adapting Image-Text Pretraining for Video Question Answer.Guangyi Chen, Xiao Liu, Guangrun Wang, Kun Zhang, Philip H. S. Torr, Xiao-Ping Zhang, Yansong Tang
2023ICCVGlobal Knowledge Calibration for Fast Open-Vocabulary Segmentation.Kunyang Han, Yong Liu, Jun Hao Liew, Henghui Ding, Jiajun Liu, Yitong Wang, Yansong Tang, Yujiu Yang, Jiashi Feng, Yao Zhao, Yunchao Wei
2023ICCVSkip-Plan: Procedure Planning in Instructional Videos via Condensed Action Space Learning.Zhiheng Li, Wenjia Geng, Muheng Li, Lei Chen, Yansong Tang, Jiwen Lu, Jie Zhou
2023ICCVFineDance: A Fine-grained Choreography Dataset for 3D Full Body Dance Generation.Ronghui Li, Junfan Zhao, Yachao Zhang, Mingyang Su, Zeping Ren, Han Zhang, Yansong Tang, Xiu Li
2023ICIPContext-Aware Inpainter-Refiner for Skeleton-Based Human Motion Completion.Rong He, Yansong Tang, Xiu Li, Jiwen Lu
2023ICLRGAIN: On the Generalization of Instructional Action Understanding.Junlong Li, Guangyi Chen, Yansong Tang, Jinan Bao, Kun Zhang, Jie Zhou, Jiwen Lu
2023IJCAIHOI-aware Adaptive Network for Weakly-supervised Action Segmentation.Runzhong Zhang, Suchen Wang, Yueqi Duan, Yansong Tang, Yue Zhang, Yap-Peng Tan
2022CVPRYouMVOS: An Actor-centric Multi-shot Video Object Segmentation Dataset.Donglai Wei, Siddhant Kharbanda, Sarthak Arora, Roshan Roy, Nishant Jain, Akash Palrecha, Tanav Shah, Shray Mathur, Ritik Mathur, Abhijay Kemkar, Anirudh Srinivasan Chakravarthy, Zudi Lin, Won-Dong Jang, Yansong Tang, Song Bai, James Tompkin, Philip H. S. Torr, Hanspeter Pfister
2022CVPRLAVT: Language-Aware Vision Transformer for Referring Image Segmentation.Zhao Yang, Jiaqi Wang, Yansong Tang, Kai Chen, Hengshuang Zhao, Philip H. S. Torr
2022CVPRBNV-Fusion: Dense 3D Reconstruction using Bi-level Neural Volume Fusion.Kejie Li, Yansong Tang, Victor Adrian Prisacariu, Philip H. S. Torr
2022CVPRDenseCLIP: Language-Guided Dense Prediction with Context-Aware Prompting.Yongming Rao, Wenliang Zhao, Guangyi Chen, Yansong Tang, Zheng Zhu, Guan Huang, Jie Zhou, Jiwen Lu
2022CVPRSemantic-Aware Auto-Encoders for Self-supervised Representation Learning.Guangrun Wang, Yansong Tang, Liang Lin, Philip H. S. Torr
2022ECCVGlobal Spectral Filter Memory Network for Video Object Segmentation.Yong Liu, Ran Yu, Jiahao Wang, Xinyuan Zhao, Yitong Wang, Yansong Tang, Yujiu Yang
2022ECCVScalableViT: Rethinking the Context-Oriented Generalization of Vision Transformer.Rui Yang, Hailong Ma, Jie Wu, Yansong Tang, Xuefeng Xiao, Min Zheng, Xiu Li
2021BMVCHierarchical Interaction Network for Video Object Segmentation from Referring Expressions.Zhao Yang, Yansong Tang, Luca Bertinetto, Hengshuang Zhao, Philip H. S. Torr
2020CVPRUncertainty-Aware Score Distribution Learning for Action Quality Assessment.Yansong Tang, Zanlin Ni, Jiahuan Zhou, Danyang Zhang, Jiwen Lu, Ying Wu, Jie Zhou
2019CVPRCOIN: A Large-Scale Dataset for Comprehensive Instructional Video Analysis.Yansong Tang, Dajun Ding, Yongming Rao, Yu Zheng, Danyang Zhang, Lili Zhao, Jiwen Lu, Jie Zhou
2018CVPRDeep Progressive Reinforcement Learning for Skeleton-Based Action Recognition.Yansong Tang, Yi Tian, Jiwen Lu, Peiyang Li, Jie Zhou
2017ICIPAction recognition in RGB-D egocentric videos.Yansong Tang, Yi Tian, Jiwen Lu, Jianjiang Feng, Jie Zhou