Yansong Tang
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
66
Venues
14
Active years
2017–2025
Best venue rank
A*
Where they publish
Papers
66 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2025 | AAAI | IteRPrimE: Zero-shot Referring Image Segmentation with Iterative Grad-CAM Refinement and Primary Word Emphasis. | Yuji Wang, Jingchen Ni, Yong Liu, Chun Yuan, Yansong Tang |
| 2025 | ACL | Ponder & Press: Advancing Visual GUI Agent towards General Computer Control. | Yiqin Wang, Haoji Zhang, Jingqi Tian, Yansong Tang |
| 2025 | CVPR | Coarse Correspondences Boost Spatial-Temporal Reasoning in Multimodal Language Model. | Benlin Liu, Yuhao Dong, Yiqin Wang, Zixian Ma, Yansong Tang, Luming Tang, Yongming Rao, Wei-Chiu Ma, Ranjay Krishna |
| 2025 | CVPR | SAM2-LOVE: Segment Anything Model 2 in Language-aided Audio-Visual Scenes. | Yuji Wang, Haoran Xu, Yong Liu, Jiaze Li, Yansong Tang |
| 2025 | CVPR | ATP-LLaVA: Adaptive Token Pruning for Large Vision Language Models. | Xubing Ye, Yukang Gan, Yixiao Ge, Xiao-Ping Zhang, Yansong Tang |
| 2025 | CVPR | VoCo-LLaMA: Towards Vision Compression with Large Language Models. | Xubing Ye, Yukang Gan, Xiaoke Huang, Yixiao Ge, Yansong Tang |
| 2025 | CVPR | FADE: Frequency-Aware Diffusion Model Factorization for Video Editing. | Yixuan Zhu, Haolin Wang, Shilin Ma, Wenliang Zhao, Yansong Tang, Lei Chen, Jie Zhou |
| 2025 | ICCV | Momentum-Gs: Momentum Gaussian Self-Distillation for High-Quality Large Scene Reconstruction. | Jixuan Fan, Wanhua Li, Yifei Han, Tianru Dai, Yansong Tang |
| 2025 | ICCV | ScoreHOI: Physically Plausible Reconstruction of Human-Object Interaction via Score-Guided Diffusion. | Ao Li, Jinpeng Liu, Yixuan Zhu, Yansong Tang |
| 2025 | ICCV | Stepping Out of Similar Semantic Space for Open-Vocabulary Segmentation. | Yong Liu, Song-Li Wu, Sule Bai, Jiahao Wang, Yitong Wang, Yansong Tang |
| 2025 | ICCV | GWM: Towards Scalable Gaussian World Models for Robotic Manipulation. | Guanxing Lu, Baoxiong Jia, Puhao Li, Yixin Chen, Ziwei Wang, Yansong Tang, Siyuan Huang |
| 2025 | ICCV | AnyBimanual: Transferring Unimanual Policy for General Bimanual Manipulation. | Guanxing Lu, Tengbo Yu, Haoyuan Deng, Season Si Chen, Yansong Tang, Ziwei Wang |
| 2025 | ICCV | Flash-Vstream: Efficient Real-Time Understanding for Long Video Streams. | Haoji Zhang, Yiqin Wang, Yansong Tang, Yong Liu, Jiashi Feng, Xiaojie Jin |
| 2025 | ICCV | KV-Edit: Training-Free Image Editing for Precise Background Preservation. | Tianrui Zhu, Shiyi Zhang, Jiawei Shao, Yansong Tang |
| 2025 | ICLR | WizardMath: Empowering Mathematical Reasoning for Large Language Models via Reinforced Evol-Instruct. | Haipeng Luo, Qingfeng Sun, Can Xu, Pu Zhao, Jian-Guang Lou, Chongyang Tao, Xiubo Geng, Qingwei Lin, Shifeng Chen, Yansong Tang, Dongmei Zhang |
| 2025 | ICLR | ThinkBot: Embodied Instruction Following with Thought Chain Reasoning. | Guanxing Lu, Ziwei Wang, Changliu Liu, Jiwen Lu, Yansong Tang |
| 2025 | ICLR | InstaRevive: One-Step Image Enhancement via Dynamic Score Matching. | Yixuan Zhu, Haolin Wang, Ao Li, Wenliang Zhao, Yansong Tang, Jingxuan Niu, Lei Chen, Jie Zhou, Jiwen Lu |
| 2025 | IROS | ManiGaussian++: General Robotic Bimanual Manipulation with Hierarchical Gaussian World Model. | Tengbo Yu, Guanxing Lu, Zaijia Yang, Haoyuan Deng, Season Si Chen, Jiwen Lu, Wenbo Ding, Guoqiang Hu, Yansong Tang, Ziwei Wang |
| 2025 | IROS | Pseudo Depth Meets Gaussian: A Feed-forward RGB SLAM Baseline. | Linqing Zhao, Xiuwei Xu, Yirui Wang, Hao Wang, Wenzhao Zheng, Yansong Tang, Haibin Yan, Jiwen Lu |
| 2025 | VTC | FlowRadar: Unsupervised Radar Target Detection in Sea Clutter Using Flownet2. | Hao Ma, Yansong Tang, Zhenyu Liu |
| 2025 | SIGGRAPH | FlexiAct: Towards Flexible Action Control in Heterogeneous Scenarios. | Shiyi Zhang, Junhao Zhuang, Zhaoyang Zhang, Ying Shan, Yansong Tang |
| 2025 | VCIP | GS-3Det: Elevating 3D Gaussian Splatting for Real-Time Multi-View 3D Object Detection. | Yifei Han, Jixuan Fan, Sule Bai, Yuji Wang, Yansong Tang |
| 2025 | VCIP | LAMP: Occlusion-Aware LAyered Control for Multi-Person Image Generation. | Lihan Zhang, Xin Dong, Wenfeng Deng, Xiaojun Liang, Yang Li, Yansong Tang |
| 2024 | AAAI | Learning Multi-Scale Video-Text Correspondence for Weakly Supervised Temporal Article Gronding. | Wenjia Geng, Yong Liu, Lei Chen, Sujia Wang, Jie Zhou, Yansong Tang |
| 2024 | AAAI | CoSTA: End-to-End Comprehensive Space-Time Entanglement for Spatio-Temporal Video Grounding. | Yaoyuan Liang, Xiao Liang, Yansong Tang, Zhao Yang, Ziran Li, Jingang Wang, Wenbo Ding, Shao-Lun Huang |
| 2024 | CVPR | MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer. | Jianjian Cao, Peng Ye, Shengze Li, Chong Yu, Yansong Tang, Jiwen Lu, Tao Chen |
| 2024 | CVPR | Segment and Caption Anything. | Xiaoke Huang, Jianfeng Wang, Yansong Tang, Zheng Zhang, Han Hu, Jiwen Lu, Lijuan Wang, Zicheng Liu |
| 2024 | CVPR | Open-Vocabulary Segmentation with Semantic-Assisted Calibration. | Yong Liu, Sule Bai, Guanbin Li, Yitong Wang, Yansong Tang |
| 2024 | CVPR | Universal Segmentation at Arbitrary Granularity with Language Instruction. | Yong Liu, Cairong Zhang, Yitong Wang, Jiahao Wang, Yujiu Yang, Yansong Tang |
| 2024 | CVPR | Towards Accurate Post-Training Quantization for Diffusion Models. | Changyuan Wang, Ziwei Wang, Xiuwei Xu, Yansong Tang, Jie Zhou, Jiwen Lu |
| 2024 | CVPR | Once for Both: Single Stage of Importance and Sparsity Search for Vision Transformer Compression. | Hancheng Ye, Chong Yu, Peng Ye, Renqiu Xia, Yansong Tang, Jiwen Lu, Tao Chen, Bo Zhang |
| 2024 | CVPR | PTM-VQA: Efficient Video Quality Assessment Leveraging Diverse PreTrained Models from the Wild. | Kun Yuan, Hongbo Liu, Mading Li, Muyi Sun, Ming Sun, Jiachao Gong, Jinhua Hao, Chao Zhou, Yansong Tang |
| 2024 | CVPR | Narrative Action Evaluation with Prompt-Guided Multimodal Interaction. | Shiyi Zhang, Sule Bai, Guangyi Chen, Lei Chen, Jiwen Lu, Junle Wang, Yansong Tang |
| 2024 | CVPR | DPMesh: Exploiting Diffusion Prior for Occluded Human Mesh Recovery. | Yixuan Zhu, Ao Li, Yansong Tang, Wenliang Zhao, Jie Zhou, Jiwen Lu |
| 2024 | CVPR | FlowIE: Efficient Image Enhancement via Rectified Flow. | Yixuan Zhu, Wenliang Zhao, Ao Li, Yansong Tang, Jie Zhou, Jiwen Lu |
| 2024 | ECCV | MotionLCM: Real-Time Controllable Motion Generation via Latent Consistency Model. | Wenxun Dai, Ling-Hao Chen, Jingbo Wang, Jinpeng Liu, Bo Dai, Yansong Tang |
| 2024 | ECCV | Learning Dual-Level Deformable Implicit Representation for Real-World Scale Arbitrary Super-Resolution. | Zhiheng Li, Muheng Li, Jixuan Fan, Lei Chen, Yansong Tang, Jiwen Lu, Jie Zhou |
| 2024 | ECCV | Plan, Posture and Go: Towards Open-Vocabulary Text-to-Motion Generation. | Jinpeng Liu, Wenxun Dai, Chunyu Wang, Yiji Cheng, Yansong Tang, Xin Tong |
| 2024 | ECCV | ManiGaussian: Dynamic Gaussian Splatting for Multi-task Robotic Manipulation. | Guanxing Lu, Shiyi Zhang, Ziwei Wang, Changliu Liu, Jiwen Lu, Yansong Tang |
| 2024 | ECCV | Post-training Quantization with Progressive Calibration and Activation Relaxing for Text-to-Image Diffusion Models. | Siao Tang, Xin Wang, Hong Chen, Chaoyu Guan, Zewen Wu, Yansong Tang, Wenwu Zhu |
| 2024 | ECCV | RodinHD: High-Fidelity 3D Avatar Generation with Diffusion Models. | Bowen Zhang, Yiji Cheng, Chunyu Wang, Ting Zhang, Jiaolong Yang, Yansong Tang, Feng Zhao, Dong Chen, Baining Guo |
| 2024 | ICASSP | Language-Free Compositional Action Generation via Decoupling Refinement. | Xiao Liu, Guangyi Chen, Yansong Tang, Guangrun Wang, Xiao-Ping Zhang, Ser-Nam Lim |
| 2024 | VCIP | Fully Aligned Network for Referring Image Segmentation. | Yong Liu, Ruihao Xu, Yansong Tang |
| 2024 | VCIP | Localization-Aware Multi-Scale Representation Learning for Repetitive Action Counting. | Sujia Wang, Xiangwei Shen, Yansong Tang, Xin Dong, Wenjia Geng, Lei Chen |
| 2023 | AAAI | Semantics-Aware Dynamic Localization and Refinement for Referring Image Segmentation. | Zhao Yang, Jiaqi Wang, Yansong Tang, Kai Chen, Hengshuang Zhao, Philip H. S. Torr |
| 2023 | CVPR | FLAG3D: A 3D Fitness Activity Dataset with Language Instruction. | Yansong Tang, Jinpeng Liu, Aoyang Liu, Bin Yang, Wenxun Dai, Yongming Rao, Jiwen Lu, Jie Zhou, Xiu Li |
| 2023 | CVPR | LOGO: A Long-Form Video Dataset for Group Action Quality Assessment. | Shiyi Zhang, Wenxun Dai, Sujia Wang, Xiangwei Shen, Jiwen Lu, Jie Zhou, Yansong Tang |
| 2023 | ICCV | Tem-adapter: Adapting Image-Text Pretraining for Video Question Answer. | Guangyi Chen, Xiao Liu, Guangrun Wang, Kun Zhang, Philip H. S. Torr, Xiao-Ping Zhang, Yansong Tang |
| 2023 | ICCV | Global Knowledge Calibration for Fast Open-Vocabulary Segmentation. | Kunyang Han, Yong Liu, Jun Hao Liew, Henghui Ding, Jiajun Liu, Yitong Wang, Yansong Tang, Yujiu Yang, Jiashi Feng, Yao Zhao, Yunchao Wei |
| 2023 | ICCV | Skip-Plan: Procedure Planning in Instructional Videos via Condensed Action Space Learning. | Zhiheng Li, Wenjia Geng, Muheng Li, Lei Chen, Yansong Tang, Jiwen Lu, Jie Zhou |
| 2023 | ICCV | FineDance: A Fine-grained Choreography Dataset for 3D Full Body Dance Generation. | Ronghui Li, Junfan Zhao, Yachao Zhang, Mingyang Su, Zeping Ren, Han Zhang, Yansong Tang, Xiu Li |
| 2023 | ICIP | Context-Aware Inpainter-Refiner for Skeleton-Based Human Motion Completion. | Rong He, Yansong Tang, Xiu Li, Jiwen Lu |
| 2023 | ICLR | GAIN: On the Generalization of Instructional Action Understanding. | Junlong Li, Guangyi Chen, Yansong Tang, Jinan Bao, Kun Zhang, Jie Zhou, Jiwen Lu |
| 2023 | IJCAI | HOI-aware Adaptive Network for Weakly-supervised Action Segmentation. | Runzhong Zhang, Suchen Wang, Yueqi Duan, Yansong Tang, Yue Zhang, Yap-Peng Tan |
| 2022 | CVPR | YouMVOS: An Actor-centric Multi-shot Video Object Segmentation Dataset. | Donglai Wei, Siddhant Kharbanda, Sarthak Arora, Roshan Roy, Nishant Jain, Akash Palrecha, Tanav Shah, Shray Mathur, Ritik Mathur, Abhijay Kemkar, Anirudh Srinivasan Chakravarthy, Zudi Lin, Won-Dong Jang, Yansong Tang, Song Bai, James Tompkin, Philip H. S. Torr, Hanspeter Pfister |
| 2022 | CVPR | LAVT: Language-Aware Vision Transformer for Referring Image Segmentation. | Zhao Yang, Jiaqi Wang, Yansong Tang, Kai Chen, Hengshuang Zhao, Philip H. S. Torr |
| 2022 | CVPR | BNV-Fusion: Dense 3D Reconstruction using Bi-level Neural Volume Fusion. | Kejie Li, Yansong Tang, Victor Adrian Prisacariu, Philip H. S. Torr |
| 2022 | CVPR | DenseCLIP: Language-Guided Dense Prediction with Context-Aware Prompting. | Yongming Rao, Wenliang Zhao, Guangyi Chen, Yansong Tang, Zheng Zhu, Guan Huang, Jie Zhou, Jiwen Lu |
| 2022 | CVPR | Semantic-Aware Auto-Encoders for Self-supervised Representation Learning. | Guangrun Wang, Yansong Tang, Liang Lin, Philip H. S. Torr |
| 2022 | ECCV | Global Spectral Filter Memory Network for Video Object Segmentation. | Yong Liu, Ran Yu, Jiahao Wang, Xinyuan Zhao, Yitong Wang, Yansong Tang, Yujiu Yang |
| 2022 | ECCV | ScalableViT: Rethinking the Context-Oriented Generalization of Vision Transformer. | Rui Yang, Hailong Ma, Jie Wu, Yansong Tang, Xuefeng Xiao, Min Zheng, Xiu Li |
| 2021 | BMVC | Hierarchical Interaction Network for Video Object Segmentation from Referring Expressions. | Zhao Yang, Yansong Tang, Luca Bertinetto, Hengshuang Zhao, Philip H. S. Torr |
| 2020 | CVPR | Uncertainty-Aware Score Distribution Learning for Action Quality Assessment. | Yansong Tang, Zanlin Ni, Jiahuan Zhou, Danyang Zhang, Jiwen Lu, Ying Wu, Jie Zhou |
| 2019 | CVPR | COIN: A Large-Scale Dataset for Comprehensive Instructional Video Analysis. | Yansong Tang, Dajun Ding, Yongming Rao, Yu Zheng, Danyang Zhang, Lili Zhao, Jiwen Lu, Jie Zhou |
| 2018 | CVPR | Deep Progressive Reinforcement Learning for Skeleton-Based Action Recognition. | Yansong Tang, Yi Tian, Jiwen Lu, Peiyang Li, Jie Zhou |
| 2017 | ICIP | Action recognition in RGB-D egocentric videos. | Yansong Tang, Yi Tian, Jiwen Lu, Jianjiang Feng, Jie Zhou |