| 2025 | ICASSP | CFSum: A Transformer-Based Multi-Modal Video Summarization Framework With Coarse-Fine Fusion. | Yaowei Guo, Jiazheng Xing, Xiaojun Hou, Shuo Xin, Juntao Jiang, Demetri Terzopoulos, Chenfanfu Jiang, Yong Liu |
| 2025 | ICS | A3FR: Agile 3D Gaussian Splatting with Incremental Gaze Tracked Foveated Rendering in Virtual Reality. | Shuo Xin, Haiyu Wang, Sai Qian Zhang |
| 2024 | CVPR | SDSTrack: Self-Distillation Symmetric Adapter Learning for Multi-Modal Visual Object Tracking. | Xiaojun Hou, Jiazheng Xing, Yijie Qian, Yaowei Guo, Shuo Xin, Junhao Chen, Kai Tang, Mengmeng Wang, Zhengkai Jiang, Liang Liu, Yong Liu |
| 2024 | IROS | A Robotic-centric Paradigm for 3D Human Tracking Under Complex Environments Using Multi-modal Adaptation. | Shuo Xin, Zhen Zhang, Liang Liu, Xiaojun Hou, Deye Zhu, Mengmeng Wang, Yong Liu |
| 2024 | IROS | Learning Safe Locomotion for Quadrupedal Robots by Derived-Action Optimization. | Deye Zhu, Chengrui Zhu, Zhen Zhang, Shuo Xin, Yong Liu |
| 2024 | ICRA | Multi-modal 3D Human Tracking for Robots in Complex Environment with Siamese Point-Video Transformer. | Shuo Xin, Zhen Zhang, Mengmeng Wang, Xiaojun Hou, Yaowei Guo, Xiao Kang, Liang Liu, Yong Liu |