| 2026 | AAAI | Grounding Actions in Camera Space: Observation-Centric Vision-Language-Action Policy. | Tianyi Zhang, Haonan Duan, Haoran Hao, Yu Qiao, Jifeng Dai, Zhi Hou |
| 2025 | ICCV | Dita: Scaling Diffusion Transformer for Generalist Vision-Language-Action Policy. | Zhi Hou, Tianyi Zhang, Yuwen Xiong, Haonan Duan, Hengjun Pu, Ronglei Tong, Chengyang Zhao, Xizhou Zhu, Yu Qiao, Jifeng Dai, Yuntao Chen |
| 2025 | ICCV | Timeformer: Capturing Temporal Relationships of Deformable 3D Gaussians for Robust Reconstruction. | Dadong Jiang, Zhi Hou, Zhihui Ke, Xianghui Yang, Xiaobo Zhou, Tie Qiu |
| 2022 | CVPR | BatchFormer: Learning to Explore Sample Relationships for Robust Representation Learning. | Zhi Hou, Baosheng Yu, Dacheng Tao |
| 2022 | ECCV | Discovering Human-Object Interaction Concepts via Self-Compositional Learning. | Zhi Hou, Baosheng Yu, Dacheng Tao |
| 2022 | GLOBECOM | Load-Adaptive and Energy-Efficient Topology Control in LEO Mega-Constellation Networks. | Long Chen, Feilong Tang, Linghe Kong, Rui Li, Zhi Hou, Jiacheng Liu, Xu Li, Song Guo |
| 2021 | CVPR | Affordance Transfer Learning for Human-Object Interaction Detection. | Zhi Hou, Baosheng Yu, Yu Qiao, Xiaojiang Peng, Dacheng Tao |
| 2021 | CVPR | Detecting Human-Object Interaction via Fabricated Compositional Learning. | Zhi Hou, Baosheng Yu, Yu Qiao, Xiaojiang Peng, Dacheng Tao |
| 2020 | ECCV | Visual Compositional Learning for Human-Object Interaction Detection. | Zhi Hou, Xiaojiang Peng, Yu Qiao, Dacheng Tao |