Skip to content

Siyuan Huang

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

95

Venues

25

Active years

2005–2026

Best venue rank

A*

Where they publish

Papers

95 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLA3: Android Agent Arena for Mobile GUI Agents with Essential-State Procedural Evaluation.Yuxiang Chai, Shunye Tang, Han Xiao, Weifeng Lin, Hanhao Li, Jiayu Zhang, Liang Liu, Pengxiang Zhao, Guangyi Liu, Guozhi Wang, Shuai Ren, Rongduo Han, Haining Zhang, Siyuan Huang, Hongsheng Li
2026CHIRemembering with Reminiscope: Codesigning with Generative AI for Reminiscence Among Older Adults.Lisha Zhu, Rui Qi, Siyuan Huang, Xueliang Li
2026ISCASA 16-bit SAR ADC with Auxiliary-Calibration-Capacitor Enhanced Digital Foreground Calibration.Xiao Wang, Siyuan Huang, Deng Luo, Ming Tao, Jianjun Chen, Yaqing Chi, Guofang Yu, Bin Liang
2025ACLGumbel Reranking: Differentiable End-to-End Reranker Optimization.Siyuan Huang, Zhiyuan Ma, Jintao Du, Changhua Meng, Weiqiang Wang, Jingwen Leng, Minyi Guo, Zhouhan Lin
2025ACLAMEX: Android Multi-annotation Expo Dataset for Mobile GUI Agents.Yuxiang Chai, Siyuan Huang, Yazhe Niu, Han Xiao, Liang Liu, Guozhi Wang, Dingyu Zhang, Shuai Ren, Hongsheng Li
2025CVPRManipTrans: Efficient Dexterous Bimanual Manipulation Transfer via Residual Learning.Kailin Li, Puhao Li, Tengyu Liu, Yuyang Li, Siyuan Huang
2025CVPRObject-Centric Prompt-Driven Vision-Language-Action Model for Robotic Manipulation.Xiaoqi Li, Jingyun Xu, Mingxu Zhang, Jiaming Liu, Yan Shen, Iaroslav Ponomarenko, Jiahui Xu, Liang Heng, Siyuan Huang, Shanghang Zhang, Hao Dong
2025CVPRGROVE: A Generalized Reward for Learning Open-Vocabulary Physical Skill.Jieming Cui, Tengyu Liu, Ziyu Meng, Jiale Yu, Ran Song, Wei Zhang, Yixin Zhu, Siyuan Huang
2025CVPRUnveiling the Mist over 3D Vision-Language Understanding: Object-centric Evaluation with Chain-of-Analysis.Jiangyong Huang, Baoxiong Jia, Yan Wang, Ziyu Zhu, Xiongkun Linghu, Qing Li, Song-Chun Zhu, Siyuan Huang
2025CVPRDynamic Motion Blending for Versatile Motion Editing.Nan Jiang, Hongjie Li, Ziye Yuan, Zimo He, Yixin Chen, Tengyu Liu, Yixin Zhu, Siyuan Huang
2025CVPRMOVIS: Enhancing Multi-Object Novel View Synthesis for Indoor Scenes.Ruijie Lu, Yixin Chen, Junfeng Ni, Baoxiong Jia, Yu Liu, Diwen Wan, Gang Zeng, Siyuan Huang
2025CVPRCross-Spectral Body Recognition with Side Information Embedding: Benchmarks on LLCM and Analyzing Range-Induced Occlusions on IJB-MDF.Anirudh Nanduri, Siyuan Huang, Rama Chellappa
2025CVPRDecompositional Neural Scene Reconstruction with Generative Diffusion Prior.Junfeng Ni, Yu Liu, Ruijie Lu, Zirui Zhou, Song-Chun Zhu, Yixin Chen, Siyuan Huang
2025CVPRMasked Point-Entity Contrast for Open-Vocabulary 3D Scene Understanding.Yan Wang, Baoxiong Jia, Ziyu Zhu, Siyuan Huang
2025CVPRMETASCENES: Towards Automated Replica Creation for Real-world 3D Scans.Huangyue Yu, Baoxiong Jia, Yixin Chen, Yandan Yang, Puhao Li, Rongpeng Su, Jiaxin Li, Qing Li, Wei Liang, Song-Chun Zhu, Tengyu Liu, Siyuan Huang
2025CVPRInteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing.Jinlu Zhang, Yixin Chen, Zan Wang, Jie Yang, Yizhou Wang, Siyuan Huang
2025EMNLPTraining LLMs to be Better Text Embedders through Bidirectional Reconstruction.Chang Su, Dengliang Shi, Siyuan Huang, Jintao Du, Changhua Meng, Yu Cheng, Weiqiang Wang, Zhouhan Lin
2025ICCVPrimHOI: Compositional Human-Object Interaction via Reusable Primitives.Kai Jia, Tengyu Liu, Yixin Zhu, Mingtao Pei, Siyuan Huang
2025ICCVTACO: Taming Diffusion for In-the-Wild Video Amodal Completion.Ruijie Lu, Yixin Chen, Yu Liu, Jiaxiang Tang, Junfeng Ni, Diwen Wan, Gang Zeng, Siyuan Huang
2025ICCVGWM: Towards Scalable Gaussian World Models for Robotic Manipulation.Guanxing Lu, Baoxiong Jia, Puhao Li, Yixin Chen, Ziwei Wang, Yansong Tang, Siyuan Huang
2025ICCVGUIOdyssey: A Comprehensive Dataset for Cross-App GUI Navigation on Mobile Devices.Quanfeng Lu, Wenqi Shao, Zitao Liu, Lingxiao Du, Fanqing Meng, Boxuan Li, Botong Chen, Siyuan Huang, Kaipeng Zhang, Ping Luo
2025ICCVTrace3D: Consistent Segmentation Lifting via Gaussian Instance Tracing.Hongyu Shen, Junfeng Ni, Yixin Chen, Weishuo Li, Mingtao Pei, Siyuan Huang
2025ICCVMove to Understand a 3D Scene: Bridging Visual Grounding and Exploration for Efficient and Versatile Embodied Navigation.Ziyu Zhu, Xilin Wang, Yixuan Li, Zhuofan Zhang, Xiaojian Ma, Yixin Chen, Baoxiong Jia, Wei Liang, Qian Yu, Zhidong Deng, Siyuan Huang, Qing Li
2025ICLRDraw-and-Understand: Leveraging Visual Prompts to Enable MLLMs to Comprehend What You Want.Weifeng Lin, Xinyu Wei, Ruichuan An, Peng Gao, Bocheng Zou, Yulin Luo, Siyuan Huang, Shanghang Zhang, Hongsheng Li
2025ICLRPixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions.Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Peng Gao, Hongsheng Li
2025ICLRBuilding Interactable Replicas of Complex Articulated Objects via Gaussian Splatting.Yu Liu, Baoxiong Jia, Ruijie Lu, Junfeng Ni, Song-Chun Zhu, Siyuan Huang
2025ICRASYNERGAI: Perception Alignment for Human-Robot Collaboration.Yixin Chen, Guoxi Zhang, Yaowei Zhang, Hongming Xu, Peiyuan Zhi, Qing Li, Siyuan Huang
2025ICRAPhysPart: Physically Plausible Part Completion for Interactable Objects.Rundong Luo, Haoran Geng, Congyue Deng, Puhao Li, Zan Wang, Baoxiong Jia, Leonidas J. Guibas, Siyuan Huang
2025IROSSKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation.Xin Li, Siyuan Huang, Qiaojun Yu, Zhengkai Jiang, Ce Hao, Yimeng Zhu, Hongsheng Li, Peng Gao, Cewu Lu
2025IROSAg2x2: Robust Agent-Agnostic Visual Representations for Zero-Shot Bimanual Manipulation.Ziyin Xiong, Yinghan Chen, Puhao Li, Yixin Zhu, Tengyu Liu, Siyuan Huang
2025ICRAUniAff: A Unified Representation of Affordances for Tool Usage and Articulation with Vision-Language Models.Qiaojun Yu, Siyuan Huang, Xibin Yuan, Zhengkai Jiang, Ce Hao, Xin Li, Haonan Chang, Junbo Wang, Liu Liu, Hongsheng Li, Peng Gao, Cewu Lu
2025ICRAEffective Tuning Strategies for Generalist Robot Manipulation Policies.Wenbo Zhang, Yang Li, Yanyuan Qiao, Siyuan Huang, Jiajun Liu, Feras Dayoub, Xiao Ma, Lingqiao Liu
2025ICRAClosed-Loop Open-Vocabulary Mobile Manipulation with GPT-4V.Peiyuan Zhi, Zhiyuan Zhang, Yu Zhao, Muzhi Han, Zeyu Zhang, Zhitian Li, Ziyuan Jiao, Baoxiong Jia, Siyuan Huang
2025WACVVILLS: Video-Image Learning to Learn Semantics for Person Re-Identification.Siyuan Huang, Ram Prabhakar, Yuxiang Guo, Rama Chellappa, Cheng Peng
2025SiggraphAGenerating Objects with Part-Articulation from a Single Image.Ruijie Lu, Yu Liu, Jiaxiang Tang, Junfeng Ni, Yuxiang Wang, Diwen Wan, Gang Zeng, Yixin Chen, Siyuan Huang
2024ACLNot All Experts are Equal: Efficient Expert Pruning and Skipping for Mixture-of-Experts Large Language Models.Xudong Lu, Qi Liu, Yuhui Xu, Aojun Zhou, Siyuan Huang, Bo Zhang, Junchi Yan, Hongsheng Li
2024CIKMBreaking the Bottleneck on Graphs with Structured State Spaces.Yunchong Song, Siyuan Huang, Jiacheng Cai, Xinbing Wang, Chenghu Zhou, Zhouhan Lin
2024CoRLA3VLM: Actionable Articulation-Aware Vision Language Model.Siyuan Huang, Haonan Chang, Yuhan Liu, Yimeng Zhu, Hao Dong, Abdeslam Boularias, Peng Gao, Hongsheng Li
2024CVPRAnySkill: Learning Open-Vocabulary Physical Skill for Interactive Agents.Jieming Cui, Tengyu Liu, Nian Liu, Yaodong Yang, Yixin Zhu, Siyuan Huang
2024CVPRScaling Up Dynamic Human-Scene Interaction Modeling.Nan Jiang, Zhiyuan Zhang, Hongjie Li, Xiaoxuan Ma, Zan Wang, Yixin Chen, Tengyu Liu, Yixin Zhu, Siyuan Huang
2024CVPRMove as you Say, Interact as you can: Language-Guided Human Motion Generation with Scene Affordance.Zan Wang, Yixin Chen, Baoxiong Jia, Puhao Li, Jinlu Zhang, Jingze Zhang, Tengyu Liu, Yixin Zhu, Wei Liang, Siyuan Huang
2024CVPRPhyScene: Physically Interactable 3D Scene Synthesis for Embodied AI.Yandan Yang, Baoxiong Jia, Peiyuan Zhi, Siyuan Huang
2024ECCVSceneVerse: Scaling 3D Vision-Language Learning for Grounded Scene Understanding.Baoxiong Jia, Yixin Chen, Huangyue Yu, Yan Wang, Xuesong Niu, Tengyu Liu, Qing Li, Siyuan Huang
2024ECCVSPHINX: A Mixer of Weights, Visual Embeddings and Image Scales for Multi-modal Large Language Models.Ziyi Lin, Dongyang Liu, Renrui Zhang, Peng Gao, Longtian Qiu, Han Xiao, Han Qiu, Wenqi Shao, Keqin Chen, Jiaming Han, Siyuan Huang, Yichi Zhang, Xuming He, Yu Qiao, Hongsheng Li
2024ECCVSlotLifter: Slot-Guided Feature Lifting for Learning Object-Centric Radiance Fields.Yu Liu, Baoxiong Jia, Yixin Chen, Siyuan Huang
2024ECCVF-HOI: Toward Fine-Grained Semantic-Aligned 3D Human-Object Interactions.Jie Yang, Xuesong Niu, Nan Jiang, Ruimao Zhang, Siyuan Huang
2024ECCVUnifying 3D Vision-Language Understanding via Promptable Queries.Ziyu Zhu, Zhuofan Zhang, Xiaojian Ma, Xuesong Niu, Yixin Chen, Baoxiong Jia, Zhidong Deng, Siyuan Huang, Qing Li
2024EMNLPMirror-Consistency: Harnessing Inconsistency in Majority Voting.Siyuan Huang, Zhiyuan Ma, Jintao Du, Changhua Meng, Weiqiang Wang, Zhouhan Lin
2024ICLRNeural-Symbolic Recursive Machine for Systematic Generalization.Qing Li, Yixin Zhu, Yitao Liang, Ying Nian Wu, Song-Chun Zhu, Siyuan Huang
2024ICLRGraph Parsing Networks.Yunchong Song, Siyuan Huang, Xinbing Wang, Chenghu Zhou, Zhouhan Lin
2024ICMLAn Embodied Generalist Agent in 3D World.Jiangyong Huang, Silong Yong, Xiaojian Ma, Xiongkun Linghu, Puhao Li, Yan Wang, Qing Li, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang
2024ICMLSPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models.Dongyang Liu, Renrui Zhang, Longtian Qiu, Siyuan Huang, Weifeng Lin, Shitian Zhao, Shijie Geng, Ziyi Lin, Peng Jin, Kaipeng Zhang, Wenqi Shao, Chao Xu, Conghui He, Junjun He, Hao Shao, Pan Lu, Yu Qiao, Hongsheng Li, Peng Gao
2024IJCAI3D Vision and Language Pretraining with Large-Scale Synthetic Data.Dejie Yang, Zhu Xu, Wentao Mo, Qingchao Chen, Siyuan Huang, Yang Liu
2024ICRABridging Zero-shot Object Navigation and Foundation Models through Pixel-Guided Navigation Skill.Wenzhe Cai, Siyuan Huang, Guangran Cheng, Yuxing Long, Peng Gao, Changyin Sun, Hao Dong
2024IROSManipVQA: Injecting Robotic Affordance and Physically Grounded Information into Multi-Modal Large Language Models.Siyuan Huang, Iaroslav Ponomarenko, Zhengkai Jiang, Xiaoqi Li, Xiaobin Hu, Peng Gao, Hongsheng Li, Hao Dong
2024IROSAg2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations.Puhao Li, Tengyu Liu, Yuyang Li, Muzhi Han, Haoran Geng, Shu Wang, Yixin Zhu, Song-Chun Zhu, Siyuan Huang
2024NAACLLayoutPointer: A Spatial-Context Adaptive Pointer Network for Visual Information Extraction.Siyuan Huang, Yongping Xiong, Guibin Wu
2024SiggraphAAutonomous Character-Scene Interaction Synthesis from Text Instruction.Nan Jiang, Zimo He, Zi Wang, Hongjie Li, Yixin Chen, Siyuan Huang, Yixin Zhu
2023CVPRGAPartNet: Cross-Category Domain-Generalizable Object Perception and Manipulation via Generalizable and Actionable Parts.Haoran Geng, Helin Xu, Chengyang Zhao, Chao Xu, Li Yi, Siyuan Huang, He Wang
2023CVPRDiffusion-based Generation, Optimization, and Planning in 3D Scenes.Siyuan Huang, Zan Wang, Puhao Li, Baoxiong Jia, Tengyu Liu, Yixin Zhu, Wei Liang, Song-Chun Zhu
2023CVPRPrompt, Generate, Then Cache: Cascade of Foundation Models Makes Strong Few-Shot Learners.Renrui Zhang, Xiangfei Hu, Bohao Li, Siyuan Huang, Hanqiu Deng, Yu Qiao, Peng Gao, Hongsheng Li
2023DASCA Blockchain of Blockchains Structure Based on Asset Trading Scheme.Siyuan Huang, Yuling Chen, Chaoyue Tan, Hui Dou, Yun Luo, Yuxiang Yang
2023ICCVARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes.Ran Gong, Jiangyong Huang, Yizhou Zhao, Haoran Geng, Xiaofeng Gao, Qingyang Wu, Wensi Ai, Ziheng Zhou, Demetri Terzopoulos, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang
2023ICCVFull-Body Articulated Human-Object Interaction.Nan Jiang, Tengyu Liu, Zhexuan Cao, Jieming Cui, Zhiyuan Zhang, Yixin Chen, He Wang, Yixin Zhu, Siyuan Huang
2023ICCV3D-VisTA: Pre-trained Transformer for 3D Vision and Text Alignment.Ziyu Zhu, Xiaojian Ma, Yixin Chen, Zhidong Deng, Siyuan Huang, Qing Li
2023ICLRA Minimalist Dataset for Systematic Generalization of Perception, Syntax, and Semantics.Qing Li, Siyuan Huang, Yining Hong, Yixin Zhu, Ying Nian Wu, Song-Chun Zhu
2023ICLRImproving Object-centric Learning with Query Optimization.Baoxiong Jia, Yu Liu, Siyuan Huang
2023ICLRSQA3D: Situated Question Answering in 3D Scenes.Xiaojian Ma, Silong Yong, Zilong Zheng, Qing Li, Yitao Liang, Song-Chun Zhu, Siyuan Huang
2023ICRAGenDexGrasp: Generalizable Dexterous Grasping.Puhao Li, Tengyu Liu, Yuyang Li, Yiran Geng, Yixin Zhu, Yaodong Yang, Siyuan Huang
2023MIGHeat Simulation on Meshless Crafted-Made Shapes.Auguste De Lambilly, Gabriel Benedetti, Nour Rizk, Hanqi Chen, Siyuan Huang, Junnan Qiu, David Louapre, Raphael Granier De Cassagnac, Damien Rohmer
2022AAAILearning V1 Simple Cells with Vector Representation of Local Content and Matrix Representation of Local Motion.Ruiqi Gao, Jianwen Xie, Siyuan Huang, Yufan Ren, Song-Chun Zhu, Ying Nian Wu
2022CVPRAdversarial Texture for Fooling Person Detectors in the Physical World.Zhanhao Hu, Siyuan Huang, Xiaopei Zhu, Fuchun Sun, Bo Zhang, Xiaolin Hu
2022CVPRInfrared Invisible Clothing: Hiding from Infrared Detectors at Multiple Angles in Real World.Xiaopei Zhu, Zhanhao Hu, Siyuan Huang, Jianmin Li, Xiaolin Hu
2021AAAILearning by Fixing: Solving Math Word Problems with Weak Supervision.Yining Hong, Qing Li, Daniel Ciao, Siyuan Huang, Song-Chun Zhu
2021AAAISMART: A Situation Model for Algebra Story Problems via Attributed Grammar.Yining Hong, Qing Li, Ran Gong, Daniel Ciao, Siyuan Huang, Song-Chun Zhu
2021ACLInter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning.Pan Lu, Ran Gong, Shibiao Jiang, Liang Qiu, Siyuan Huang, Xiaodan Liang, Song-Chun Zhu
2021CVPRLearning Neural Representation of Camera Pose with Matrix Representation of Pose Shift via View Synthesis.Yaxuan Zhu, Ruiqi Gao, Siyuan Huang, Song-Chun Zhu, Ying Nian Wu
2021ICCVYouRefIt: Embodied Reference Understanding with Language and Gesture.Yixin Chen, Qing Li, Deqian Kong, Yik Lun Kei, Song-Chun Zhu, Tao Gao, Yixin Zhu, Siyuan Huang
2021ICCVVLGrammar: Grounded Grammar Induction of Vision and Language.Yining Hong, Qing Li, Song-Chun Zhu, Siyuan Huang
2021ICCVSpatio-temporal Self-Supervised Representation Learning for 3D Point Clouds.Siyuan Huang, Yichen Xie, Song-Chun Zhu, Yixin Zhu
2020AAAIStreaming Batch Gradient Tracking for Neural Network Training (Student Abstract).Siyuan Huang, Brian D. Hoskins, Matthew W. Daniels, Mark D. Stiles, Gina C. Adam
2020ECCVLEMMA: A Multi-view Dataset for LEarning Multi-agent Multi-task Activities.Baoxiong Jia, Yixin Chen, Siyuan Huang, Yixin Zhu, Song-Chun Zhu
2020ECCVA Competence-Aware Curriculum for Visual Concepts Learning via Question Answering.Qing Li, Siyuan Huang, Yining Hong, Song-Chun Zhu
2020ICMLClosed Loop Neural-Symbolic Learning via Integrating Neural Perception, Grammar Parsing, and Symbolic Reasoning.Qing Li, Siyuan Huang, Yining Hong, Yixin Chen, Ying Nian Wu, Song-Chun Zhu
2019ICCVHolistic++ Scene Understanding: Single-View 3D Holistic Scene Parsing and Human Pose Estimation With Human-Object Interaction and Physical Commonsense.Yixin Chen, Siyuan Huang, Tao Yuan, Yixin Zhu, Siyuan Qi, Song-Chun Zhu
2019ICCVUnderstanding Human Gaze Communication by Spatio-Temporal Graph Reasoning.Lifeng Fan, Wenguan Wang, Song-Chun Zhu, Xinyu Tang, Siyuan Huang
2018CVPRHuman-Centric Indoor Scene Synthesis Using Stochastic Grammar.Siyuan Qi, Yixin Zhu, Siyuan Huang, Chenfanfu Jiang, Song-Chun Zhu
2018ECCVHolistic 3D Scene Parsing and Reconstruction from a Single RGB Image.Siyuan Huang, Siyuan Qi, Yixin Zhu, Yinxue Xiao, Yuanlu Xu, Song-Chun Zhu
2017ICCVPredicting Human Activities Using Stochastic Grammar.Siyuan Qi, Siyuan Huang, Ping Wei, Song-Chun Zhu
2017ISPAFlexible Light Curves Generation System for Astronomical Catalogs.Kun Li, Ce Yu, Shanjiang Tang, Chao Sun, Qing Zhao, Siyuan Huang, Qinlong Kang
2016IWQoSHybridFlow: A lightweight control plane for hybrid SDN in enterprise networks.Siyuan Huang, Jin Zhao, Xin Wang
2015ICIPBuilding change detection based on 3D reconstruction.Baohua Chen, Lei Deng, Yueqi Duan, Siyuan Huang, Jie Zhou
2015IWQoScCluster: A highly scalable and elastic OpenFlow control plane.Kun Qiu, Renlong Tu, Siyuan Huang, Jin Zhao, Xin Wang
2015VCIPImage set querying based localization.Lei Deng, Siyuan Huang, Yueqi Duan, Baohua Chen, Jie Zhou
2005ICISMobilizing Informational Social Capital in Cyber Space: Online Social Network Structural Properties and Knowledge Sharing.Siyuan Huang, Gerardine DeSanctis