Skip to content

Song-Chun Zhu

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

202

Venues

21

Active years

2004–2026

Best venue rank

A*

Where they publish

Papers

202 indexed papers, newest first.

YearVenueTitleAuthors
2026AAAIVideo Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation.Xinyi Tong, Yiran Zhu, Jishang Chen, Chunru Zhan, Tianle Wang, Sirui Zhang, Nian Liu, Tiezheng Ge, Duo Xu, Xin Jin, Feng Yu, Song-Chun Zhu
2026AAAITongUI: Internet-Scale Trajectories from Multimodal Web Tutorials for Generalized GUI Agents.Bofei Zhang, Zirui Shang, Zhi Gao, Wang Zhang, Rui Xie, Xiaojian Ma, Tao Yuan, Xinxiao Wu, Song-Chun Zhu, Qing Li
2026ACLJurisBench: A Deep Benchmark for Assessing Large Language Models in Professional Legal Practice.Ziang Chen, Guannan Li, Fanlin Ji, Yipeng Kang, Jiaqi Li, Muhan Zhang, Yangtao Zhang, Li Tianjiao, Jiannan Wang, Xin Guo, Song-Chun Zhu, Bin Ling
2026ACLSIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning.Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
2026ACLv-HUB: A Benchmark for Video Humor Understanding from Vision and Sound.Zhengpeng Shi, Yanpeng Zhao, Jianqun Zhou, Yuxuan Wang, Qinrong Cui, Wei Bi, Song-Chun Zhu, Bo Zhao, Zilong Zheng
2025AAAIDifferentiable Information Enhanced Model-Based Reinforcement Learning.Xiaoyuan Zhang, Xinyan Cai, Bo Liu, Weidong Huang, Song-Chun Zhu, Siyuan Qi, Yaodong Yang
2025ACLReflectEvo: Improving Meta Introspection of Small LLMs by Learning Self-Reflection.Jiaqi Li, Xinyi Dong, Yang Liu, Zhizhuo Yang, Quansen Wang, Xiaobo Wang, Song-Chun Zhu, Zixia Jia, Zilong Zheng
2025CVPRUnveiling the Mist over 3D Vision-Language Understanding: Object-centric Evaluation with Chain-of-Analysis.Jiangyong Huang, Baoxiong Jia, Yan Wang, Ziyu Zhu, Xiongkun Linghu, Qing Li, Song-Chun Zhu, Siyuan Huang
2025CVPRDecompositional Neural Scene Reconstruction with Generative Diffusion Prior.Junfeng Ni, Yu Liu, Ruijie Lu, Zirui Zhou, Song-Chun Zhu, Yixin Chen, Siyuan Huang
2025CVPRMETASCENES: Towards Automated Replica Creation for Real-world 3D Scans.Huangyue Yu, Baoxiong Jia, Yixin Chen, Yandan Yang, Puhao Li, Rongpeng Su, Jiaxin Li, Qing Li, Wei Liang, Song-Chun Zhu, Tengyu Liu, Siyuan Huang
2025EMNLPEnhancing LLM-Based Social Bot via an Adversarial Learning Framework.Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng
2025ICLRMulti-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage.Zhi Gao, Bofei Zhang, Pengxiang Li, Xiaojian Ma, Tao Yuan, Yue Fan, Yuwei Wu, Yunde Jia, Song-Chun Zhu, Qing Li
2025ICLRBuilding Interactable Replicas of Complex Articulated Objects via Gaussian Splatting.Yu Liu, Baoxiong Jia, Ruijie Lu, Junfeng Ni, Song-Chun Zhu, Siyuan Huang
2024AAAIProAgent: Building Proactive Cooperative Agents with Large Language Models.Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang, Guanghe Li, Yihang Sun, Cheng Zhang, Zhaowei Zhang, Anji Liu, Song-Chun Zhu, Xiaojun Chang, Junge Zhang, Feng Yin, Yitao Liang, Yaodong Yang
2024ACLLangSuit·E: Planning, Controlling and Interacting with Large Language Models in Embodied Text Environments.Zixia Jia, Mengmeng Wang, Baichen Tong, Song-Chun Zhu, Zilong Zheng
2024ACLRulE: Knowledge Graph Reasoning with Rule Embedding.Xiaojuan Tang, Song-Chun Zhu, Yitao Liang, Muhan Zhang
2024CVPRCLOVA: A Closed-LOop Visual Assistant with Tool Usage and Update.Zhi Gao, Yuntao Du, Xintong Zhang, Xiaojian Ma, Wenjuan Han, Song-Chun Zhu, Qing Li
2024ICLRNeural-Symbolic Recursive Machine for Systematic Generalization.Qing Li, Yixin Zhu, Yitao Liang, Ying Nian Wu, Song-Chun Zhu, Siyuan Huang
2024ICLRCivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents.Siyuan Qi, Shuo Chen, Yexin Li, Xiangyu Kong, Junqi Wang, Bangcheng Yang, Pring Wong, Yifan Zhong, Xiaoyuan Zhang, Zhaowei Zhang, Nian Liu, Yaodong Yang, Song-Chun Zhu
2024ICLRBongard-OpenWorld: Few-Shot Reasoning for Free-form Visual Concepts in the Real World.Rujie Wu, Xiaojian Ma, Zhenliang Zhang, Wei Wang, Qing Li, Song-Chun Zhu, Yizhou Wang
2024ICMLEfficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning.Yizhe Huang, Anji Liu, Fanqi Kong, Yaodong Yang, Song-Chun Zhu, Xue Feng
2024ICMLAn Embodied Generalist Agent in 3D World.Jiangyong Huang, Silong Yong, Xiaojian Ma, Xiongkun Linghu, Puhao Li, Yan Wang, Qing Li, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang
2024ICMLFast Peer Adaptation with Context-aware Exploration.Long Ma, Yuanfei Wang, Fangwei Zhong, Song-Chun Zhu, Yizhou Wang
2024IROSAg2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations.Puhao Li, Tengyu Liu, Yuyang Li, Muzhi Han, Haoran Geng, Shu Wang, Yixin Zhu, Song-Chun Zhu, Siyuan Huang
2024IROSLLMShu Wang, Muzhi Han, Ziyuan Jiao, Zeyu Zhang, Ying Nian Wu, Song-Chun Zhu, Hangxin Liu
2024VROn the Emergence of Symmetrical Reality.Zhenliang Zhang, Zeyu Zhang, Ziyuan Jiao, Yao Su, Hangxin Liu, Wei Wang, Song-Chun Zhu
2024SIGdialMindDial: Enhancing Conversational Agents with Theory-of-Mind for Common Ground Alignment and Negotiation.Shuwen Qiu, Mingdian Liu, Hengli Li, Song-Chun Zhu, Zilong Zheng
2023CVPRDiffusion-based Generation, Optimization, and Planning in 3D Scenes.Siyuan Huang, Zan Wang, Puhao Li, Baoxiong Jia, Tengyu Liu, Yixin Zhu, Wei Liang, Song-Chun Zhu
2023ICCVX-VoE: Measuring eXplanatory Violation of Expectation in Physical Events.Bo Dai, Linge Wang, Baoxiong Jia, Zeyu Zhang, Song-Chun Zhu, Chi Zhang, Yixin Zhu
2023ICCVARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes.Ran Gong, Jiangyong Huang, Yizhou Zhao, Haoran Geng, Xiaofeng Gao, Qingyang Wu, Wensi Ai, Ziheng Zhou, Demetri Terzopoulos, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang
2023ICLRA Minimalist Dataset for Systematic Generalization of Perception, Syntax, and Semantics.Qing Li, Siyuan Huang, Yining Hong, Yixin Zhu, Ying Nian Wu, Song-Chun Zhu
2023ICLRDynamic Prompt Learning via Policy Gradient for Semi-structured Mathematical Reasoning.Pan Lu, Liang Qiu, Kai-Wei Chang, Ying Nian Wu, Song-Chun Zhu, Tanmay Rajpurohit, Peter Clark, Ashwin Kalyan
2023ICLRSQA3D: Situated Question Answering in 3D Scenes.Xiaojian Ma, Silong Yong, Zilong Zheng, Qing Li, Yitao Liang, Song-Chun Zhu, Siyuan Huang
2023ICMLOn the Complexity of Bayesian Generalization.Yu-Zhe Shi, Manjie Xu, John E. Hopcroft, Kun He, Joshua B. Tenenbaum, Song-Chun Zhu, Ying Nian Wu, Wenjuan Han, Yixin Zhu
2023IROSLearning a Causal Transition Model for Object Cutting.Zeyu Zhang, Muzhi Han, Baoxiong Jia, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu, Hangxin Liu
2023IROSPart-level Scene Reconstruction Affords Robot Interaction.Zeyu Zhang, Lexing Zhang, Zaijin Wang, Ziyuan Jiao, Muzhi Han, Yixin Zhu, Song-Chun Zhu, Hangxin Liu
2023ICRARearrange Indoor Scenes for Human-Robot Co-Activity.Weiqi Wang, Zihang Zhao, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu, Hangxin Liu
2022AAAILearning V1 Simple Cells with Vector Representation of Local Content and Matrix Representation of Local Motion.Ruiqi Gao, Jianwen Xie, Siyuan Huang, Yufan Ren, Song-Chun Zhu, Ying Nian Wu
2022AAAIValueNet: A New Dataset for Human Value Driven Dialogue System.Liang Qiu, Yizhou Zhao, Jinchao Li, Pan Lu, Baolin Peng, Jianfeng Gao, Song-Chun Zhu
2022AAAILearning from the Tangram to Solve Mini Visual Tasks.Yizhou Zhao, Liang Qiu, Pan Lu, Feng Shi, Tian Han, Song-Chun Zhu
2022ECCVLearning Algebraic Representation for Systematic Generalization in Abstract Reasoning.Chi Zhang, Sirui Xie, Baoxiong Jia, Ying Nian Wu, Song-Chun Zhu, Yixin Zhu
2022ICLRRelViT: Concept-guided Vision Transformer for Visual Relational Reasoning.Xiaojian Ma, Weili Nie, Zhiding Yu, Huaizu Jiang, Chaowei Xiao, Yuke Zhu, Song-Chun Zhu, Anima Anandkumar
2022ICLRMCMC Should Mix: Learning Energy-Based Model with Neural Transport Latent Space MCMC.Erik Nijkamp, Ruiqi Gao, Pavel Sountsov, Srinivas Vasudevan, Bo Pang, Song-Chun Zhu, Ying Nian Wu
2022ICMLCOAT: Measuring Object Compositionality in Emergent Representations.Sirui Xie, Ari S. Morcos, Song-Chun Zhu, Ramakrishna Vedantam
2022ICMLLatent Diffusion Energy-Based Model for Interpretable Text Modelling.Peiyu Yu, Sirui Xie, Xiaojian Ma, Baoxiong Jia, Bo Pang, Ruiqi Gao, Yixin Zhu, Song-Chun Zhu, Ying Nian Wu
2022IROSSequential Manipulation Planning on Scene Graph.Ziyuan Jiao, Yida Niu, Zeyu Zhang, Song-Chun Zhu, Yixin Zhu, Hangxin Liu
2022SIGdialTowards Socially Intelligent Agents with Mental State Transition and Human Value.Liang Qiu, Yizhou Zhao, Yuan Liang, Pan Lu, Weiyan Shi, Zhou Yu, Song-Chun Zhu
2021AAAILearning by Fixing: Solving Math Word Problems with Weak Supervision.Yining Hong, Qing Li, Daniel Ciao, Siyuan Huang, Song-Chun Zhu
2021AAAISMART: A Situation Model for Algebra Story Problems via Attributed Grammar.Yining Hong, Qing Li, Ran Gong, Daniel Ciao, Siyuan Huang, Song-Chun Zhu
2021AAAILearning Cycle-Consistent Cooperative Networks via Alternating MCMC Teaching for Unsupervised Cross-Domain Translation.Jianwen Xie, Zilong Zheng, Xiaolin Fang, Song-Chun Zhu, Ying Nian Wu
2021ACLInter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning.Pan Lu, Ran Gong, Shibiao Jiang, Liang Qiu, Siyuan Huang, Xiaodan Liang, Song-Chun Zhu
2021ACLSocAoG: Incremental Graph Parsing for Social Relation Inference in Dialogues.Liang Qiu, Yuan Liang, Yizhou Zhao, Pan Lu, Baolin Peng, Zhou Yu, Ying Nian Wu, Song-Chun Zhu
2021ACLGRICE: A Grammar-based Dataset for Recovering Implicature and Conversational rEasoning.Zilong Zheng, Shuwen Qiu, Lifeng Fan, Yixin Zhu, Song-Chun Zhu
2021CVPRACRE: Abstract Causal REasoning Beyond Covariation.Chi Zhang, Baoxiong Jia, Mark Edmonds, Song-Chun Zhu, Yixin Zhu
2021CVPRAbstract Spatial-Temporal Reasoning via Probabilistic Abduction and Execution.Chi Zhang, Baoxiong Jia, Song-Chun Zhu, Yixin Zhu
2021CVPRLearning Triadic Belief Dynamics in Nonverbal Communication From Videos.Lifeng Fan, Shuwen Qiu, Zilong Zheng, Tao Gao, Song-Chun Zhu, Yixin Zhu
2021CVPRGenerative PointNet: Deep Energy-Based Learning on Unordered Point Sets for 3D Generation, Reconstruction and Classification.Jianwen Xie, Yifei Xu, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu
2021CVPRLearning Neural Representation of Camera Pose with Matrix Representation of Pose Shift via View Synthesis.Yaxuan Zhu, Ruiqi Gao, Siyuan Huang, Song-Chun Zhu, Ying Nian Wu
2021EMNLPCrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization.Arjun R. Akula, Soravit Changpinyo, Boqing Gong, Piyush Sharma, Song-Chun Zhu, Radu Soricut
2021EMNLPMind the Context: The Impact of Contextualization in Neural Module Networks for Grounding Visual Referring Expressions.Arjun R. Akula, Spandana Gella, Keze Wang, Song-Chun Zhu, Siva Reddy
2021ICCVYouRefIt: Embodied Reference Understanding with Language and Gesture.Yixin Chen, Qing Li, Deqian Kong, Yik Lun Kei, Song-Chun Zhu, Tao Gao, Yixin Zhu, Siyuan Huang
2021ICCVVLGrammar: Grounded Grammar Induction of Vision and Language.Yining Hong, Qing Li, Song-Chun Zhu, Siyuan Huang
2021ICCVSpatio-temporal Self-Supervised Representation Learning for 3D Point Clouds.Siyuan Huang, Yichen Xie, Song-Chun Zhu, Yixin Zhu
2021ICLRStochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models.Mitch Hill, Jonathan Craig Mitchell, Song-Chun Zhu
2021ICRACongestion-aware Multi-agent Trajectory Prediction for Collision Avoidance.Xu Xie, Chi Zhang, Yixin Zhu, Ying Nian Wu, Song-Chun Zhu
2021ICRAReconstructing Interactive 3D Scenes by Panoptic Mapping and CAD Model Alignments.Muzhi Han, Zeyu Zhang, Ziyuan Jiao, Xu Xie, Yixin Zhu, Song-Chun Zhu, Hangxin Liu
2021IROSConsolidating Kinematic Models to Promote Coordinated Mobile Manipulations.Ziyuan Jiao, Zeyu Zhang, Xin Jiang, David K. Han, Song-Chun Zhu, Yixin Zhu, Hangxin Liu
2021IROSEfficient Task Planning for Mobile Manipulation: a Virtual Kinematic Chain Perspective.Ziyuan Jiao, Zeyu Zhang, Weiqi Wang, David K. Han, Song-Chun Zhu, Yixin Zhu, Hangxin Liu
2020AAAICoCoX: Generating Conceptual and Counterfactual Explanations via Fault-Lines.Arjun R. Akula, Shuai Wang, Song-Chun Zhu
2020AAAITheory-Based Causal Transfer: Integrating Instance-Level Induction and Abstract-Level Structure Learning.Mark Edmonds, Xiaojian Ma, Siyuan Qi, Yixin Zhu, Hongjing Lu, Song-Chun Zhu
2020AAAIOn the Anatomy of MCMC-Based Maximum Likelihood Learning of Energy-Based Models.Erik Nijkamp, Mitch Hill, Tian Han, Song-Chun Zhu, Ying Nian Wu
2020AAAIMotion-Based Generator Model: Unsupervised Disentanglement of Appearance, Trackable and Intrackable Motions in Dynamic Patterns.Jianwen Xie, Ruiqi Gao, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu
2020AAAIMachine Number Sense: A Dataset of Visual Arithmetic Problems for Abstract and Relational Reasoning.Wenhe Zhang, Chi Zhang, Yixin Zhu, Song-Chun Zhu
2020ACLWords Aren't Enough, Their Order Matters: On the Robustness of Grounding Visual Referring Expressions.Arjun R. Akula, Spandana Gella, Yaser Al-Onaizan, Song-Chun Zhu, Siva Reddy
2020CVPRJoint Training of Variational Auto-Encoder and Latent Energy-Based Model.Tian Han, Erik Nijkamp, Linqi Zhou, Bo Pang, Song-Chun Zhu, Ying Nian Wu
2020CVPRInducing Hierarchical Compositional Model by Sparsifying Generator Network.Xianglei Xing, Tianfu Wu, Song-Chun Zhu, Ying Nian Wu
2020ECCVLEMMA: A Multi-view Dataset for LEarning Multi-agent Multi-task Activities.Baoxiong Jia, Yixin Chen, Siyuan Huang, Yixin Zhu, Song-Chun Zhu
2020ECCVA Competence-Aware Curriculum for Visual Concepts Learning via Question Answering.Qing Li, Siyuan Huang, Yining Hong, Song-Chun Zhu
2020ECCVLearning Multi-layer Latent Variable Model via Variational Optimization of Short Run MCMC for Approximate Inference.Erik Nijkamp, Bo Pang, Tian Han, Linqi Zhou, Song-Chun Zhu, Ying Nian Wu
2020EMNLPStructured Attention for Unsupervised Dialogue Structure Induction.Liang Qiu, Yizhou Zhao, Weiyan Shi, Yuan Liang, Feng Shi, Tao Yuan, Zhou Yu, Song-Chun Zhu
2020ICMLClosed Loop Neural-Symbolic Learning via Integrating Neural Perception, Grammar Parsing, and Symbolic Reasoning.Qing Li, Siyuan Huang, Yining Hong, Yixin Chen, Ying Nian Wu, Song-Chun Zhu
2020IROSGraph-based Hierarchical Knowledge Representation for Robot Task Transfer from Virtual to Physical World.Zhenliang Zhang, Yixin Zhu, Song-Chun Zhu
2020IROSHuman-Robot Interaction in a Shared Augmented Reality Workspace.Shuwen Qiu, Hangxin Liu, Zeyu Zhang, Yixin Zhu, Song-Chun Zhu
2020ICRAJoint Inference of States, Robot Knowledge, and Human (False-)Beliefs.Tao Yuan, Hangxin Liu, Lifeng Fan, Zilong Zheng, Tao Gao, Yixin Zhu, Song-Chun Zhu
2020ICRACongestion-aware Evacuation Routing using Augmented Reality Devices.Zeyu Zhang, Hangxin Liu, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu
2020RO-MANJoint Mind Modeling for Explanation Generation in Complex Human-Robot Collaborative Tasks.Xiaofeng Gao, Ran Gong, Yizhou Zhao, Shu Wang, Tianmin Shu, Song-Chun Zhu
2019AAAIMirroring without Overimitation: Learning Functionally Equivalent Manipulation Actions.Hangxin Liu, Chi Zhang, Yixin Zhu, Chenfanfu Jiang, Song-Chun Zhu
2019AAAIRecognizing Unseen Attribute-Object Pair with Generative Model.Zhixiong Nan, Yang Liu, Nanning Zheng, Song-Chun Zhu
2019AAAILearning Dynamic Generator Model by Alternating Back-Propagation through Time.Jianwen Xie, Ruiqi Gao, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu
2019AAAIMetaStyle: Three-Way Trade-off among Speed, Flexibility, and Quality in Neural Style Transfer.Chi Zhang, Yixin Zhu, Song-Chun Zhu
2019CogSciDecomposing Human Causal Learning: Bottom-up Associative Learning and Top-down Schema Reasoning.Mark Edmonds, Siyuan Qi, Yixin Zhu, James Kubricht, Song-Chun Zhu, Hongjing Lu
2019CogSciPartitioning the Perception of Physical and Social Events Within a Unified Psychological Space.Tianmin Shu, Yujia Peng, Hongjing Lu, Song-Chun Zhu
2019CVPRExplainable AI as Collaborative Task Solving.Arjun R. Akula, Changsong Liu, Sinisa Todorovic, Joyce Y. Chai, Song-Chun Zhu
2019CVPRNatural Language Interaction with Explainable AI Models.Arjun R. Akula, Sinisa Todorovic, Joyce Y. Chai, Song-Chun Zhu
2019CVPRDivergence Triangle for Joint Training of Generator Model, Energy-Based Model, and Inferential Model.Tian Han, Erik Nijkamp, Xiaolin Fang, Mitch Hill, Song-Chun Zhu, Ying Nian Wu
2019CVPRUnsupervised Disentangling of Appearance and Geometry by Deformable Generator Network.Xianglei Xing, Tian Han, Ruiqi Gao, Song-Chun Zhu, Ying Nian Wu
2019CVPRRAVEN: A Dataset for Relational and Analogical Visual REasoNing.Chi Zhang, Feng Gao, Baoxiong Jia, Yixin Zhu, Song-Chun Zhu
2019CVPRReasoning Visual Dialogs With Structural and Partial Observations.Zilong Zheng, Wenguan Wang, Siyuan Qi, Song-Chun Zhu
2019FPGASparse Winograd Convolutional Neural Networks on Small-scale Systolic Arrays.Feng Shi, Haochen Li, Yuhe Gao, Benjamin Kuschner, Song-Chun Zhu
2019ICCVHolistic++ Scene Understanding: Single-View 3D Holistic Scene Parsing and Human Pose Estimation With Human-Object Interaction and Physical Commonsense.Yixin Chen, Siyuan Huang, Tao Yuan, Yixin Zhu, Siyuan Qi, Song-Chun Zhu
2019ICCVUnderstanding Human Gaze Communication by Spatio-Temporal Graph Reasoning.Lifeng Fan, Wenguan Wang, Song-Chun Zhu, Xinyu Tang, Siyuan Huang
2019ICCVDenseRaC: Joint 3D Pose and Shape Estimation by Dense Render-and-Compare.Yuanlu Xu, Song-Chun Zhu, Tony Tung
2019ICLRLearning Grid Cells as Vector Representation of Self-Position Coupled with Matrix Representation of Self-Motion.Ruiqi Gao, Jianwen Xie, Song-Chun Zhu, Ying Nian Wu
2019ICRAHigh-Fidelity Grasping in Virtual Reality using a Glove-based System.Hangxin Liu, Zhenliang Zhang, Xu Xie, Yixin Zhu, Yue Liu, Yongtian Wang, Song-Chun Zhu
2019ICRASelf-Supervised Incremental Learning for Sound Source Localization in Complex Indoor Environment.Hangxin Liu, Zeyu Zhang, Yixin Zhu, Song-Chun Zhu
2019IROSLearning Virtual Grasp with Failed Demonstrations via Bayesian Inverse Reinforcement Learning.Xu Xie, Changyang Li, Chi Zhang, Yixin Zhu, Song-Chun Zhu
2018AAAILearning Pose Grammar to Encode Human Body Configuration for 3D Pose Estimation.Haoshu Fang, Yuanlu Xu, Wenguan Wang, Xiaobai Liu, Song-Chun Zhu
2018AAAITracking Occluded Objects and Recovering Incomplete Trajectories by Reasoning About Containment Relations and Human Actions.Wei Liang, Yixin Zhu, Song-Chun Zhu
2018AAAIScene-Centric Joint Parsing of Cross-View Videos.Hang Qi, Yuanlu Xu, Tao Yuan, Tianfu Wu, Song-Chun Zhu
2018AAAIInterpreting CNN Knowledge via an Explanatory Graph.Quanshi Zhang, Ruiming Cao, Feng Shi, Ying Nian Wu, Song-Chun Zhu
2018AAAIExamining CNN Representations With Respect to Dataset Bias.Quanshi Zhang, Wenguan Wang, Song-Chun Zhu
2018CogSciHuman Causal Transfer: Challenges for Deep Reinforcement Learning.Mark Edmonds, James Kubricht, Colin Summers, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu, Hongjing Lu
2018CVPRInferring Shared Attention in Social Scene Videos.Lifeng Fan, Yixin Chen, Ping Wei, Wenguan Wang, Song-Chun Zhu
2018CVPRLearning Generative ConvNets via Multi-Grid Modeling and Sampling.Ruiqi Gao, Yang Lu, Junpei Zhou, Song-Chun Zhu, Ying Nian Wu
2018CVPRHuman-Centric Indoor Scene Synthesis Using Stochastic Grammar.Siyuan Qi, Yixin Zhu, Siyuan Huang, Chenfanfu Jiang, Song-Chun Zhu
2018CVPRAttentive Fashion Grammar Network for Fashion Landmark Detection and Clothing Category Classification.Wenguan Wang, Yuanlu Xu, Jianbing Shen, Song-Chun Zhu
2018CVPRWhere and Why Are They Looking? Jointly Inferring Human Attention and Intentions in Complex Tasks.Ping Wei, Yang Liu, Tianmin Shu, Nanning Zheng, Song-Chun Zhu
2018CVPRLearning Descriptor Networks for 3D Shape Synthesis and Analysis.Jianwen Xie, Zilong Zheng, Ruiqi Gao, Wenguan Wang, Song-Chun Zhu, Ying Nian Wu
2018CVPRA Causal And-Or Graph Model for Visibility Fluent Reasoning in Tracking Interacting Objects.Yuanlu Xu, Lei Qin, Xiaobai Liu, Jianwen Xie, Song-Chun Zhu
2018CVPRInterpretable Convolutional Neural Networks.Quanshi Zhang, Ying Nian Wu, Song-Chun Zhu
2018ECCVHolistic 3D Scene Parsing and Reconstruction from a Single RGB Image.Siyuan Huang, Siyuan Qi, Yixin Zhu, Yinxue Xiao, Yuanlu Xu, Song-Chun Zhu
2018ECCVLearning Human-Object Interactions by Graph Parsing Neural Networks.Siyuan Qi, Wenguan Wang, Baoxiong Jia, Jianbing Shen, Song-Chun Zhu
2018ICMLGeneralized Earley Parser: Bridging Symbolic Grammars and Sequence Data for Future Prediction.Siyuan Qi, Baoxiong Jia, Song-Chun Zhu
2018ICRAInteractive Robot Knowledge Patching Using Augmented Reality.Hangxin Liu, Yaofang Zhang, Wenwen Si, Xu Xie, Yixin Zhu, Song-Chun Zhu
2018ICRAIntent-Aware Multi-Agent Reinforcement Learning.Siyuan Qi, Song-Chun Zhu
2018ICRAUnsupervised Learning of Hierarchical Models for Hand-Object Interactions.Xu Xie, Hangxin Liu, Mark Edmonds, Feng Gao, Siyuan Qi, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu
2018VRSpatially Perturbed Collision Sounds Attenuate Perceived Causality in 3D Launching Events.Duotun Wang, James Kubricht, Yixin Zhu, Wei Liang, Song-Chun Zhu, Chenfanfu Jiang, Hongjing Lu
2017AAAIAlternating Back-Propagation for Generator Network.Tian Han, Yang Lu, Song-Chun Zhu, Ying Nian Wu
2017AAAICross-View People Tracking by Scene-Centered Spatio-Temporal Parsing.Yuanlu Xu, Xiaobai Liu, Lei Qin, Song-Chun Zhu
2017AAAIGrowing Interpretable Part Graphs on ConvNets via Multi-Shot Learning.Quanshi Zhang, Ruiming Cao, Ying Nian Wu, Song-Chun Zhu
2017CogSciConsistent Probabilistic Simulation Underlying Human Judgment in Substance Dynamics.James Kubricht, Yixin Zhu, Chenfanfu Jiang, Demetri Terzopoulos, Song-Chun Zhu, Hongjing Lu
2017CogSciVisuomotor Adaptation and Sensory Recalibration in Reversed Hand Movement Task.Jenny Lin, Yixin Zhu, James Kubricht, Song-Chun Zhu, Hongjing Lu
2017CogSciInferring Human Interaction from Motion Trajectories in Aerial Videos.Tianmin Shu, Yujia Peng, Lifeng Fan, Hongjing Lu, Song-Chun Zhu
2017CoRLLearning Human Utility from Video Demonstrations for Deductive Planning in Robotics.Nishant Shukla, Yunzhong He, Frank Chen, Song-Chun Zhu
2017CVPRInferring Hidden Statuses and Actions in Video by Causal Reasoning.Amy Sue Fire, Song-Chun Zhu
2017CVPRCERN: Confidence-Energy Recurrent Network for Group Activity Recognition.Tianmin Shu, Sinisa Todorovic, Song-Chun Zhu
2017CVPRGenerative Hierarchical Learning of Sparse FRAME Models.Jianwen Xie, Yifei Xu, Erik Nijkamp, Ying Nian Wu, Song-Chun Zhu
2017CVPRSynthesizing Dynamic Patterns by Spatial-Temporal Generative ConvNet.Jianwen Xie, Song-Chun Zhu, Ying Nian Wu
2017CVPRMining Object Parts from CNNs via Active Question-Answering.Quanshi Zhang, Ruiming Cao, Ying Nian Wu, Song-Chun Zhu
2017ICCVJointly Recognizing Object Fluents and Tasks in Egocentric Videos.Yang Liu, Ping Wei, Song-Chun Zhu
2017ICCVMonocular 3D Human Pose Estimation by Predicting Depth on Joints.Bruce Xiaohan Nie, Ping Wei, Song-Chun Zhu
2017ICCVPredicting Human Activities Using Stochastic Grammar.Siyuan Qi, Siyuan Huang, Ping Wei, Song-Chun Zhu
2017IJCAIInferring Human Attention by Learning Latent Intentions.Ping Wei, Dan Xie, Nanning Zheng, Song-Chun Zhu
2017IJCAISingle-Image 3D Scene Parsing Using Geometric Commonsense.Chengcheng Yu, Xiaobai Liu, Song-Chun Zhu
2017IROSFeeling the force: Integrating force and pose for fluent discovery through imitation learning to open medicine bottles.Mark Edmonds, Feng Gao, Xu Xie, Hangxin Liu, Siyuan Qi, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu
2017IROSA glove-based system for studying hand-object manipulation via joint pose and force sensing.Hangxin Liu, Xu Xie, Matt Millar, Mark Edmonds, Feng Gao, Yixin Zhu, Veronica J. Santos, Brandon Rothrock, Song-Chun Zhu
2017ICRALearning social affordance grammar from videos: Transferring human interactions to human-robot interactions.Tianmin Shu, Xiaofeng Gao, Michael S. Ryoo, Song-Chun Zhu
2016AAAITask Learning through Visual Demonstration and Situated Dialogue.Changsong Liu, Joyce Y. Chai, Nishant Shukla, Song-Chun Zhu
2016AAAILearning FRAME Models Using CNN Filters.Yang Lu, Song-Chun Zhu, Ying Nian Wu
2016CogSciProbabilistic Simulation Predicts Human Performance on Viscous Fluid-Pouring Problem.James Kubricht, Chenfanfu Jiang, Yixin Zhu, Song-Chun Zhu, Demetri Terzopoulos, Hongjing Lu
2016CogSciCritical Features of Joint Actions that Signal Human Interaction.Tianmin Shu, Steven M. Thurman, Dawn Chen, Song-Chun Zhu, Hongjing Lu
2016CVPRRecognizing Car Fluents from Video.Bo Li, Tianfu Wu, Caiming Xiong, Song-Chun Zhu
2016CVPRMulti-view People Tracking via Hierarchical Trajectory Composition.Yuanlu Xu, Xiaobai Liu, Yang Liu, Song-Chun Zhu
2016CVPRInferring Forces and Learning Human Utilities from Videos.Yixin Zhu, Chenfanfu Jiang, Yibiao Zhao, Demetri Terzopoulos, Song-Chun Zhu
2016EMNLPJointly Learning Grounded Task Structures from Language Instruction and Visual Demonstration.Changsong Liu, Shaohua Yang, Sari Saba-Sadiya, Nishant Shukla, Yunzhong He, Song-Chun Zhu, Joyce Yue Chai
2016ICMLA Theory of Generative ConvNet.Jianwen Xie, Yang Lu, Song-Chun Zhu, Ying Nian Wu
2016IJCAIWhat Is Where: Inferring Containment Relations from Videos.Wei Liang, Yibiao Zhao, Yixin Zhu, Song-Chun Zhu
2016IJCAILearning Social Affordance for Human-Robot Interaction.Tianmin Shu, Michael S. Ryoo, Song-Chun Zhu
2016IROSInferring human intent from video by sampling hierarchical plans.Steven Holtzen, Yibiao Zhao, Tao Gao, Joshua B. Tenenbaum, Song-Chun Zhu
2016ICRARobot learning with a spatial, temporal, and causal and-or graph.Caiming Xiong, Nishant Shukla, Wenlong Xiong, Song-Chun Zhu
2016NAACLGrounded Semantic Role Labeling.Shaohua Yang, Qiaozi Gao, Changsong Liu, Caiming Xiong, Song-Chun Zhu, Joyce Y. Chai
2016SIGGRAPHA virtual reality platform for dynamic human-scene interaction.Jenny Lin, Xingwen Guo, Jingyu Shao, Chenfanfu Jiang, Yixin Zhu, Song-Chun Zhu
2016SIGGRAPHEvaluating physical quantities and learning human utilities from RGBD videos.Yixin Zhu, Chenfanfu Jiang, Yibiao Zhao, Demetri Terzopoulos, Song-Chun Zhu
2015CogSciEvaluating Human Cognition of Containing Relations with Physical Simulation.Wei Liang, Yibiao Zhao, Yixin Zhu, Song-Chun Zhu
2015CVPRJoint action recognition and pose estimation from video.Bruce Xiaohan Nie, Caiming Xiong, Song-Chun Zhu
2015CVPRJoint inference of groups, events and human roles in aerial videos.Tianmin Shu, Dan Xie, Brandon Rothrock, Sinisa Todorovic, Song-Chun Zhu
2015CVPRUnderstanding tools: Task-oriented object modeling, learning and recognition.Yixin Zhu, Yibiao Zhao, Song-Chun Zhu
2015ICCVAutomated Facial Trait Judgment and Election Outcome Prediction: Social Dimensions of Face.Jungseock Joo, Francis F. Steen, Song-Chun Zhu
2015ICCVAttributed Grammars for Joint Estimation of Human Attributes, Part and Pose.Seyoung Park, Song-Chun Zhu
2015ICCVMining And-Or Graphs for Graph Matching and Object Discovery.Quanshi Zhang, Ying Nian Wu, Song-Chun Zhu
2014CVPRUnsupervised Learning of Dictionaries of Hierarchical Compositional Models.Jifeng Dai, Yi Hong, Wenze Hu, Song-Chun Zhu, Ying Nian Wu
2014CVPRVisual Persuasion: Inferring Communicative Intents of Images.Jungseock Joo, Weixin Li, Francis F. Steen, Song-Chun Zhu
2014CVPRSingle-View 3D Scene Parsing by Attributed Grammar.Xiaobai Liu, Yibiao Zhao, Song-Chun Zhu
2014CVPROnline Object Tracking, Learning, and Parsing with And-Or Graphs.Yang Lu, Tianfu Wu, Song-Chun Zhu
2014CVPRCross-View Action Modeling, Learning, and Recognition.Jiang Wang, Xiaohan Nie, Yin Xia, Ying Wu, Song-Chun Zhu
2014CVPRLearning Inhomogeneous FRAME Models for Object Patterns.Jianwen Xie, Wenze Hu, Song-Chun Zhu, Ying Nian Wu
2014ECCVIntegrating Context and Occlusion for Car Detection by Hierarchical And-Or Model.Bo Li, Tianfu Wu, Song-Chun Zhu
2014ICRADetecting potential falling objects by inferring human action and natural disturbance.Bo Zheng, Yibiao Zhao, Joey C. Yu, Katsushi Ikeuchi, Song-Chun Zhu
2013AAAILearning Perceptual Causality from Video.Amy Sue Fire, Song-Chun Zhu
2013CogSciUsing Causal Induction in Humans to Learn and Infer Causality from Video.Amy Sue Fire, Song-Chun Zhu
2013CVPRIntegrating Grammar and Segmentation for Human Pose Estimation.Brandon Rothrock, Seyoung Park, Song-Chun Zhu
2013CVPRDiscriminatively Trained And-Or Tree Models for Object Detection.Xi Song, Tianfu Wu, Yunde Jia, Song-Chun Zhu
2013CVPRScene Parsing by Integrating Function, Geometry and Appearance Models.Yibiao Zhao, Song-Chun Zhu
2013CVPRBeyond Point Clouds: Scene Understanding by Reasoning Geometry and Physics.Bo Zheng, Yibiao Zhao, Joey C. Yu, Katsushi Ikeuchi, Song-Chun Zhu
2013ICCVMonte Carlo Tree Search for Scheduling Activity Recognition.Mohamed R. Amer, Sinisa Todorovic, Alan Fern, Song-Chun Zhu
2013ICCVCosegmentation and Cosketch by Unsupervised Learning.Jifeng Dai, Ying Nian Wu, Jie Zhou, Song-Chun Zhu
2013ICCVHuman Attribute Recognition by Rich Appearance Dictionary.Jungseock Joo, Shuo Wang, Song-Chun Zhu
2013ICCVModeling Occlusion by Discriminative AND-OR Structures.Bo Li, Wenze Hu, Tianfu Wu, Song-Chun Zhu
2013ICCVConcurrent Action Detection with Structural Prediction.Ping Wei, Nanning Zheng, Yibiao Zhao, Song-Chun Zhu
2013ICCVModeling 4D Human-Object Interactions for Event and Object Recognition.Ping Wei, Yibiao Zhao, Nanning Zheng, Song-Chun Zhu
2013ICCVLearning Near-Optimal Cost-Sensitive Decision Policy for Object Detection.Tianfu Wu, Song-Chun Zhu
2013ICCVInferring "Dark Matter" and "Dark Energy" from Videos.Dan Xie, Sinisa Todorovic, Song-Chun Zhu
2012ACCVHierarchical Space Tiling for Scene Modeling.Shuo Wang, Yizhou Wang, Song-Chun Zhu
2012WACVReconfigurable templates for robust vehicle detection and classification.Yang Lv, Benjamin Z. Yao, Yongtian Wang, Song-Chun Zhu
2012WACVLearning reconfigurable scene representation by tangram model.Jun Zhu, Tianfu Wu, Song-Chun Zhu, Xiaokang Yang, Wenjun Zhang
2011ICCVVideo Primal Sketch: A generic middle-level representation of video.Zhi Han, Zongben Xu, Song-Chun Zhu
2011ICCVImage representation by active curves.Wenze Hu, Ying Nian Wu, Song-Chun Zhu
2011ICCVParsing video events with goal inference and intent prediction.Mingtao Pei, Yunde Jia, Song-Chun Zhu
2011ICCVUnsupervised learning of event AND-OR grammar and semantics from video.Zhangzhang Si, Mingtao Pei, Benjamin Z. Yao, Song-Chun Zhu
2008CVPRSAVE: A framework for semantic annotation of visual events.Mun Wai Lee, Asaad Hakeem, Niels Haering, Song-Chun Zhu
2008CVPRLearning a scene contextual model for tracking and abnormality detection.Benjamin Z. Yao, Liang Wang, Song-Chun Zhu
2004CVPRAutomatic Single View Building Reconstruction by Integrating Segmentation.Feng Han, Song-Chun Zhu