| 2026 | AAAI | Video Echoed in Music: Semantic, Temporal, and Rhythmic Alignment for Video-to-Music Generation. | Xinyi Tong, Yiran Zhu, Jishang Chen, Chunru Zhan, Tianle Wang, Sirui Zhang, Nian Liu, Tiezheng Ge, Duo Xu, Xin Jin, Feng Yu, Song-Chun Zhu |
| 2026 | AAAI | TongUI: Internet-Scale Trajectories from Multimodal Web Tutorials for Generalized GUI Agents. | Bofei Zhang, Zirui Shang, Zhi Gao, Wang Zhang, Rui Xie, Xiaojian Ma, Tao Yuan, Xinxiao Wu, Song-Chun Zhu, Qing Li |
| 2026 | ACL | JurisBench: A Deep Benchmark for Assessing Large Language Models in Professional Legal Practice. | Ziang Chen, Guannan Li, Fanlin Ji, Yipeng Kang, Jiaqi Li, Muhan Zhang, Yangtao Zhang, Li Tianjiao, Jiannan Wang, Xin Guo, Song-Chun Zhu, Bin Ling |
| 2026 | ACL | SIV-Bench: A Video Benchmark for Social Interaction Understanding and Reasoning. | Fanqi Kong, Weiqin Zu, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2026 | ACL | v-HUB: A Benchmark for Video Humor Understanding from Vision and Sound. | Zhengpeng Shi, Yanpeng Zhao, Jianqun Zhou, Yuxuan Wang, Qinrong Cui, Wei Bi, Song-Chun Zhu, Bo Zhao, Zilong Zheng |
| 2025 | AAAI | Differentiable Information Enhanced Model-Based Reinforcement Learning. | Xiaoyuan Zhang, Xinyan Cai, Bo Liu, Weidong Huang, Song-Chun Zhu, Siyuan Qi, Yaodong Yang |
| 2025 | ACL | ReflectEvo: Improving Meta Introspection of Small LLMs by Learning Self-Reflection. | Jiaqi Li, Xinyi Dong, Yang Liu, Zhizhuo Yang, Quansen Wang, Xiaobo Wang, Song-Chun Zhu, Zixia Jia, Zilong Zheng |
| 2025 | CVPR | Unveiling the Mist over 3D Vision-Language Understanding: Object-centric Evaluation with Chain-of-Analysis. | Jiangyong Huang, Baoxiong Jia, Yan Wang, Ziyu Zhu, Xiongkun Linghu, Qing Li, Song-Chun Zhu, Siyuan Huang |
| 2025 | CVPR | Decompositional Neural Scene Reconstruction with Generative Diffusion Prior. | Junfeng Ni, Yu Liu, Ruijie Lu, Zirui Zhou, Song-Chun Zhu, Yixin Chen, Siyuan Huang |
| 2025 | CVPR | METASCENES: Towards Automated Replica Creation for Real-world 3D Scans. | Huangyue Yu, Baoxiong Jia, Yixin Chen, Yandan Yang, Puhao Li, Rongpeng Su, Jiaxin Li, Qing Li, Wei Liang, Song-Chun Zhu, Tengyu Liu, Siyuan Huang |
| 2025 | EMNLP | Enhancing LLM-Based Social Bot via an Adversarial Learning Framework. | Fanqi Kong, Xiaoyuan Zhang, Xinyu Chen, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2025 | ICLR | Multi-modal Agent Tuning: Building a VLM-Driven Agent for Efficient Tool Usage. | Zhi Gao, Bofei Zhang, Pengxiang Li, Xiaojian Ma, Tao Yuan, Yue Fan, Yuwei Wu, Yunde Jia, Song-Chun Zhu, Qing Li |
| 2025 | ICLR | Building Interactable Replicas of Complex Articulated Objects via Gaussian Splatting. | Yu Liu, Baoxiong Jia, Ruijie Lu, Junfeng Ni, Song-Chun Zhu, Siyuan Huang |
| 2024 | AAAI | ProAgent: Building Proactive Cooperative Agents with Large Language Models. | Ceyao Zhang, Kaijie Yang, Siyi Hu, Zihao Wang, Guanghe Li, Yihang Sun, Cheng Zhang, Zhaowei Zhang, Anji Liu, Song-Chun Zhu, Xiaojun Chang, Junge Zhang, Feng Yin, Yitao Liang, Yaodong Yang |
| 2024 | ACL | LangSuit·E: Planning, Controlling and Interacting with Large Language Models in Embodied Text Environments. | Zixia Jia, Mengmeng Wang, Baichen Tong, Song-Chun Zhu, Zilong Zheng |
| 2024 | ACL | RulE: Knowledge Graph Reasoning with Rule Embedding. | Xiaojuan Tang, Song-Chun Zhu, Yitao Liang, Muhan Zhang |
| 2024 | CVPR | CLOVA: A Closed-LOop Visual Assistant with Tool Usage and Update. | Zhi Gao, Yuntao Du, Xintong Zhang, Xiaojian Ma, Wenjuan Han, Song-Chun Zhu, Qing Li |
| 2024 | ICLR | Neural-Symbolic Recursive Machine for Systematic Generalization. | Qing Li, Yixin Zhu, Yitao Liang, Ying Nian Wu, Song-Chun Zhu, Siyuan Huang |
| 2024 | ICLR | CivRealm: A Learning and Reasoning Odyssey in Civilization for Decision-Making Agents. | Siyuan Qi, Shuo Chen, Yexin Li, Xiangyu Kong, Junqi Wang, Bangcheng Yang, Pring Wong, Yifan Zhong, Xiaoyuan Zhang, Zhaowei Zhang, Nian Liu, Yaodong Yang, Song-Chun Zhu |
| 2024 | ICLR | Bongard-OpenWorld: Few-Shot Reasoning for Free-form Visual Concepts in the Real World. | Rujie Wu, Xiaojian Ma, Zhenliang Zhang, Wei Wang, Qing Li, Song-Chun Zhu, Yizhou Wang |
| 2024 | ICML | Efficient Adaptation in Mixed-Motive Environments via Hierarchical Opponent Modeling and Planning. | Yizhe Huang, Anji Liu, Fanqi Kong, Yaodong Yang, Song-Chun Zhu, Xue Feng |
| 2024 | ICML | An Embodied Generalist Agent in 3D World. | Jiangyong Huang, Silong Yong, Xiaojian Ma, Xiongkun Linghu, Puhao Li, Yan Wang, Qing Li, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang |
| 2024 | ICML | Fast Peer Adaptation with Context-aware Exploration. | Long Ma, Yuanfei Wang, Fangwei Zhong, Song-Chun Zhu, Yizhou Wang |
| 2024 | IROS | Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations. | Puhao Li, Tengyu Liu, Yuyang Li, Muzhi Han, Haoran Geng, Shu Wang, Yixin Zhu, Song-Chun Zhu, Siyuan Huang |
| 2024 | IROS | LLM | Shu Wang, Muzhi Han, Ziyuan Jiao, Zeyu Zhang, Ying Nian Wu, Song-Chun Zhu, Hangxin Liu |
| 2024 | VR | On the Emergence of Symmetrical Reality. | Zhenliang Zhang, Zeyu Zhang, Ziyuan Jiao, Yao Su, Hangxin Liu, Wei Wang, Song-Chun Zhu |
| 2024 | SIGdial | MindDial: Enhancing Conversational Agents with Theory-of-Mind for Common Ground Alignment and Negotiation. | Shuwen Qiu, Mingdian Liu, Hengli Li, Song-Chun Zhu, Zilong Zheng |
| 2023 | CVPR | Diffusion-based Generation, Optimization, and Planning in 3D Scenes. | Siyuan Huang, Zan Wang, Puhao Li, Baoxiong Jia, Tengyu Liu, Yixin Zhu, Wei Liang, Song-Chun Zhu |
| 2023 | ICCV | X-VoE: Measuring eXplanatory Violation of Expectation in Physical Events. | Bo Dai, Linge Wang, Baoxiong Jia, Zeyu Zhang, Song-Chun Zhu, Chi Zhang, Yixin Zhu |
| 2023 | ICCV | ARNOLD: A Benchmark for Language-Grounded Task Learning With Continuous States in Realistic 3D Scenes. | Ran Gong, Jiangyong Huang, Yizhou Zhao, Haoran Geng, Xiaofeng Gao, Qingyang Wu, Wensi Ai, Ziheng Zhou, Demetri Terzopoulos, Song-Chun Zhu, Baoxiong Jia, Siyuan Huang |
| 2023 | ICLR | A Minimalist Dataset for Systematic Generalization of Perception, Syntax, and Semantics. | Qing Li, Siyuan Huang, Yining Hong, Yixin Zhu, Ying Nian Wu, Song-Chun Zhu |
| 2023 | ICLR | Dynamic Prompt Learning via Policy Gradient for Semi-structured Mathematical Reasoning. | Pan Lu, Liang Qiu, Kai-Wei Chang, Ying Nian Wu, Song-Chun Zhu, Tanmay Rajpurohit, Peter Clark, Ashwin Kalyan |
| 2023 | ICLR | SQA3D: Situated Question Answering in 3D Scenes. | Xiaojian Ma, Silong Yong, Zilong Zheng, Qing Li, Yitao Liang, Song-Chun Zhu, Siyuan Huang |
| 2023 | ICML | On the Complexity of Bayesian Generalization. | Yu-Zhe Shi, Manjie Xu, John E. Hopcroft, Kun He, Joshua B. Tenenbaum, Song-Chun Zhu, Ying Nian Wu, Wenjuan Han, Yixin Zhu |
| 2023 | IROS | Learning a Causal Transition Model for Object Cutting. | Zeyu Zhang, Muzhi Han, Baoxiong Jia, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu, Hangxin Liu |
| 2023 | IROS | Part-level Scene Reconstruction Affords Robot Interaction. | Zeyu Zhang, Lexing Zhang, Zaijin Wang, Ziyuan Jiao, Muzhi Han, Yixin Zhu, Song-Chun Zhu, Hangxin Liu |
| 2023 | ICRA | Rearrange Indoor Scenes for Human-Robot Co-Activity. | Weiqi Wang, Zihang Zhao, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu, Hangxin Liu |
| 2022 | AAAI | Learning V1 Simple Cells with Vector Representation of Local Content and Matrix Representation of Local Motion. | Ruiqi Gao, Jianwen Xie, Siyuan Huang, Yufan Ren, Song-Chun Zhu, Ying Nian Wu |
| 2022 | AAAI | ValueNet: A New Dataset for Human Value Driven Dialogue System. | Liang Qiu, Yizhou Zhao, Jinchao Li, Pan Lu, Baolin Peng, Jianfeng Gao, Song-Chun Zhu |
| 2022 | AAAI | Learning from the Tangram to Solve Mini Visual Tasks. | Yizhou Zhao, Liang Qiu, Pan Lu, Feng Shi, Tian Han, Song-Chun Zhu |
| 2022 | ECCV | Learning Algebraic Representation for Systematic Generalization in Abstract Reasoning. | Chi Zhang, Sirui Xie, Baoxiong Jia, Ying Nian Wu, Song-Chun Zhu, Yixin Zhu |
| 2022 | ICLR | RelViT: Concept-guided Vision Transformer for Visual Relational Reasoning. | Xiaojian Ma, Weili Nie, Zhiding Yu, Huaizu Jiang, Chaowei Xiao, Yuke Zhu, Song-Chun Zhu, Anima Anandkumar |
| 2022 | ICLR | MCMC Should Mix: Learning Energy-Based Model with Neural Transport Latent Space MCMC. | Erik Nijkamp, Ruiqi Gao, Pavel Sountsov, Srinivas Vasudevan, Bo Pang, Song-Chun Zhu, Ying Nian Wu |
| 2022 | ICML | COAT: Measuring Object Compositionality in Emergent Representations. | Sirui Xie, Ari S. Morcos, Song-Chun Zhu, Ramakrishna Vedantam |
| 2022 | ICML | Latent Diffusion Energy-Based Model for Interpretable Text Modelling. | Peiyu Yu, Sirui Xie, Xiaojian Ma, Baoxiong Jia, Bo Pang, Ruiqi Gao, Yixin Zhu, Song-Chun Zhu, Ying Nian Wu |
| 2022 | IROS | Sequential Manipulation Planning on Scene Graph. | Ziyuan Jiao, Yida Niu, Zeyu Zhang, Song-Chun Zhu, Yixin Zhu, Hangxin Liu |
| 2022 | SIGdial | Towards Socially Intelligent Agents with Mental State Transition and Human Value. | Liang Qiu, Yizhou Zhao, Yuan Liang, Pan Lu, Weiyan Shi, Zhou Yu, Song-Chun Zhu |
| 2021 | AAAI | Learning by Fixing: Solving Math Word Problems with Weak Supervision. | Yining Hong, Qing Li, Daniel Ciao, Siyuan Huang, Song-Chun Zhu |
| 2021 | AAAI | SMART: A Situation Model for Algebra Story Problems via Attributed Grammar. | Yining Hong, Qing Li, Ran Gong, Daniel Ciao, Siyuan Huang, Song-Chun Zhu |
| 2021 | AAAI | Learning Cycle-Consistent Cooperative Networks via Alternating MCMC Teaching for Unsupervised Cross-Domain Translation. | Jianwen Xie, Zilong Zheng, Xiaolin Fang, Song-Chun Zhu, Ying Nian Wu |
| 2021 | ACL | Inter-GPS: Interpretable Geometry Problem Solving with Formal Language and Symbolic Reasoning. | Pan Lu, Ran Gong, Shibiao Jiang, Liang Qiu, Siyuan Huang, Xiaodan Liang, Song-Chun Zhu |
| 2021 | ACL | SocAoG: Incremental Graph Parsing for Social Relation Inference in Dialogues. | Liang Qiu, Yuan Liang, Yizhou Zhao, Pan Lu, Baolin Peng, Zhou Yu, Ying Nian Wu, Song-Chun Zhu |
| 2021 | ACL | GRICE: A Grammar-based Dataset for Recovering Implicature and Conversational rEasoning. | Zilong Zheng, Shuwen Qiu, Lifeng Fan, Yixin Zhu, Song-Chun Zhu |
| 2021 | CVPR | ACRE: Abstract Causal REasoning Beyond Covariation. | Chi Zhang, Baoxiong Jia, Mark Edmonds, Song-Chun Zhu, Yixin Zhu |
| 2021 | CVPR | Abstract Spatial-Temporal Reasoning via Probabilistic Abduction and Execution. | Chi Zhang, Baoxiong Jia, Song-Chun Zhu, Yixin Zhu |
| 2021 | CVPR | Learning Triadic Belief Dynamics in Nonverbal Communication From Videos. | Lifeng Fan, Shuwen Qiu, Zilong Zheng, Tao Gao, Song-Chun Zhu, Yixin Zhu |
| 2021 | CVPR | Generative PointNet: Deep Energy-Based Learning on Unordered Point Sets for 3D Generation, Reconstruction and Classification. | Jianwen Xie, Yifei Xu, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu |
| 2021 | CVPR | Learning Neural Representation of Camera Pose with Matrix Representation of Pose Shift via View Synthesis. | Yaxuan Zhu, Ruiqi Gao, Siyuan Huang, Song-Chun Zhu, Ying Nian Wu |
| 2021 | EMNLP | CrossVQA: Scalably Generating Benchmarks for Systematically Testing VQA Generalization. | Arjun R. Akula, Soravit Changpinyo, Boqing Gong, Piyush Sharma, Song-Chun Zhu, Radu Soricut |
| 2021 | EMNLP | Mind the Context: The Impact of Contextualization in Neural Module Networks for Grounding Visual Referring Expressions. | Arjun R. Akula, Spandana Gella, Keze Wang, Song-Chun Zhu, Siva Reddy |
| 2021 | ICCV | YouRefIt: Embodied Reference Understanding with Language and Gesture. | Yixin Chen, Qing Li, Deqian Kong, Yik Lun Kei, Song-Chun Zhu, Tao Gao, Yixin Zhu, Siyuan Huang |
| 2021 | ICCV | VLGrammar: Grounded Grammar Induction of Vision and Language. | Yining Hong, Qing Li, Song-Chun Zhu, Siyuan Huang |
| 2021 | ICCV | Spatio-temporal Self-Supervised Representation Learning for 3D Point Clouds. | Siyuan Huang, Yichen Xie, Song-Chun Zhu, Yixin Zhu |
| 2021 | ICLR | Stochastic Security: Adversarial Defense Using Long-Run Dynamics of Energy-Based Models. | Mitch Hill, Jonathan Craig Mitchell, Song-Chun Zhu |
| 2021 | ICRA | Congestion-aware Multi-agent Trajectory Prediction for Collision Avoidance. | Xu Xie, Chi Zhang, Yixin Zhu, Ying Nian Wu, Song-Chun Zhu |
| 2021 | ICRA | Reconstructing Interactive 3D Scenes by Panoptic Mapping and CAD Model Alignments. | Muzhi Han, Zeyu Zhang, Ziyuan Jiao, Xu Xie, Yixin Zhu, Song-Chun Zhu, Hangxin Liu |
| 2021 | IROS | Consolidating Kinematic Models to Promote Coordinated Mobile Manipulations. | Ziyuan Jiao, Zeyu Zhang, Xin Jiang, David K. Han, Song-Chun Zhu, Yixin Zhu, Hangxin Liu |
| 2021 | IROS | Efficient Task Planning for Mobile Manipulation: a Virtual Kinematic Chain Perspective. | Ziyuan Jiao, Zeyu Zhang, Weiqi Wang, David K. Han, Song-Chun Zhu, Yixin Zhu, Hangxin Liu |
| 2020 | AAAI | CoCoX: Generating Conceptual and Counterfactual Explanations via Fault-Lines. | Arjun R. Akula, Shuai Wang, Song-Chun Zhu |
| 2020 | AAAI | Theory-Based Causal Transfer: Integrating Instance-Level Induction and Abstract-Level Structure Learning. | Mark Edmonds, Xiaojian Ma, Siyuan Qi, Yixin Zhu, Hongjing Lu, Song-Chun Zhu |
| 2020 | AAAI | On the Anatomy of MCMC-Based Maximum Likelihood Learning of Energy-Based Models. | Erik Nijkamp, Mitch Hill, Tian Han, Song-Chun Zhu, Ying Nian Wu |
| 2020 | AAAI | Motion-Based Generator Model: Unsupervised Disentanglement of Appearance, Trackable and Intrackable Motions in Dynamic Patterns. | Jianwen Xie, Ruiqi Gao, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu |
| 2020 | AAAI | Machine Number Sense: A Dataset of Visual Arithmetic Problems for Abstract and Relational Reasoning. | Wenhe Zhang, Chi Zhang, Yixin Zhu, Song-Chun Zhu |
| 2020 | ACL | Words Aren't Enough, Their Order Matters: On the Robustness of Grounding Visual Referring Expressions. | Arjun R. Akula, Spandana Gella, Yaser Al-Onaizan, Song-Chun Zhu, Siva Reddy |
| 2020 | CVPR | Joint Training of Variational Auto-Encoder and Latent Energy-Based Model. | Tian Han, Erik Nijkamp, Linqi Zhou, Bo Pang, Song-Chun Zhu, Ying Nian Wu |
| 2020 | CVPR | Inducing Hierarchical Compositional Model by Sparsifying Generator Network. | Xianglei Xing, Tianfu Wu, Song-Chun Zhu, Ying Nian Wu |
| 2020 | ECCV | LEMMA: A Multi-view Dataset for LEarning Multi-agent Multi-task Activities. | Baoxiong Jia, Yixin Chen, Siyuan Huang, Yixin Zhu, Song-Chun Zhu |
| 2020 | ECCV | A Competence-Aware Curriculum for Visual Concepts Learning via Question Answering. | Qing Li, Siyuan Huang, Yining Hong, Song-Chun Zhu |
| 2020 | ECCV | Learning Multi-layer Latent Variable Model via Variational Optimization of Short Run MCMC for Approximate Inference. | Erik Nijkamp, Bo Pang, Tian Han, Linqi Zhou, Song-Chun Zhu, Ying Nian Wu |
| 2020 | EMNLP | Structured Attention for Unsupervised Dialogue Structure Induction. | Liang Qiu, Yizhou Zhao, Weiyan Shi, Yuan Liang, Feng Shi, Tao Yuan, Zhou Yu, Song-Chun Zhu |
| 2020 | ICML | Closed Loop Neural-Symbolic Learning via Integrating Neural Perception, Grammar Parsing, and Symbolic Reasoning. | Qing Li, Siyuan Huang, Yining Hong, Yixin Chen, Ying Nian Wu, Song-Chun Zhu |
| 2020 | IROS | Graph-based Hierarchical Knowledge Representation for Robot Task Transfer from Virtual to Physical World. | Zhenliang Zhang, Yixin Zhu, Song-Chun Zhu |
| 2020 | IROS | Human-Robot Interaction in a Shared Augmented Reality Workspace. | Shuwen Qiu, Hangxin Liu, Zeyu Zhang, Yixin Zhu, Song-Chun Zhu |
| 2020 | ICRA | Joint Inference of States, Robot Knowledge, and Human (False-)Beliefs. | Tao Yuan, Hangxin Liu, Lifeng Fan, Zilong Zheng, Tao Gao, Yixin Zhu, Song-Chun Zhu |
| 2020 | ICRA | Congestion-aware Evacuation Routing using Augmented Reality Devices. | Zeyu Zhang, Hangxin Liu, Ziyuan Jiao, Yixin Zhu, Song-Chun Zhu |
| 2020 | RO-MAN | Joint Mind Modeling for Explanation Generation in Complex Human-Robot Collaborative Tasks. | Xiaofeng Gao, Ran Gong, Yizhou Zhao, Shu Wang, Tianmin Shu, Song-Chun Zhu |
| 2019 | AAAI | Mirroring without Overimitation: Learning Functionally Equivalent Manipulation Actions. | Hangxin Liu, Chi Zhang, Yixin Zhu, Chenfanfu Jiang, Song-Chun Zhu |
| 2019 | AAAI | Recognizing Unseen Attribute-Object Pair with Generative Model. | Zhixiong Nan, Yang Liu, Nanning Zheng, Song-Chun Zhu |
| 2019 | AAAI | Learning Dynamic Generator Model by Alternating Back-Propagation through Time. | Jianwen Xie, Ruiqi Gao, Zilong Zheng, Song-Chun Zhu, Ying Nian Wu |
| 2019 | AAAI | MetaStyle: Three-Way Trade-off among Speed, Flexibility, and Quality in Neural Style Transfer. | Chi Zhang, Yixin Zhu, Song-Chun Zhu |
| 2019 | CogSci | Decomposing Human Causal Learning: Bottom-up Associative Learning and Top-down Schema Reasoning. | Mark Edmonds, Siyuan Qi, Yixin Zhu, James Kubricht, Song-Chun Zhu, Hongjing Lu |
| 2019 | CogSci | Partitioning the Perception of Physical and Social Events Within a Unified Psychological Space. | Tianmin Shu, Yujia Peng, Hongjing Lu, Song-Chun Zhu |
| 2019 | CVPR | Explainable AI as Collaborative Task Solving. | Arjun R. Akula, Changsong Liu, Sinisa Todorovic, Joyce Y. Chai, Song-Chun Zhu |
| 2019 | CVPR | Natural Language Interaction with Explainable AI Models. | Arjun R. Akula, Sinisa Todorovic, Joyce Y. Chai, Song-Chun Zhu |
| 2019 | CVPR | Divergence Triangle for Joint Training of Generator Model, Energy-Based Model, and Inferential Model. | Tian Han, Erik Nijkamp, Xiaolin Fang, Mitch Hill, Song-Chun Zhu, Ying Nian Wu |
| 2019 | CVPR | Unsupervised Disentangling of Appearance and Geometry by Deformable Generator Network. | Xianglei Xing, Tian Han, Ruiqi Gao, Song-Chun Zhu, Ying Nian Wu |
| 2019 | CVPR | RAVEN: A Dataset for Relational and Analogical Visual REasoNing. | Chi Zhang, Feng Gao, Baoxiong Jia, Yixin Zhu, Song-Chun Zhu |
| 2019 | CVPR | Reasoning Visual Dialogs With Structural and Partial Observations. | Zilong Zheng, Wenguan Wang, Siyuan Qi, Song-Chun Zhu |
| 2019 | FPGA | Sparse Winograd Convolutional Neural Networks on Small-scale Systolic Arrays. | Feng Shi, Haochen Li, Yuhe Gao, Benjamin Kuschner, Song-Chun Zhu |
| 2019 | ICCV | Holistic++ Scene Understanding: Single-View 3D Holistic Scene Parsing and Human Pose Estimation With Human-Object Interaction and Physical Commonsense. | Yixin Chen, Siyuan Huang, Tao Yuan, Yixin Zhu, Siyuan Qi, Song-Chun Zhu |
| 2019 | ICCV | Understanding Human Gaze Communication by Spatio-Temporal Graph Reasoning. | Lifeng Fan, Wenguan Wang, Song-Chun Zhu, Xinyu Tang, Siyuan Huang |
| 2019 | ICCV | DenseRaC: Joint 3D Pose and Shape Estimation by Dense Render-and-Compare. | Yuanlu Xu, Song-Chun Zhu, Tony Tung |
| 2019 | ICLR | Learning Grid Cells as Vector Representation of Self-Position Coupled with Matrix Representation of Self-Motion. | Ruiqi Gao, Jianwen Xie, Song-Chun Zhu, Ying Nian Wu |
| 2019 | ICRA | High-Fidelity Grasping in Virtual Reality using a Glove-based System. | Hangxin Liu, Zhenliang Zhang, Xu Xie, Yixin Zhu, Yue Liu, Yongtian Wang, Song-Chun Zhu |
| 2019 | ICRA | Self-Supervised Incremental Learning for Sound Source Localization in Complex Indoor Environment. | Hangxin Liu, Zeyu Zhang, Yixin Zhu, Song-Chun Zhu |
| 2019 | IROS | Learning Virtual Grasp with Failed Demonstrations via Bayesian Inverse Reinforcement Learning. | Xu Xie, Changyang Li, Chi Zhang, Yixin Zhu, Song-Chun Zhu |
| 2018 | AAAI | Learning Pose Grammar to Encode Human Body Configuration for 3D Pose Estimation. | Haoshu Fang, Yuanlu Xu, Wenguan Wang, Xiaobai Liu, Song-Chun Zhu |
| 2018 | AAAI | Tracking Occluded Objects and Recovering Incomplete Trajectories by Reasoning About Containment Relations and Human Actions. | Wei Liang, Yixin Zhu, Song-Chun Zhu |
| 2018 | AAAI | Scene-Centric Joint Parsing of Cross-View Videos. | Hang Qi, Yuanlu Xu, Tao Yuan, Tianfu Wu, Song-Chun Zhu |
| 2018 | AAAI | Interpreting CNN Knowledge via an Explanatory Graph. | Quanshi Zhang, Ruiming Cao, Feng Shi, Ying Nian Wu, Song-Chun Zhu |
| 2018 | AAAI | Examining CNN Representations With Respect to Dataset Bias. | Quanshi Zhang, Wenguan Wang, Song-Chun Zhu |
| 2018 | CogSci | Human Causal Transfer: Challenges for Deep Reinforcement Learning. | Mark Edmonds, James Kubricht, Colin Summers, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu, Hongjing Lu |
| 2018 | CVPR | Inferring Shared Attention in Social Scene Videos. | Lifeng Fan, Yixin Chen, Ping Wei, Wenguan Wang, Song-Chun Zhu |
| 2018 | CVPR | Learning Generative ConvNets via Multi-Grid Modeling and Sampling. | Ruiqi Gao, Yang Lu, Junpei Zhou, Song-Chun Zhu, Ying Nian Wu |
| 2018 | CVPR | Human-Centric Indoor Scene Synthesis Using Stochastic Grammar. | Siyuan Qi, Yixin Zhu, Siyuan Huang, Chenfanfu Jiang, Song-Chun Zhu |
| 2018 | CVPR | Attentive Fashion Grammar Network for Fashion Landmark Detection and Clothing Category Classification. | Wenguan Wang, Yuanlu Xu, Jianbing Shen, Song-Chun Zhu |
| 2018 | CVPR | Where and Why Are They Looking? Jointly Inferring Human Attention and Intentions in Complex Tasks. | Ping Wei, Yang Liu, Tianmin Shu, Nanning Zheng, Song-Chun Zhu |
| 2018 | CVPR | Learning Descriptor Networks for 3D Shape Synthesis and Analysis. | Jianwen Xie, Zilong Zheng, Ruiqi Gao, Wenguan Wang, Song-Chun Zhu, Ying Nian Wu |
| 2018 | CVPR | A Causal And-Or Graph Model for Visibility Fluent Reasoning in Tracking Interacting Objects. | Yuanlu Xu, Lei Qin, Xiaobai Liu, Jianwen Xie, Song-Chun Zhu |
| 2018 | CVPR | Interpretable Convolutional Neural Networks. | Quanshi Zhang, Ying Nian Wu, Song-Chun Zhu |
| 2018 | ECCV | Holistic 3D Scene Parsing and Reconstruction from a Single RGB Image. | Siyuan Huang, Siyuan Qi, Yixin Zhu, Yinxue Xiao, Yuanlu Xu, Song-Chun Zhu |
| 2018 | ECCV | Learning Human-Object Interactions by Graph Parsing Neural Networks. | Siyuan Qi, Wenguan Wang, Baoxiong Jia, Jianbing Shen, Song-Chun Zhu |
| 2018 | ICML | Generalized Earley Parser: Bridging Symbolic Grammars and Sequence Data for Future Prediction. | Siyuan Qi, Baoxiong Jia, Song-Chun Zhu |
| 2018 | ICRA | Interactive Robot Knowledge Patching Using Augmented Reality. | Hangxin Liu, Yaofang Zhang, Wenwen Si, Xu Xie, Yixin Zhu, Song-Chun Zhu |
| 2018 | ICRA | Intent-Aware Multi-Agent Reinforcement Learning. | Siyuan Qi, Song-Chun Zhu |
| 2018 | ICRA | Unsupervised Learning of Hierarchical Models for Hand-Object Interactions. | Xu Xie, Hangxin Liu, Mark Edmonds, Feng Gao, Siyuan Qi, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu |
| 2018 | VR | Spatially Perturbed Collision Sounds Attenuate Perceived Causality in 3D Launching Events. | Duotun Wang, James Kubricht, Yixin Zhu, Wei Liang, Song-Chun Zhu, Chenfanfu Jiang, Hongjing Lu |
| 2017 | AAAI | Alternating Back-Propagation for Generator Network. | Tian Han, Yang Lu, Song-Chun Zhu, Ying Nian Wu |
| 2017 | AAAI | Cross-View People Tracking by Scene-Centered Spatio-Temporal Parsing. | Yuanlu Xu, Xiaobai Liu, Lei Qin, Song-Chun Zhu |
| 2017 | AAAI | Growing Interpretable Part Graphs on ConvNets via Multi-Shot Learning. | Quanshi Zhang, Ruiming Cao, Ying Nian Wu, Song-Chun Zhu |
| 2017 | CogSci | Consistent Probabilistic Simulation Underlying Human Judgment in Substance Dynamics. | James Kubricht, Yixin Zhu, Chenfanfu Jiang, Demetri Terzopoulos, Song-Chun Zhu, Hongjing Lu |
| 2017 | CogSci | Visuomotor Adaptation and Sensory Recalibration in Reversed Hand Movement Task. | Jenny Lin, Yixin Zhu, James Kubricht, Song-Chun Zhu, Hongjing Lu |
| 2017 | CogSci | Inferring Human Interaction from Motion Trajectories in Aerial Videos. | Tianmin Shu, Yujia Peng, Lifeng Fan, Hongjing Lu, Song-Chun Zhu |
| 2017 | CoRL | Learning Human Utility from Video Demonstrations for Deductive Planning in Robotics. | Nishant Shukla, Yunzhong He, Frank Chen, Song-Chun Zhu |
| 2017 | CVPR | Inferring Hidden Statuses and Actions in Video by Causal Reasoning. | Amy Sue Fire, Song-Chun Zhu |
| 2017 | CVPR | CERN: Confidence-Energy Recurrent Network for Group Activity Recognition. | Tianmin Shu, Sinisa Todorovic, Song-Chun Zhu |
| 2017 | CVPR | Generative Hierarchical Learning of Sparse FRAME Models. | Jianwen Xie, Yifei Xu, Erik Nijkamp, Ying Nian Wu, Song-Chun Zhu |
| 2017 | CVPR | Synthesizing Dynamic Patterns by Spatial-Temporal Generative ConvNet. | Jianwen Xie, Song-Chun Zhu, Ying Nian Wu |
| 2017 | CVPR | Mining Object Parts from CNNs via Active Question-Answering. | Quanshi Zhang, Ruiming Cao, Ying Nian Wu, Song-Chun Zhu |
| 2017 | ICCV | Jointly Recognizing Object Fluents and Tasks in Egocentric Videos. | Yang Liu, Ping Wei, Song-Chun Zhu |
| 2017 | ICCV | Monocular 3D Human Pose Estimation by Predicting Depth on Joints. | Bruce Xiaohan Nie, Ping Wei, Song-Chun Zhu |
| 2017 | ICCV | Predicting Human Activities Using Stochastic Grammar. | Siyuan Qi, Siyuan Huang, Ping Wei, Song-Chun Zhu |
| 2017 | IJCAI | Inferring Human Attention by Learning Latent Intentions. | Ping Wei, Dan Xie, Nanning Zheng, Song-Chun Zhu |
| 2017 | IJCAI | Single-Image 3D Scene Parsing Using Geometric Commonsense. | Chengcheng Yu, Xiaobai Liu, Song-Chun Zhu |
| 2017 | IROS | Feeling the force: Integrating force and pose for fluent discovery through imitation learning to open medicine bottles. | Mark Edmonds, Feng Gao, Xu Xie, Hangxin Liu, Siyuan Qi, Yixin Zhu, Brandon Rothrock, Song-Chun Zhu |
| 2017 | IROS | A glove-based system for studying hand-object manipulation via joint pose and force sensing. | Hangxin Liu, Xu Xie, Matt Millar, Mark Edmonds, Feng Gao, Yixin Zhu, Veronica J. Santos, Brandon Rothrock, Song-Chun Zhu |
| 2017 | ICRA | Learning social affordance grammar from videos: Transferring human interactions to human-robot interactions. | Tianmin Shu, Xiaofeng Gao, Michael S. Ryoo, Song-Chun Zhu |
| 2016 | AAAI | Task Learning through Visual Demonstration and Situated Dialogue. | Changsong Liu, Joyce Y. Chai, Nishant Shukla, Song-Chun Zhu |
| 2016 | AAAI | Learning FRAME Models Using CNN Filters. | Yang Lu, Song-Chun Zhu, Ying Nian Wu |
| 2016 | CogSci | Probabilistic Simulation Predicts Human Performance on Viscous Fluid-Pouring Problem. | James Kubricht, Chenfanfu Jiang, Yixin Zhu, Song-Chun Zhu, Demetri Terzopoulos, Hongjing Lu |
| 2016 | CogSci | Critical Features of Joint Actions that Signal Human Interaction. | Tianmin Shu, Steven M. Thurman, Dawn Chen, Song-Chun Zhu, Hongjing Lu |
| 2016 | CVPR | Recognizing Car Fluents from Video. | Bo Li, Tianfu Wu, Caiming Xiong, Song-Chun Zhu |
| 2016 | CVPR | Multi-view People Tracking via Hierarchical Trajectory Composition. | Yuanlu Xu, Xiaobai Liu, Yang Liu, Song-Chun Zhu |
| 2016 | CVPR | Inferring Forces and Learning Human Utilities from Videos. | Yixin Zhu, Chenfanfu Jiang, Yibiao Zhao, Demetri Terzopoulos, Song-Chun Zhu |
| 2016 | EMNLP | Jointly Learning Grounded Task Structures from Language Instruction and Visual Demonstration. | Changsong Liu, Shaohua Yang, Sari Saba-Sadiya, Nishant Shukla, Yunzhong He, Song-Chun Zhu, Joyce Yue Chai |
| 2016 | ICML | A Theory of Generative ConvNet. | Jianwen Xie, Yang Lu, Song-Chun Zhu, Ying Nian Wu |
| 2016 | IJCAI | What Is Where: Inferring Containment Relations from Videos. | Wei Liang, Yibiao Zhao, Yixin Zhu, Song-Chun Zhu |
| 2016 | IJCAI | Learning Social Affordance for Human-Robot Interaction. | Tianmin Shu, Michael S. Ryoo, Song-Chun Zhu |
| 2016 | IROS | Inferring human intent from video by sampling hierarchical plans. | Steven Holtzen, Yibiao Zhao, Tao Gao, Joshua B. Tenenbaum, Song-Chun Zhu |
| 2016 | ICRA | Robot learning with a spatial, temporal, and causal and-or graph. | Caiming Xiong, Nishant Shukla, Wenlong Xiong, Song-Chun Zhu |
| 2016 | NAACL | Grounded Semantic Role Labeling. | Shaohua Yang, Qiaozi Gao, Changsong Liu, Caiming Xiong, Song-Chun Zhu, Joyce Y. Chai |
| 2016 | SIGGRAPH | A virtual reality platform for dynamic human-scene interaction. | Jenny Lin, Xingwen Guo, Jingyu Shao, Chenfanfu Jiang, Yixin Zhu, Song-Chun Zhu |
| 2016 | SIGGRAPH | Evaluating physical quantities and learning human utilities from RGBD videos. | Yixin Zhu, Chenfanfu Jiang, Yibiao Zhao, Demetri Terzopoulos, Song-Chun Zhu |
| 2015 | CogSci | Evaluating Human Cognition of Containing Relations with Physical Simulation. | Wei Liang, Yibiao Zhao, Yixin Zhu, Song-Chun Zhu |
| 2015 | CVPR | Joint action recognition and pose estimation from video. | Bruce Xiaohan Nie, Caiming Xiong, Song-Chun Zhu |
| 2015 | CVPR | Joint inference of groups, events and human roles in aerial videos. | Tianmin Shu, Dan Xie, Brandon Rothrock, Sinisa Todorovic, Song-Chun Zhu |
| 2015 | CVPR | Understanding tools: Task-oriented object modeling, learning and recognition. | Yixin Zhu, Yibiao Zhao, Song-Chun Zhu |
| 2015 | ICCV | Automated Facial Trait Judgment and Election Outcome Prediction: Social Dimensions of Face. | Jungseock Joo, Francis F. Steen, Song-Chun Zhu |
| 2015 | ICCV | Attributed Grammars for Joint Estimation of Human Attributes, Part and Pose. | Seyoung Park, Song-Chun Zhu |
| 2015 | ICCV | Mining And-Or Graphs for Graph Matching and Object Discovery. | Quanshi Zhang, Ying Nian Wu, Song-Chun Zhu |
| 2014 | CVPR | Unsupervised Learning of Dictionaries of Hierarchical Compositional Models. | Jifeng Dai, Yi Hong, Wenze Hu, Song-Chun Zhu, Ying Nian Wu |
| 2014 | CVPR | Visual Persuasion: Inferring Communicative Intents of Images. | Jungseock Joo, Weixin Li, Francis F. Steen, Song-Chun Zhu |
| 2014 | CVPR | Single-View 3D Scene Parsing by Attributed Grammar. | Xiaobai Liu, Yibiao Zhao, Song-Chun Zhu |
| 2014 | CVPR | Online Object Tracking, Learning, and Parsing with And-Or Graphs. | Yang Lu, Tianfu Wu, Song-Chun Zhu |
| 2014 | CVPR | Cross-View Action Modeling, Learning, and Recognition. | Jiang Wang, Xiaohan Nie, Yin Xia, Ying Wu, Song-Chun Zhu |
| 2014 | CVPR | Learning Inhomogeneous FRAME Models for Object Patterns. | Jianwen Xie, Wenze Hu, Song-Chun Zhu, Ying Nian Wu |
| 2014 | ECCV | Integrating Context and Occlusion for Car Detection by Hierarchical And-Or Model. | Bo Li, Tianfu Wu, Song-Chun Zhu |
| 2014 | ICRA | Detecting potential falling objects by inferring human action and natural disturbance. | Bo Zheng, Yibiao Zhao, Joey C. Yu, Katsushi Ikeuchi, Song-Chun Zhu |
| 2013 | AAAI | Learning Perceptual Causality from Video. | Amy Sue Fire, Song-Chun Zhu |
| 2013 | CogSci | Using Causal Induction in Humans to Learn and Infer Causality from Video. | Amy Sue Fire, Song-Chun Zhu |
| 2013 | CVPR | Integrating Grammar and Segmentation for Human Pose Estimation. | Brandon Rothrock, Seyoung Park, Song-Chun Zhu |
| 2013 | CVPR | Discriminatively Trained And-Or Tree Models for Object Detection. | Xi Song, Tianfu Wu, Yunde Jia, Song-Chun Zhu |
| 2013 | CVPR | Scene Parsing by Integrating Function, Geometry and Appearance Models. | Yibiao Zhao, Song-Chun Zhu |
| 2013 | CVPR | Beyond Point Clouds: Scene Understanding by Reasoning Geometry and Physics. | Bo Zheng, Yibiao Zhao, Joey C. Yu, Katsushi Ikeuchi, Song-Chun Zhu |
| 2013 | ICCV | Monte Carlo Tree Search for Scheduling Activity Recognition. | Mohamed R. Amer, Sinisa Todorovic, Alan Fern, Song-Chun Zhu |
| 2013 | ICCV | Cosegmentation and Cosketch by Unsupervised Learning. | Jifeng Dai, Ying Nian Wu, Jie Zhou, Song-Chun Zhu |
| 2013 | ICCV | Human Attribute Recognition by Rich Appearance Dictionary. | Jungseock Joo, Shuo Wang, Song-Chun Zhu |
| 2013 | ICCV | Modeling Occlusion by Discriminative AND-OR Structures. | Bo Li, Wenze Hu, Tianfu Wu, Song-Chun Zhu |
| 2013 | ICCV | Concurrent Action Detection with Structural Prediction. | Ping Wei, Nanning Zheng, Yibiao Zhao, Song-Chun Zhu |
| 2013 | ICCV | Modeling 4D Human-Object Interactions for Event and Object Recognition. | Ping Wei, Yibiao Zhao, Nanning Zheng, Song-Chun Zhu |
| 2013 | ICCV | Learning Near-Optimal Cost-Sensitive Decision Policy for Object Detection. | Tianfu Wu, Song-Chun Zhu |
| 2013 | ICCV | Inferring "Dark Matter" and "Dark Energy" from Videos. | Dan Xie, Sinisa Todorovic, Song-Chun Zhu |
| 2012 | ACCV | Hierarchical Space Tiling for Scene Modeling. | Shuo Wang, Yizhou Wang, Song-Chun Zhu |
| 2012 | WACV | Reconfigurable templates for robust vehicle detection and classification. | Yang Lv, Benjamin Z. Yao, Yongtian Wang, Song-Chun Zhu |
| 2012 | WACV | Learning reconfigurable scene representation by tangram model. | Jun Zhu, Tianfu Wu, Song-Chun Zhu, Xiaokang Yang, Wenjun Zhang |
| 2011 | ICCV | Video Primal Sketch: A generic middle-level representation of video. | Zhi Han, Zongben Xu, Song-Chun Zhu |
| 2011 | ICCV | Image representation by active curves. | Wenze Hu, Ying Nian Wu, Song-Chun Zhu |
| 2011 | ICCV | Parsing video events with goal inference and intent prediction. | Mingtao Pei, Yunde Jia, Song-Chun Zhu |
| 2011 | ICCV | Unsupervised learning of event AND-OR grammar and semantics from video. | Zhangzhang Si, Mingtao Pei, Benjamin Z. Yao, Song-Chun Zhu |
| 2008 | CVPR | SAVE: A framework for semantic annotation of visual events. | Mun Wai Lee, Asaad Hakeem, Niels Haering, Song-Chun Zhu |
| 2008 | CVPR | Learning a scene contextual model for tracking and abnormality detection. | Benjamin Z. Yao, Liang Wang, Song-Chun Zhu |
| 2004 | CVPR | Automatic Single View Building Reconstruction by Integrating Segmentation. | Feng Han, Song-Chun Zhu |