Skip to content

Chuang Gan

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

146

Venues

21

Active years

2013–2026

Best venue rank

A*

Where they publish

Papers

146 indexed papers, newest first.

YearVenueTitleAuthors
2026ACLSteering LLM Thinking with Budget Guidance.Junyan Li, Wenshuo Zhao, Yang Zhang, Chuang Gan
2026ACLTailored Primitive Initialization is the Secret Key to Reinforcement Learning.Yihang Yao, Guangtao Zeng, Raina Wu, Yang Zhang, Ding Zhao, Zhang-Wei Hong, Chuang Gan
2026ASPLOSTaming the Long-Tail: Efficient Reasoning RL Training with Adaptive Drafter.Qinghao Hu, Shang Yang, Junxian Guo, Xiaozhe Yao, Yujun Lin, Yuxian Gu, Han Cai, Chuang Gan, Ana Klimovic, Song Han
2026IWQoSCodedFRER: Enhancing Reliability for FRER Protocol via Erasure Codes in Error-Prone Networks.Shi Dun, Haolan Jia, Chuang Gan, Yuchong Hu, Tianyun Long, Dan Feng
2025AAAIUniMuMo: Unified Text, Music, and Motion Generation.Han Yang, Kun Su, Yutong Zhang, Jiaben Chen, Kaizhi Qian, Gaowen Liu, Chuang Gan
2025ACLYour Language Model May Think Too Rigidly: Achieving Reasoning Consistency with Symmetry-Enhanced Training.Yihang Yao, Zhepeng Cen, Miao Li, William Han, Yuyou Zhang, Emerson Liu, Zuxin Liu, Chuang Gan, Ding Zhao
2025CVPR3D-Mem: 3D Scene Memory for Embodied Exploration and Reasoning.Yuncong Yang, Han Yang, Jiachen Zhou, Peihao Chen, Hongxin Zhang, Yilun Du, Chuang Gan
2025CVPRLSceneLLM: Enhancing Large 3D Scene Understanding Using Adaptive Visual Preferences.Hongyan Zhi, Peihao Chen, Junyan Li, Shuailei Ma, Xinyu Sun, Tianhang Xiang, Yinjie Lei, Mingkui Tan, Chuang Gan
2025FASTRevisiting Network Coding for Warm Blob Storage.Chuang Gan, Yuchong Hu, Leyan Zhao, Xin Zhao, Pengyu Gong, Dan Feng
2025ICCVRapVerse: Coherent Vocals and Whole-Body Motion Generation from Text.Jiaben Chen, Xin Yan, Yihang Chen, Siyuan Cen, Zixin Wang, Qinwei Ma, Haoyu Zhen, Kaizhi Qian, Lie Lu, Chuang Gan
2025ICCVVCA: Video Curious Agent for Long Video Understanding.Zeyuan Yang, Delin Chen, Xueyang Yu, Maohao Shen, Chuang Gan
2025ICCVLearning 4D Embodied World Models.Haoyu Zhen, Qiao Sun, Hongxin Zhang, Junyan Li, Siyuan Zhou, Yilun Du, Chuang Gan
2025ICLRSafeDiffuser: Safe Planning with Diffusion Probabilistic Models.Wei Xiao, Tsun-Hsuan Wang, Chuang Gan, Ramin M. Hasani, Mathias Lechner, Daniela Rus
2025ICLRScaling Autonomous Agents via Automatic Reward Modeling And Planning.Zhenfang Chen, Delin Chen, Rui Sun, Wenjun Liu, Chuang Gan
2025ICLRDelta: Dense Efficient Long-Range 3D tracking for any video.Tuan Duc Ngo, Peiye Zhuang, Evangelos Kalogerakis, Chuang Gan, Sergey Tulyakov, Hsin-Ying Lee, Chaoyang Wang
2025ICLRTopoGaussian: Inferring Internal Topology Structures from Visual Clues.Xiaoyu Xiong, Changyu Hu, Chunru Lin, Pingchuan Ma, Chuang Gan, Tao Du
2025ICLRCOMBO: Compositional World Models for Embodied Multi-Agent Cooperation.Hongxin Zhang, Zeyuan Wang, Qiushi Lyu, Zheyuan Zhang, Sunli Chen, Tianmin Shu, Behzad Dariush, Kwonjoon Lee, Yilun Du, Chuang Gan
2025ICMLABNet: Adaptive explicit-Barrier Net for Safe and Scalable Robot Learning.Wei Xiao, Tsun-Hsuan Wang, Chuang Gan, Daniela Rus
2025ICMLAdaWorld: Learning Adaptable World Models with Latent Actions.Shenyuan Gao, Siyuan Zhou, Yilun Du, Jun Zhang, Chuang Gan
2025ICMLCommVQ: Commutative Vector Quantization for KV Cache Compression.Junyan Li, Yang Zhang, Muhammad Yusuf Hassan, Talha Chafekar, Tianle Cai, Zhile Ren, Pengsheng Guo, Foroozan Karimzadeh, Colorado Reed, Chong Wang, Chuang Gan
2025ICMLSatori: Reinforcement Learning with Chain-of-Action-Thought Enhances LLM Reasoning via Autoregressive Search.Maohao Shen, Guangtao Zeng, Zhenting Qi, Zhang-Wei Hong, Zhenfang Chen, Wei Lu, Gregory W. Wornell, Subhro Das, David Daniel Cox, Chuang Gan
2025ICRAMatchMaker: Automated Asset Generation for Robotic Assembly.Yian Wang, Bingjie Tang, Chuang Gan, Dieter Fox, Kaichun Mo, Yashraj Narang, Iretiayo Akinola
2024AAAIVisual Chain-of-Thought Prompting for Knowledge-Based Visual Reasoning.Zhenfang Chen, Qinhong Zhou, Yikang Shen, Yining Hong, Zhiqing Sun, Dan Gutfreund, Chuang Gan
2024ACLAligning Large Multimodal Models with Factually Augmented RLHF.Zhiqing Sun, Sheng Shen, Shengcao Cao, Haotian Liu, Chunyuan Li, Yikang Shen, Chuang Gan, Liangyan Gui, Yu-Xiong Wang, Yiming Yang, Kurt Keutzer, Trevor Darrell
2024CoRLUBSoft: A Simulation Platform for Robotic Skill Learning in Unbounded Soft Environments.Chunru Lin, Jugang Fan, Yian Wang, Zeyuan Yang, Zhehuan Chen, Lixing Fang, Tsun-Hsuan Wang, Zhou Xian, Chuang Gan
2024CVPRMultiPLY: A Multisensory Object-Centric Embodied Large Language Model in 3D World.Yining Hong, Zishuo Zheng, Peihao Chen, Yian Wang, Junyan Li, Chuang Gan
2024CVPROpen3DIS: Open-Vocabulary 3D Instance Segmentation with 2D Mask Guidance.Phuc D. A. Nguyen, Tuan Duc Ngo, Evangelos Kalogerakis, Chuang Gan, Anh Tuan Tran, Cuong Pham, Khoi Nguyen
2024CVPRSOK-Bench: A Situated Video Reasoning Benchmark with Aligned Open-World Knowledge.Andong Wang, Bo Wu, Sunli Chen, Zhenfang Chen, Haotian Guan, Wei-Ning Lee, Li Erran Li, Chuang Gan
2024CVPRRILA: Reflective and Imaginative Language Agent for Zero-Shot Semantic Audio-Visual Navigation.Zeyuan Yang, Jiageng Lin, Peihao Chen, Anoop Cherian, Tim K. Marks, Jonathan Le Roux, Chuang Gan
2024ECCVFlexAttention for Efficient High-Resolution Vision-Language Models.Junyan Li, Delin Chen, Tianle Cai, Peihao Chen, Yining Hong, Zhenfang Chen, Yikang Shen, Chuang Gan
2024ICLRGENOME: Generative Neuro-Symbolic Visual Reasoning by Growing and Reusing Modules.Zhenfang Chen, Rui Sun, Wenjun Liu, Yining Hong, Chuang Gan
2024ICLRCoVLM: Composing Visual Entities and Relationships in Large Language Models Via Communicative Decoding.Junyan Li, Delin Chen, Yining Hong, Zhenfang Chen, Peihao Chen, Yikang Shen, Chuang Gan
2024ICLRDIFFTACTILE: A Physics-based Differentiable Tactile Simulator for Contact-rich Robotic Manipulation.Zilin Si, Gu Zhang, Qingwei Ben, Branden Romero, Zhou Xian, Chao Liu, Chuang Gan
2024ICLRSALMON: Self-Alignment with Instructable Reward Models.Zhiqing Sun, Yikang Shen, Hongxin Zhang, Qinhong Zhou, Zhenfang Chen, David Daniel Cox, Yiming Yang, Chuang Gan
2024ICLRThin-Shell Object Manipulations With Differentiable Physics Simulations.Yian Wang, Juntian Zheng, Zhehuan Chen, Zhou Xian, Gu Zhang, Chao Liu, Chuang Gan
2024ICLRBuilding Cooperative Embodied Agents Modularly with Large Language Models.Hongxin Zhang, Weihua Du, Jiaming Shan, Qinhong Zhou, Yilun Du, Joshua B. Tenenbaum, Tianmin Shu, Chuang Gan
2024ICLRHAZARD Challenge: Embodied Decision Making in Dynamically Changing Environments.Qinhong Zhou, Sunli Chen, Yisong Wang, Haozhe Xu, Weihua Du, Hongxin Zhang, Yilun Du, Joshua B. Tenenbaum, Chuang Gan
2024ICMLSpeech Self-Supervised Learning Using Diffusion Model Synthetic Data.Heting Gao, Kaizhi Qian, Junrui Ni, Chuang Gan, Mark A. Hasegawa-Johnson, Shiyu Chang, Yang Zhang
2024ICMLLLM and Simulation as Bilevel Optimizers: A New Paradigm to Advance Physical Scientific Discovery.Pingchuan Ma, Tsun-Hsuan Wang, Minghao Guo, Zhiqing Sun, Joshua B. Tenenbaum, Daniela Rus, Chuang Gan, Wojciech Matusik
2024ICMLRoboGen: Towards Unleashing Infinite Data for Automated Robot Learning via Generative Simulation.Yufei Wang, Zhou Xian, Feng Chen, Tsun-Hsuan Wang, Yian Wang, Katerina Fragkiadaki, Zackory Erickson, David Held, Chuang Gan
2024ICMLContPhy: Continuum Physical Concept Learning and Reasoning from Videos.Zhicheng Zheng, Xin Yan, Zhenfang Chen, Jingzhou Wang, Qin Zhi Eddie Lim, Joshua B. Tenenbaum, Chuang Gan
2024ICML3D-VLA: A 3D Vision-Language-Action Generative World Model.Haoyu Zhen, Xiaowen Qiu, Peihao Chen, Jincheng Yang, Xin Yan, Yilun Du, Yining Hong, Chuang Gan
2024ICMLRoboDreamer: Learning Compositional World Models for Robot Imagination.Siyuan Zhou, Yilun Du, Jiaben Chen, Yandong Li, Dit-Yan Yeung, Chuang Gan
2024ICRAConceptGraphs: Open-Vocabulary 3D Scene Graphs for Perception and Planning.Qiao Gu, Ali Kuwajerwala, Sacha Morin, Krishna Murthy Jatavallabhula, Bipasha Sen, Aditya Agarwal, Corban Rivera, William Paul, Kirsty Ellis, Rama Chellappa, Chuang Gan, Celso Miguel de Melo, Joshua B. Tenenbaum, Antonio Torralba, Florian Shkurti, Liam Paull
2024IROSDisentangled Acoustic Fields For Multimodal Physical Scene Understanding.Jie Yin, Andrew Luo, Yilun Du, Anoop Cherian, Tim K. Marks, Jonathan Le Roux, Chuang Gan
2023ACLJECC: Commonsense Reasoning Tasks Derived from Interactive Fictions.Mo Yu, Yi Gu, Xiaoxiao Guo, Yufei Feng, Xiaodan Zhu, Michael A. Greenspan, Murray Campbell, Chuang Gan
2023CVPRMod-Squad: Designing Mixtures of Experts As Modular Multi-Task Learners.Zitian Chen, Yikang Shen, Mingyu Ding, Zhenfang Chen, Hengshuang Zhao, Erik G. Learned-Miller, Chuang Gan
2023CVPRVisual Dependency Transformers: Dependency Tree Emerges from Reversed Attention.Mingyu Ding, Yikang Shen, Lijie Fan, Zhenfang Chen, Zitian Chen, Ping Luo, Joshua B. Tenenbaum, Chuang Gan
2023CVPR3D Concept Learning and Reasoning from Multi-View Images.Yining Hong, Chunru Lin, Yilun Du, Zhenfang Chen, Joshua B. Tenenbaum, Chuang Gan
2023CVPRLearning Situation Hyper-Graphs for Video Question Answering.Aisha Urooj Khan, Hilde Kuehne, Bo Wu, Kim Chheu, Walid Bousselham, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2023CVPRECYao Mu, Shunyu Yao, Mingyu Ding, Ping Luo, Chuang Gan
2023CVPRMasked Motion Encoding for Self-Supervised Video Representation Learning.Xinyu Sun, Peihao Chen, Liangwei Chen, Changhao Li, Thomas H. Li, Mingkui Tan, Chuang Gan
2023CVPRPhysics-Driven Diffusion Models for Impact Sound Synthesis from Videos.Kun Su, Kaizhi Qian, Eli Shlizerman, Antonio Torralba, Chuang Gan
2023EMNLPSparse Universal Transformer.Shawn Tan, Yikang Shen, Zhenfang Chen, Aaron C. Courville, Chuang Gan
2023ICCDEnabling Encrypted Delta Compression for Outsourced Storage Systems via Preserving Similarity.Chuang Gan, Yuchong Hu, Leyan Zhao, Xin Zhao, Pengyu Gong, Wenhao Zhang, Lin Wang, Dan Feng
2023ICCVEfficientViT: Lightweight Multi-Scale Attention for High-Resolution Dense Prediction.Han Cai, Junyan Li, Muyan Hu, Chuang Gan, Song Han
2023ICCVLearning Vision-and-Language Navigation from YouTube Videos.Kunyang Lin, Peihao Chen, Diwei Huang, Thomas H. Li, Mingkui Tan, Chuang Gan
2023ICCVTextPSG: Panoptic Scene Graph Generation from Textual Descriptions.Chengyang Zhao, Yikang Shen, Zhenfang Chen, Mingyu Ding, Chuang Gan
2023ICLRDexDeform: Dexterous Deformable Object Manipulation with Human Demonstrations and Differentiable Physics.Sizhe Li, Zhiao Huang, Tao Chen, Tao Du, Hao Su, Joshua B. Tenenbaum, Chuang Gan
2023ICLRPAC-NeRF: Physics Augmented Continuum Neural Radiance Fields for Geometry-Agnostic System Identification.Xuan Li, Yi-Ling Qiao, Peter Yichen Chen, Krishna Murthy Jatavallabhula, Ming Lin, Chenfanfu Jiang, Chuang Gan
2023ICLRSoftZoo: A Soft Robot Co-design Benchmark For Locomotion In Diverse Environments.Tsun-Hsuan Wang, Pingchuan Ma, Andrew Everett Spielberg, Zhou Xian, Hao Zhang, Joshua B. Tenenbaum, Daniela Rus, Chuang Gan
2023ICLRFluidLab: A Differentiable Environment for Benchmarking Complex Fluid Manipulation.Zhou Xian, Bo Zhu, Zhenjia Xu, Hsiao-Yu Tung, Antonio Torralba, Katerina Fragkiadaki, Chuang Gan
2023ICLRHyper-Decision Transformer for Efficient Online Policy Adaptation.Mengdi Xu, Yuchen Lu, Yikang Shen, Shun Zhang, Ding Zhao, Chuang Gan
2023ICLRPlanning with Large Language Models for Code Generation.Shun Zhang, Zhenfang Chen, Yikang Shen, Mingyu Ding, Joshua B. Tenenbaum, Chuang Gan
2023ICMLLearning Neural Constitutive Laws from Motion Observations for Generalizable PDE Dynamics.Pingchuan Ma, Peter Yichen Chen, Bolei Deng, Joshua B. Tenenbaum, Tao Du, Chuang Gan, Wojciech Matusik
2023ICMLOn the Forward Invariance of Neural ODEs.Wei Xiao, Tsun-Hsuan Wang, Ramin M. Hasani, Mathias Lechner, Yutong Ban, Chuang Gan, Daniela Rus
2023ICMLReparameterized Policy Learning for Multimodal Trajectory Optimization.Zhiao Huang, Litian Liang, Zhan Ling, Xuanlin Li, Chuang Gan, Hao Su
2023ICRADeep Masked Graph Matching for Correspondence Identification in Collaborative Perception.Peng Gao, Qingzhao Zhu, Hongsheng Lu, Chuang Gan, Hao Zhang
2023MICROPockEngine: Sparse and Efficient Fine-tuning in a Pocket.Ligeng Zhu, Lanxiang Hu, Ji Lin, Wei-Ming Chen, Wei-Chen Wang, Chuang Gan, Song Han
2022CoRLEmbodied Concept Learner: Self-supervised Learning of Concepts and Mapping through Instruction Following.Mingyu Ding, Yan Xu, Zhenfang Chen, David Daniel Cox, Ping Luo, Joshua B. Tenenbaum, Chuang Gan
2022CoRLPlanning with Spatial-Temporal Abstraction from Point Clouds for Deformable Object Manipulation.Xingyu Lin, Carl Qi, Yunchu Zhang, Zhiao Huang, Katerina Fragkiadaki, Yunzhu Li, Chuang Gan, David Held
2022CVPRFinding Fallen Objects Via Asynchronous Audio-Visual Integration.Chuang Gan, Yi Gu, Siyuan Zhou, Jeremy Schwartz, Seth Alter, James Traer, Dan Gutfreund, Joshua B. Tenenbaum, Josh H. McDermott, Antonio Torralba
2022CVPRFixing Malfunctional Objects With Learned Physical Simulation and Functional Prediction.Yining Hong, Kaichun Mo, Li Yi, Leonidas J. Guibas, Antonio Torralba, Joshua B. Tenenbaum, Chuang Gan
2022CVPRAutoGPart: Intermediate Supervision Search for Generalizable 3D Part Segmentation.Xueyi Liu, Xiaomeng Xu, Anyi Rao, Chuang Gan, Li Yi
2022ECCVWeakly Supervised Grounding for VQA in Vision-Language Transformers.Aisha Urooj Khan, Hilde Kuehne, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2022ECCVPrototype-Guided Continual Adaptation for Class-Incremental Unsupervised Domain Adaptation.Hongbin Lin, Yifan Zhang, Zhen Qiu, Shuaicheng Niu, Chuang Gan, Yanxia Liu, Mingkui Tan
2022EMNLPRevisiting the Roles of "Text" in Text Games.Yi Gu, Shunyu Yao, Chuang Gan, Josh Tenenbaum, Mo Yu
2022ICLRRISP: Rendering-Invariant State Predictor with Differentiable Simulation and Rendering for Cross-Domain Parameter Estimation.Pingchuan Ma, Tao Du, Joshua B. Tenenbaum, Wojciech Matusik, Chuang Gan
2022ICLRNetwork Augmentation for Tiny Deep Learning.Han Cai, Chuang Gan, Ji Lin, Song Han
2022ICLRComPhy: Compositional Physical Reasoning of Objects and Events from Videos.Zhenfang Chen, Kexin Yi, Yunzhu Li, Mingyu Ding, Antonio Torralba, Joshua B. Tenenbaum, Chuang Gan
2022ICLRContact Points Discovery for Soft-Body Manipulations with Differentiable Physics.Sizhe Li, Zhiao Huang, Tao Du, Hao Su, Joshua B. Tenenbaum, Chuang Gan
2022ICLRDiffSkill: Skill Abstraction from Differentiable Physics for Deformable Object Manipulations with Tools.Xingyu Lin, Zhiao Huang, Yunzhu Li, Joshua B. Tenenbaum, David Held, Chuang Gan
2022ICLRFALCON: Fast Visual Concept Learning by Integrating Images, Linguistic descriptions, and Conceptual Relations.Lingjie Mei, Jiayuan Mao, Ziqi Wang, Chuang Gan, Joshua B. Tenenbaum
2022ICLRLinking Emergent and Natural Languages via Corpus Transfer.Shunyu Yao, Mo Yu, Yang Zhang, Karthik R. Narasimhan, Joshua B. Tenenbaum, Chuang Gan
2022ICMLPrompting Decision Transformer for Few-Shot Policy Generalization.Mengdi Xu, Yikang Shen, Shun Zhang, Yuchen Lu, Ding Zhao, Joshua B. Tenenbaum, Chuang Gan
2022ICRAThe ThreeDWorld Transport Challenge: A Visually Guided Task-and-Motion Planning Benchmark Towards Physically Realistic Embodied AI.Chuang Gan, Siyuan Zhou, Jeremy Schwartz, Seth Alter, Abhishek Bhandwaldar, Dan Gutfreund, Daniel L. K. Yamins, James J. DiCarlo, Josh H. McDermott, Antonio Torralba, Joshua B. Tenenbaum
2022IROSNoisy Agents: Self-supervised Exploration by Predicting Auditory Events.Chuang Gan, Xiaoyu Chen, Phillip Isola, Antonio Torralba, Joshua B. Tenenbaum
2021AAAIRSPNet: Relative Speed Perception for Unsupervised Video Representation Learning.Peihao Chen, Deng Huang, Dongliang He, Xiang Long, Runhao Zeng, Shilei Wen, Mingkui Tan, Chuang Gan
2021AAAIMVFNet: Multi-View Fusion Network for Efficient Video Recognition.Wenhao Wu, Dongliang He, Tianwei Lin, Fu Li, Chuang Gan, Errui Ding
2021AAAIAugmenting Policy Learning with Routines Discovered from a Single Demonstration.Zelin Zhao, Chuang Gan, Jiajun Wu, Xiaoxiao Guo, Joshua B. Tenenbaum
2021CVPRFound a Reason for me? Weakly-supervised Grounded Visual Question Answering using Capsules.Aisha Urooj Khan, Hilde Kuehne, Kevin Duarte, Chuang Gan, Niels da Vitoria Lobo, Mubarak Shah
2021ICCVCurious Representation Learning for Embodied Intelligence.Yilun Du, Chuang Gan, Phillip Isola
2021ICLROn Fast Adversarial Robustness Adaptation in Model-Agnostic Meta-Learning.Ren Wang, Kaidi Xu, Sijia Liu, Pin-Yu Chen, Tsui-Wei Weng, Chuang Gan, Meng Wang
2021ICLRGrounding Physical Concepts of Objects and Events Through Dynamic Visual Reasoning.Zhenfang Chen, Jiayuan Mao, Jiajun Wu, Kwan-Yee Kenneth Wong, Joshua B. Tenenbaum, Chuang Gan
2021ICLRPlasticineLab: A Soft-Body Manipulation Benchmark with Differentiable Physics.Zhiao Huang, Yuanming Hu, Tao Du, Siyuan Zhou, Hao Su, Joshua B. Tenenbaum, Chuang Gan
2021ICLRLearning Task Decomposition with Ordered Memory Policy Network.Yuchen Lu, Yikang Shen, Siyuan Zhou, Aaron C. Courville, Joshua B. Tenenbaum, Chuang Gan
2021ICMLAdversarial Option-Aware Hierarchical Imitation Learning.Mingxuan Jing, Wenbing Huang, Fuchun Sun, Xiaojian Ma, Tao Kong, Chuang Gan, Lei Li
2021ICMLGlobal Prosody Style Transfer Without Text Transcriptions.Kaizhi Qian, Yang Zhang, Shiyu Chang, Jinjun Xiong, Chuang Gan, David D. Cox, Mark Hasegawa-Johnson
2021ICMLAGENT: A Benchmark for Core Psychological Reasoning.Tianmin Shu, Abhishek Bhandwaldar, Chuang Gan, Kevin A. Smith, Shari Liu, Dan Gutfreund, Elizabeth S. Spelke, Joshua B. Tenenbaum, Tomer D. Ullman
2021IJCAITemporal and Object Quantification Networks.Jiayuan Mao, Zhezheng Luo, Chuang Gan, Joshua B. Tenenbaum, Jiajun Wu, Leslie Pack Kaelbling, Tomer D. Ullman
2021IJCNNMAGCN: A Multi-Adaptive Graph Convolutional Network for Traffic Forecasting.Qingyuan Zhan, Guixing Wu, Chuang Gan
2021IROSOPEn: An Open-ended Physics Environment for Learning Without a Task.Chuang Gan, Abhishek Bhandwaldar, Antonio Torralba, Joshua B. Tenenbaum, Phillip Isola
2021WSDMThe 1st International Workshop on Machine Reasoning: International Machine Reasoning Conference (MRC 2021).Yongfeng Zhang, Min Zhang, Hanxiong Chen, Xu Chen, Xianjie Chen, Chuang Gan, Tong Sun, Xin Luna Dong
2020AAAILocation-Aware Graph Convolutional Networks for Video Question Answering.Deng Huang, Peihao Chen, Runhao Zeng, Qing Du, Mingkui Tan, Chuang Gan
2020ACLHAT: Hardware-Aware Transformers for Efficient Natural Language Processing.Hanrui Wang, Zhanghao Wu, Zhijian Liu, Han Cai, Ligeng Zhu, Chuang Gan, Song Han
2020CVPRMusic Gesture for Visual Sound Separation.Chuang Gan, Deng Huang, Hang Zhao, Joshua B. Tenenbaum, Antonio Torralba
2020CVPRDense Regression Network for Video Grounding.Runhao Zeng, Haoming Xu, Wenbing Huang, Peihao Chen, Mingkui Tan, Chuang Gan
2020ECCVFoley Music: Learning to Generate Music from Videos.Chuang Gan, Deng Huang, Peihao Chen, Joshua B. Tenenbaum, Antonio Torralba
2020ECCVDataMix: Efficient Privacy-Preserving Edge-Cloud Inference.Zhijian Liu, Zhanghao Wu, Chuang Gan, Ligeng Zhu, Song Han
2020EMNLPInteractive Fiction Game Playing as Multi-Paragraph Reading Comprehension with Reinforcement Learning.Xiaoxiao Guo, Mo Yu, Yupeng Gao, Chuang Gan, Murray Campbell, Shiyu Chang
2020ICLROnce-for-All: Train One Network and Specialize it for Efficient Deployment.Han Cai, Chuang Gan, Tianzhe Wang, Zhekai Zhang, Song Han
2020ICLRCLEVRER: Collision Events for Video Representation and Reasoning.Kexin Yi, Chuang Gan, Yunzhu Li, Pushmeet Kohli, Jiajun Wu, Antonio Torralba, Joshua B. Tenenbaum
2020ICLRDeep Audio Priors Emerge From Harmonic Convolutional Networks.Zhoutong Zhang, Yunyun Wang, Chuang Gan, Jiajun Wu, Joshua B. Tenenbaum, Antonio Torralba, William T. Freeman
2020ICRALook, Listen, and Act: Towards Audio-Visual Embodied Navigation.Chuang Gan, Yiwei Zhang, Jiajun Wu, Boqing Gong, Joshua B. Tenenbaum
2019AAAIControllable Image-to-Video Translation: A Case Study on Facial Expression Generation.Lijie Fan, Wenbing Huang, Chuang Gan, Junzhou Huang, Boqing Gong
2019AAAIStNet: Local and Global Spatial-Temporal Modeling for Action Recognition.Dongliang He, Zhichao Zhou, Chuang Gan, Fu Li, Xiao Liu, Yandong Li, Limin Wang, Shilei Wen
2019AAAIBeyond RNNs: Positional Self-Attention with Co-Attention for Video Question Answering.Xiangpeng Li, Jingkuan Song, Lianli Gao, Xianglong Liu, Wenbing Huang, Xiangnan He, Chuang Gan
2019CVPRSelf-Supervised Segmentation and Source Separation on Videos.Andrew Rouditchenko, Hang Zhao, Chuang Gan, Josh H. McDermott, Antonio Torralba
2019ICASSPSelf-supervised Audio-visual Co-segmentation.Andrew Rouditchenko, Hang Zhao, Chuang Gan, Josh H. McDermott, Antonio Torralba
2019ICCVSelf-Supervised Moving Vehicle Tracking With Stereo Sound.Chuang Gan, Hang Zhao, Peihao Chen, David D. Cox, Antonio Torralba
2019ICCVTSM: Temporal Shift Module for Efficient Video Understanding.Ji Lin, Chuang Gan, Song Han
2019ICCVGraph Convolutional Networks for Temporal Action Localization.Runhao Zeng, Wenbing Huang, Chuang Gan, Mingkui Tan, Yu Rong, Peilin Zhao, Junzhou Huang
2019ICCVThe Sound of Motions.Hang Zhao, Chuang Gan, Wei-Chiu Ma, Antonio Torralba
2019ICLRDefensive Quantization: When Efficiency Meets Robustness.Ji Lin, Chuang Gan, Song Han
2019ICLRThe Neuro-Symbolic Concept Learner: Interpreting Scenes, Words, and Sentences From Natural Supervision.Jiayuan Mao, Chuang Gan, Pushmeet Kohli, Joshua B. Tenenbaum, Jiajun Wu
2018AAAIT-C3D: Temporal Convolutional 3D Network for Real-Time Action Recognition.Kun Liu, Wu Liu, Chuang Gan, Mingkui Tan, Huadong Ma
2018AAAIMultimodal Keyless Attention Fusion for Video Classification.Xiang Long, Chuang Gan, Gerard de Melo, Xiao Liu, Yandong Li, Fu Li, Shilei Wen
2018CVPRSparse, Smart Contours to Represent and Edit Images.Tali Dekel, Chuang Gan, Dilip Krishnan, Ce Liu, William T. Freeman
2018CVPREnd-to-End Learning of Motion Representation for Video Understanding.Lijie Fan, Wen-bing Huang, Chuang Gan, Stefano Ermon, Boqing Gong, Junzhou Huang
2018CVPRGeometry Guided Convolutional Neural Networks for Self-Supervised Video Representation Learning.Chuang Gan, Boqing Gong, Kun Liu, Hao Su, Leonidas J. Guibas
2018CVPRAttention Clusters: Purely Attention Based Local Feature Integration for Video Classification.Xiang Long, Chuang Gan, Gerard de Melo, Jiajun Wu, Xiao Liu, Shilei Wen
2018ECCVThe Sound of Pixels.Hang Zhao, Chuang Gan, Andrew Rouditchenko, Carl Vondrick, Josh H. McDermott, Antonio Torralba
2018ECCVUnsupervised Domain Adaptation for 3D Keypoint Estimation via View Consistency.Xingyi Zhou, Arjun Karpur, Chuang Gan, Linjie Luo, Qixing Huang
2017AAAIDECK: Discovering Event Composition Knowledge from Web Images for Zero-Shot Event Detection and Recounting in Videos.Chuang Gan, Chen Sun, Ram Nevatia
2017CVPRStyleNet: Generating Attractive Visual Captions with Styles.Chuang Gan, Zhe Gan, Xiaodong He, Jianfeng Gao, Li Deng
2017CVPRSemantic Compositional Networks for Visual Captioning.Zhe Gan, Chuang Gan, Xiaodong He, Yunchen Pu, Kenneth Tran, Jianfeng Gao, Lawrence Carin, Li Deng
2017ICCVVQS: Linking Segmentations to Questions and Answers for Supervised Attention in VQA and Question-Focused Semantic Segmentation.Chuang Gan, Yandong Li, Haoxiang Li, Chen Sun, Boqing Gong
2017ICCVRecurrent Topic-Transition GAN for Visual Paragraph Generation.Xiaodan Liang, Zhiting Hu, Hao Zhang, Chuang Gan, Eric P. Xing
2016AAAIConcepts Not Alone: Exploring Pairwise Relationships for Zero-Shot Video Activity Recognition.Chuang Gan, Ming Lin, Yi Yang, Gerard de Melo, Alexander G. Hauptmann
2016CVPRLearning Attributes Equals Multi-Source Domain Generalization.Chuang Gan, Tianbao Yang, Boqing Gong
2016CVPRYou Lead, We Exceed: Labor-Free Video Concept Learning by Jointly Exploiting Web Videos and Images.Chuang Gan, Ting Yao, Kuiyuan Yang, Yi Yang, Tao Mei
2016ECCVWebly-Supervised Video Recognition by Mutually Voting for Relevant Web Images and Web Video Frames.Chuang Gan, Chen Sun, Lixin Duan, Boqing Gong
2015AAAIExploring Semantic Inter-Class Relationships (SIR) for Zero-Shot Action Recognition.Chuang Gan, Ming Lin, Yi Yang, Yueting Zhuang, Alexander G. Hauptmann
2015CVPRDevNet: A Deep Event Network for multimedia event detection and evidence recounting.Chuang Gan, Naiyan Wang, Yi Yang, Dit-Yan Yeung, Alexander G. Hauptmann
2015ICCVAutomatic Concept Discovery from Parallel Text and Visual Corpora.Chen Sun, Chuang Gan, Ram Nevatia
2013VCIPSalient object detection in image sequences via spatial-temporal cue.Chuang Gan, Zengchang Qin, Jia Xu, Tao Wan