Mingyu Ding
Publication record assembled from the DBLP archive of ranked conferences.
Papers indexed
55
Venues
13
Active years
2018–2026
Best venue rank
A*
Where they publish
Papers
55 indexed papers, newest first.
| Year | Venue | Title | Authors |
|---|---|---|---|
| 2026 | AAAI | Unlocking the Power of Large Multimodal Models for Robot Learning: Robustness, Generalization, and Opportunities. | Mingyu Ding |
| 2026 | AAAI | ARCHE: A Novel Task to Evaluate LLMs on Latent Reasoning Chain Extraction. | Pengze Li, Jiaqi Liu, Junchi Yu, Lihao Liu, Mingyu Ding, Wanli Ouyang, Shixiang Tang, Xi Chen |
| 2025 | CVPR | CompGS: Unleashing 2D Compositionality for Compositional Text-to-3D via Dynamically Optimizing 3D Gaussians. | Chongjian Ge, Chenfeng Xu, Yuanfeng Ji, Chensheng Peng, Masayoshi Tomizuka, Ping Luo, Mingyu Ding, Varun Jampani, Wei Zhan |
| 2025 | CVPR | DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation. | Zhixuan Liang, Yao Mu, Yixiao Wang, Tianxing Chen, Wenqi Shao, Wei Zhan, Masayoshi Tomizuka, Ping Luo, Mingyu Ding |
| 2025 | CVPR | RoboTwin: Dual-Arm Robot Benchmark with Generative Digital Twins. | Yao Mu, Tianxing Chen, Zanxin Chen, Shijia Peng, Zhiqian Lan, Zeyu Gao, Zhixuan Liang, Qiaojun Yu, Yude Zou, Mingkun Xu, Lunkai Lin, Zhiqiang Xie, Mingyu Ding, Ping Luo |
| 2025 | ICCV | Moto: Latent Motion Token as the Bridging Language for Learning Robot Manipulation from Videos. | Yi Chen, Yuying Ge, Weiliang Tang, Yizhuo Li, Yixiao Ge, Mingyu Ding, Ying Shan, Xihui Liu |
| 2025 | ICLR | X-Drive: Cross-modality Consistent Multi-Sensor Data Synthesis for Driving Scenarios. | Yichen Xie, Chenfeng Xu, Chensheng Peng, Shuqi Zhao, Nhat Ho, Alexander T. Pham, Mingyu Ding, Masayoshi Tomizuka, Wei Zhan |
| 2025 | ICLR | MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models. | Peng Xia, Siwei Han, Shi Qiu, Yiyang Zhou, Zhaoyang Wang, Wenhao Zheng, Zhaorun Chen, Chenhang Cui, Mingyu Ding, Linjie Li, Lijuan Wang, Huaxiu Yao |
| 2025 | ICML | WOMD-Reasoning: A Large-Scale Dataset for Interaction Reasoning in Driving. | Yiheng Li, Cunxin Fan, Chongjian Ge, Seth Z. Zhao, Chenran Li, Chenfeng Xu, Huaxiu Yao, Masayoshi Tomizuka, Bolei Zhou, Chen Tang, Mingyu Ding, Wei Zhan |
| 2025 | ICRA | TrajSSL: Trajectory-Enhanced Semi-Supervised 3D Object Detection. | Philip L. Jacobson, Yichen Xie, Mingyu Ding, Chenfeng Xu, Masayoshi Tomizuka, Wei Zhan, Ming C. Wu |
| 2025 | IROS | ReBot: Scaling Robot Learning with Real-to-Sim-to-Real Robotic Video Synthesis. | Yu Fang, Yue Yang, Xinghao Zhu, Kaiyuan Zheng, Gedas Bertasius, Daniel Szafir, Mingyu Ding |
| 2025 | IROS | PhyGrasp: Generalizing Robotic Grasping with Physics-informed Large Multimodal Models. | Dingkun Guo, Yuqi Xiang, Shuqi Zhao, Xinghao Zhu, Masayoshi Tomizuka, Mingyu Ding, Wei Zhan |
| 2025 | IROS | P | Kun Song, Gaoming Chen, Masayoshi Tomizuka, Wei Zhan, Zhenhua Xiong, Mingyu Ding |
| 2025 | ICRA | Embodiment-agnostic Action Planning via Object-Part Scene Flow. | Weiliang Tang, Jia-Hui Pan, Wei Zhan, Jianshu Zhou, Huaxiu Yao, Yun-Hui Liu, Masayoshi Tomizuka, Mingyu Ding, Chi-Wing Fu |
| 2025 | ICRA | Physics-Aware Robotic Palletization With Online Masking Inference. | Tianqi Zhang, Zheng Wu, Yuxin Chen, Yixiao Wang, Boyuan Liang, Scott Moura, Masayoshi Tomizuka, Mingyu Ding, Wei Zhan |
| 2024 | CoRL | Q-SLAM: Quadric Representations for Monocular SLAM. | Chensheng Peng, Chenfeng Xu, Yue Wang, Mingyu Ding, Heng Yang, Masayoshi Tomizuka, Kurt Keutzer, Marco Pavone, Wei Zhan |
| 2024 | CoRL | Sparse Diffusion Policy: A Sparse, Reusable, and Flexible Policy for Robot Learning. | Yixiao Wang, Yifei Zhang, Mingxiao Huo, Thomas Tian, Xiang Zhang, Yichen Xie, Chenfeng Xu, Pengliang Ji, Wei Zhan, Mingyu Ding, Masayoshi Tomizuka |
| 2024 | CVPR | SkillDiffuser: Interpretable Hierarchical Planning via Skill Abstractions in Diffusion-Based Task Execution. | Zhixuan Liang, Yao Mu, Hengbo Ma, Masayoshi Tomizuka, Mingyu Ding, Ping Luo |
| 2024 | ICLR | Tree-Planner: Efficient Close-loop Task Planning with Large Language Models. | Mengkang Hu, Yao Mu, Xinmiao Yu, Mingyu Ding, Shiguang Wu, Wenqi Shao, Qiguang Chen, Bin Wang, Yu Qiao, Ping Luo |
| 2024 | ICLR | UniAdapter: Unified Parameter-Efficient Transfer Learning for Cross-modal Modeling. | Haoyu Lu, Yuqi Huo, Guoxing Yang, Zhiwu Lu, Wei Zhan, Masayoshi Tomizuka, Mingyu Ding |
| 2024 | ICLR | VDT: General-purpose Video Diffusion Transformers via Mask Modeling. | Haoyu Lu, Guoxing Yang, Nanyi Fei, Yuqi Huo, Zhiwu Lu, Ping Luo, Mingyu Ding |
| 2024 | ICML | RoboCodeX: Multimodal Code Generation for Robotic Behavior Synthesis. | Yao Mu, Junting Chen, Qinglong Zhang, Shoufa Chen, Qiaojun Yu, Chongjian Ge, Runjian Chen, Zhixuan Liang, Mengkang Hu, Chaofan Tao, Peize Sun, Haibao Yu, Chao Yang, Wenqi Shao, Wenhai Wang, Jifeng Dai, Yu Qiao, Mingyu Ding, Ping Luo |
| 2024 | ICRA | Open X-Embodiment: Robotic Learning Datasets and RT-X Models : Open X-Embodiment Collaboration. | Abby O'Neill, Abdul Rehman, Abhiram Maddukuri, Abhishek Gupta, Abhishek Padalkar, Abraham Lee, Acorn Pooley, Agrim Gupta, Ajay Mandlekar, Ajinkya Jain, Albert Tung, Alex Bewley, Alexander Herzog, Alex Irpan, Alexander Khazatsky, Anant Rai, Anchit Gupta, Andrew E. Wang, Anikait Singh, Animesh Garg, Aniruddha Kembhavi, Annie Xie, Anthony Brohan, Antonin Raffin, Archit Sharma, Arefeh Yavary, Arhan Jain, Ashwin Balakrishna, Ayzaan Wahid, Ben Burgess-Limerick, Beomjoon Kim, Bernhard Schlkopf, Blake Wulfe, Brian Ichter, Cewu Lu, Charles Xu, Charlotte Le, Chelsea Finn, Chen Wang, Chenfeng Xu, Cheng Chi, Chenguang Huang, Christine Chan, Christopher Agia, Chuer Pan, Chuyuan Fu, Coline Devin, Danfei Xu, Daniel Morton, Danny Driess, Daphne Chen, Deepak Pathak, Dhruv Shah, Dieter Bchler, Dinesh Jayaraman, Dmitry Kalashnikov, Dorsa Sadigh, Edward Johns, Ethan Paul Foster, Fangchen Liu, Federico Ceola, Fei Xia, Feiyu Zhao, Freek Stulp, Gaoyue Zhou, Gaurav S. Sukhatme, Gautam Salhotra, Ge Yan, Gilbert Feng, Giulio Schiavi, Glen Berseth, Gregory Kahn, Guanzhi Wang, Hao Su, Haoshu Fang, Haochen Shi, Henghui Bao, Heni Ben Amor, Henrik I. Christensen, Hiroki Furuta, Homer Walke, Hongjie Fang, Huy Ha, Igor Mordatch, Ilija Radosavovic, Isabel Leal, Jacky Liang, Jad Abou-Chakra, Jaehyung Kim, Jaimyn Drake, Jan Peters, Jan Schneider, Jasmine Hsu, Jeannette Bohg, Jeffrey T. Bingham, Jeffrey Wu, Jensen Gao, Jiaheng Hu, Jiajun Wu, Jialin Wu, Jiankai Sun, Jianlan Luo, Jiayuan Gu, Jie Tan, Jihoon Oh, Jimmy Wu, Jingpei Lu, Jingyun Yang, Jitendra Malik, Joo Silvrio, Joey Hejna, Jonathan Booher, Jonathan Tompson, Jonathan Yang, Jordi Salvador, Joseph J. Lim, Junhyek Han, Kaiyuan Wang, Kanishka Rao, Karl Pertsch, Karol Hausman, Keegan Go, Keerthana Gopalakrishnan, Ken Goldberg, Kendra Byrne, Kenneth Oslund, Kento Kawaharazuka, Kevin Black, Kevin Lin, Kevin Zhang, Kiana Ehsani, Kiran Lekkala, Kirsty Ellis, Krishan Rana, Krishnan Srinivasan, Kuan Fang, Kunal Pratap Singh, Kuo-Hao Zeng, Kyle Hatch, Kyle Hsu, Laurent Itti, Lawrence Yunliang Chen, Lerrel Pinto, Li Fei-Fei, Liam Tan, Linxi Jim Fan, Lionel Ott, Lisa Lee, Luca Weihs, Magnum Chen, Marion Lepert, Marius Memmel, Masayoshi Tomizuka, Masha Itkina, Mateo Guaman Castro, Max Spero, Maximilian Du, Michael Ahn, Michael C. Yip, Mingtong Zhang, Mingyu Ding, Minho Heo, Mohan Kumar Srirama, Mohit Sharma, Moo Jin Kim, Naoaki Kanazawa, Nicklas Hansen, Nicolas Heess, Nikhil J. Joshi, Niko Snderhauf, Ning Liu, Norman Di Palo, Nur Muhammad (Mahi) Shafiullah, Oier Mees, Oliver Kroemer, Osbert Bastani, Pannag R. Sanketi, Patrick Tree Miller, Patrick Yin, Paul Wohlhart, Peng Xu, Peter David Fagan, Peter Mitrano, Pierre Sermanet, Pieter Abbeel, Priya Sundaresan, Qiuyu Chen, Quan Vuong, Rafael Rafailov, Ran Tian, Ria Doshi, Roberto Martn-Martn, Rohan Baijal, Rosario Scalise, Rose Hendrix, Roy Lin, Runjia Qian, Ruohan Zhang, Russell Mendonca, Rutav Shah, Ryan Hoque, Ryan Julian, Samuel Bustamante-Gomez, Sean Kirmani, Sergey Levine, Shan Lin, Sherry Moore, Shikhar Bahl, Shivin Dass, Shubham D. Sonawani, Shuran Song, Sichun Xu, Siddhant Haldar, Siddharth Karamcheti, Simeon Adebola, Simon Guist, Soroush Nasiriany, Stefan Schaal, Stefan Welker, Stephen Tian, Subramanian Ramamoorthy, Sudeep Dasari, Suneel Belkhale, Sungjae Park, Suraj Nair, Suvir Mirchandani, Takayuki Osa, Tanmay Gupta, Tatsuya Harada, Tatsuya Matsushima, Ted Xiao, Thomas Kollar, Tianhe Yu, Tianli Ding, Todor Davchev, Tony Z. Zhao, Travis Armstrong, Trevor Darrell, Trinity Chung, Vidhi Jain, Vincent Vanhoucke, Wei Zhan, Wenxuan Zhou, Wolfram Burgard, Xi Chen, Xiaolong Wang, Xinghao Zhu, Xinyang Geng, Xiyuan Liu, Liangwei Xu, Xuanlin Li, Yao Lu, Yecheng Jason Ma, Yejin Kim, Yevgen Chebotar, Yifan Zhou, Yifeng Zhu, Yilin Wu, Ying Xu, Yixuan Wang, Yonatan Bisk, Yoonyoung Cho, Youngwoon Lee, Yuchen Cui, Yue Cao, Yueh-Hua Wu, Yujin Tang, Yuke Zhu, Yunchu Zhang, Yunfan Jiang, Yunshuang Li, Yunzhu Li, Yusuke Iwasawa, Yutaka Matsuo, Zehan Ma, Zhuo Xu, Zichen Jeff Cui, Zichen Zhang, Zipeng Lin |
| 2024 | IROS | Pre-training on Synthetic Driving Data for Trajectory Prediction. | Yiheng Li, Seth Z. Zhao, Chenfeng Xu, Chen Tang, Chenran Li, Mingyu Ding, Masayoshi Tomizuka, Wei Zhan |
| 2024 | IROS | DSLO: Deep Sequence LiDAR Odometry Based on Inconsistent Spatio-temporal Propagation. | Huixin Zhang, Guangming Wang, Xinrui Wu, Chenfeng Xu, Mingyu Ding, Masayoshi Tomizuka, Wei Zhan, Hesheng Wang |
| 2023 | CVPR | Mod-Squad: Designing Mixtures of Experts As Modular Multi-Task Learners. | Zitian Chen, Yikang Shen, Mingyu Ding, Zhenfang Chen, Hengshuang Zhao, Erik G. Learned-Miller, Chuang Gan |
| 2023 | CVPR | Visual Dependency Transformers: Dependency Tree Emerges from Reversed Attention. | Mingyu Ding, Yikang Shen, Lijie Fan, Zhenfang Chen, Zitian Chen, Ping Luo, Joshua B. Tenenbaum, Chuang Gan |
| 2023 | CVPR | EC | Yao Mu, Shunyu Yao, Mingyu Ding, Ping Luo, Chuang Gan |
| 2023 | ICCV | TextPSG: Panoptic Scene Graph Generation from Textual Descriptions. | Chengyang Zhao, Yikang Shen, Zhenfang Chen, Mingyu Ding, Chuang Gan |
| 2023 | ICLR | Planning with Large Language Models for Code Generation. | Shun Zhang, Zhenfang Chen, Yikang Shen, Mingyu Ding, Joshua B. Tenenbaum, Chuang Gan |
| 2023 | ICML | AdaptDiffuser: Diffusion Models as Adaptive Self-evolving Planners. | Zhixuan Liang, Yao Mu, Mingyu Ding, Fei Ni, Masayoshi Tomizuka, Ping Luo |
| 2022 | CoRL | Embodied Concept Learner: Self-supervised Learning of Concepts and Mapping through Instruction Following. | Mingyu Ding, Yan Xu, Zhenfang Chen, David Daniel Cox, Ping Luo, Joshua B. Tenenbaum, Chuang Gan |
| 2022 | ECCV | DaViT: Dual Attention Vision Transformers. | Mingyu Ding, Bin Xiao, Noel Codella, Ping Luo, Jingdong Wang, Lu Yuan |
| 2022 | ICLR | ComPhy: Compositional Physical Reasoning of Objects and Events from Videos. | Zhenfang Chen, Kexin Yi, Yunzhu Li, Mingyu Ding, Antonio Torralba, Joshua B. Tenenbaum, Chuang Gan |
| 2022 | ICLR | Learning Versatile Neural Architectures by Propagating Network Codes. | Mingyu Ding, Yuqi Huo, Haoyu Lu, Linjie Yang, Zhe Wang, Zhiwu Lu, Jingdong Wang, Ping Luo |
| 2022 | ICML | CtrlFormer: Learning Transferable State Representation for Visual Control via Transformer. | Yao Mark Mu, Shoufa Chen, Mingyu Ding, Jianyu Chen, Runjian Chen, Ping Luo |
| 2021 | AAAI | A Global Occlusion-Aware Approach to Self-Supervised Monocular Visual Odometry. | Yao Lu, Xiaoli Xu, Mingyu Ding, Zhiwu Lu, Tao Xiang |
| 2021 | CVPR | HR-NAS: Searching Efficient High-Resolution Neural Architectures With Lightweight Transformers. | Mingyu Ding, Xiaochen Lian, Linjie Yang, Peng Wang, Xiaojie Jin, Zhiwu Lu, Ping Luo |
| 2021 | CVPR | L2M-GAN: Learning To Manipulate Latent Space Semantics for Facial Attribute Editing. | Guoxing Yang, Nanyi Fei, Mingyu Ding, Guangzhen Liu, Zhiwu Lu, Tao Xiang |
| 2021 | ICLR | IEPT: Instance-Level and Episode-Level Pretext Tasks for Few-Shot Learning. | Manli Zhang, Jianhong Zhang, Zhiwu Lu, Tao Xiang, Mingyu Ding, Songfang Huang |
| 2021 | IJCAI | Self-Supervised Video Representation Learning with Constrained Spatiotemporal Jigsaw. | Yuqi Huo, Mingyu Ding, Haoyu Lu, Ziyuan Huang, Mingqian Tang, Zhiwu Lu, Tao Xiang |
| 2021 | WACV | Domain-Adaptive Few-Shot Learning. | An Zhao, Mingyu Ding, Zhiwu Lu, Tao Xiang, Yulei Niu, Jiechao Guan, Ji-Rong Wen |
| 2020 | AAAI | Every Frame Counts: Joint Learning of Video Segmentation and Optical Flow. | Mingyu Ding, Zhe Wang, Bolei Zhou, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | CVPR | Learning Depth-Guided Convolutions for Monocular 3D Object Detection. | Mingyu Ding, Yuqi Huo, Hongwei Yi, Zhe Wang, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | CVPR | Learning Depth-Guided Convolutions for Monocular 3D Object Detection. | Mingyu Ding, Yuqi Huo, Hongwei Yi, Zhe Wang, Jianping Shi, Zhiwu Lu, Ping Luo |
| 2020 | ECCV | Lightweight Action Recognition in Compressed Videos. | Yuqi Huo, Xiaoli Xu, Yao Lu, Yulei Niu, Mingyu Ding, Zhiwu Lu, Tao Xiang, Ji-Rong Wen |
| 2020 | ECCV | Segmenting Transparent Objects in the Wild. | Enze Xie, Wenjia Wang, Wenhai Wang, Mingyu Ding, Chunhua Shen, Ping Luo |
| 2020 | ECCV | Dense Hybrid Recurrent Multi-view Stereo Net with Dynamic Consistency Checking. | Jianfeng Yan, Zizhuang Wei, Hongwei Yi, Mingyu Ding, Runze Zhang, Yisong Chen, Guoping Wang, Yu-Wing Tai |
| 2020 | ECCV | Pyramid Multi-view Stereo Net with Self-adaptive View Aggregation. | Hongwei Yi, Zizhuang Wei, Mingyu Ding, Runze Zhang, Yisong Chen, Guoping Wang, Yu-Wing Tai |
| 2020 | ICRA | SegVoxelNet: Exploring Semantic Context and Depth-aware Features for 3D Vehicle Detection from Point Cloud. | Hongwei Yi, Shaoshuai Shi, Mingyu Ding, Jiankai Sun, Kui Xu, Hui Zhou, Zhe Wang, Sheng Li, Guoping Wang |
| 2019 | CVPR | Face-Focused Cross-Stream Network for Deception Detection in Videos. | Mingyu Ding, An Zhao, Zhiwu Lu, Tao Xiang, Ji-Rong Wen |
| 2019 | ICCV | CamNet: Coarse-to-Fine Retrieval for Camera Re-Localization. | Mingyu Ding, Zhe Wang, Jiankai Sun, Jianping Shi, Ping Luo |
| 2018 | BMVC | DeepInsight: Multi-Task Multi-Scale Deep Learning for Mental Disorder Diagnosis. | Mingyu Ding, Yuqi Huo, Jun Hu, Zhiwu Lu |
| 2018 | ICONIP | Zero-Shot Learning with Superclasses. | Yuqi Huo, Mingyu Ding, An Zhao, Jun Hu, Ji-Rong Wen, Zhiwu Lu |
| 2018 | ICONIP | InsightGAN: Semi-Supervised Feature Learning with Generative Adversarial Network for Drug Abuse Detection. | Guangzhen Liu, Jun Hu, An Zhao, Mingyu Ding, Yuqi Huo, Zhiwu Lu |