Skip to content

Jason D. Lee

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

86

Venues

8

Active years

2007–2026

Best venue rank

A*

Where they publish

Papers

86 indexed papers, newest first.

YearVenueTitleAuthors
2026COLTOn the Statistical Query Complexity of Learning Semiautomata: a Random Walk Approach.George Giapitzakis, Kimon Fountoulakis, Eshaan Nichani, Jason D. Lee
2026COLTProvable Learning of Random Hierarchy Models and Hierarchical Shallow-to-Deep Chaining.Yunwei Ren, Yatin Dandi, Florent Krzakala, Jason D. Lee
2026COLTRisk Comparisons in Linear Regression: Implicit Regularization Dominates Explicit Regularization (Extended Abstract).Jingfeng Wu, Peter L. Bartlett, Sham M. Kakade, Jason D. Lee, Bin Yu
2025AISTATSHow Well Can Transformers Emulate In-Context Newton's Method?Angeliki Giannou, Liu Yang, Tianhao Wang, Dimitris Papailiopoulos, Jason D. Lee
2025COLTLearning Compositional Functions with Transformers from Easy-to-Hard Data.Zixuan Wang, Eshaan Nichani, Alberto Bietti, Alex Damian, Daniel Hsu, Jason D. Lee, Denny Wu
2025COLTAnytime Acceleration of Gradient Descent.Zihan Zhang, Jason D. Lee, Simon S. Du, Yuxin Chen
2025ICLRUnderstanding Optimization in Deep Learning with Central Flows.Jeremy Cohen, Alex Damian, Ameet Talwalkar, J. Zico Kolter, Jason D. Lee
2025ICLRLearning Hierarchical Polynomials of Multiple Nonlinear Features.Hengyu Fu, Zihao Wang, Eshaan Nichani, Jason D. Lee
2025ICLRRegressing the Relative Future: Efficient Policy Optimization for Multi-turn RLHF.Zhaolin Gao, Wenhao Zhan, Jonathan Daniel Chang, Gokul Swamy, Kiant Brantley, Jason D. Lee, Wen Sun
2025ICLRTransformers Learn to Implement Multi-step Gradient Descent with Chain of Thought.Jianhao Huang, Zixuan Wang, Jason D. Lee
2025ICLRCorrecting the Mythos of KL-Regularization: Direct Alignment without Overoptimization via Chi-Squared Preference Optimization.Audrey Huang, Wenhao Zhan, Tengyang Xie, Jason D. Lee, Wen Sun, Akshay Krishnamurthy, Dylan J. Foster
2025ICLRUnderstanding Factual Recall in Transformers via Associative Memories.Eshaan Nichani, Jason D. Lee, Alberto Bietti
2025ICLRTransformers Provably Learn Two-Mixture of Linear Classification via Gradient Flow.Hongru Yang, Zhangyang Wang, Jason D. Lee, Yingbin Liang
2025ICLRExploiting Structure in Offline Multi-Agent RL: The Benefits of Low Interaction Rank.Wenhao Zhan, Scott Fujimoto, Zheqing Zhu, Jason D. Lee, Daniel Jiang, Yonathan Efroni
2025ICMLDiscrepancies are Virtue: Weak-to-Strong Generalization through Lens of Intrinsic Dimension.Yijun Dong, Yicheng Li, Yunai Li, Jason D. Lee, Qi Lei
2025ICMLMetastable Dynamics of Chain-of-Thought Reasoning: Provable Benefits of Search, RL and Distillation.Juno Kim, Denny Wu, Jason D. Lee, Taiji Suzuki
2025ICMLMinimax Optimal Regret Bound for Reinforcement Learning with Trajectory Feedback.Zihan Zhang, Yuxin Chen, Jason D. Lee, Simon Shaolei Du, Ruosong Wang
2025ICMLRethinking Addressing in Language Models via Contextualized Equivariant Positional Encoding.Jiajun Zhu, Peihao Wang, Ruisi Cai, Jason D. Lee, Pan Li, Zhangyang Wang
2024COLTComputational-Statistical Gaps in Gaussian Single-Index Models (Extended Abstract).Alex Damian, Loucas Pillaud-Vivien, Jason D. Lee, Joan Bruna
2024COLTSettling the sample complexity of online reinforcement learning.Zihan Zhang, Yuxin Chen, Jason D. Lee, Simon S. Du
2024COLTOptimal Multi-Distribution Learning.Zihan Zhang, Wenhao Zhan, Yuxin Chen, Simon S. Du, Jason D. Lee
2024ICLRProvably Efficient CVaR RL in Low-rank MDPs.Yulai Zhao, Wenhao Zhan, Xiaoyan Hu, Ho-fung Leung, Farzan Farnia, Wen Sun, Jason D. Lee
2024ICLRTeaching Arithmetic to Small Transformers.Nayoung Lee, Kartik Sreenivasan, Jason D. Lee, Kangwook Lee, Dimitris Papailiopoulos
2024ICLRDichotomy of Early and Late Phase Implicit Biases Can Provably Induce Grokking.Kaifeng Lyu, Jikai Jin, Zhiyuan Li, Simon Shaolei Du, Jason D. Lee, Wei Hu
2024ICLRLearning Hierarchical Polynomials with Three-Layer Neural Networks.Zihao Wang, Eshaan Nichani, Jason D. Lee
2024ICLRHorizon-Free Regret for Linear Markov Decision Processes.Zihan Zhang, Jason D. Lee, Yuxin Chen, Simon Shaolei Du
2024ICLRProvable Reward-Agnostic Preference-Based Reinforcement Learning.Wenhao Zhan, Masatoshi Uehara, Wen Sun, Jason D. Lee
2024ICLRProvable Offline Preference-Based Reinforcement Learning.Wenhao Zhan, Masatoshi Uehara, Nathan Kallus, Jason D. Lee, Wen Sun
2024ICMLMedusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads.Tianle Cai, Yuhong Li, Zhengyang Geng, Hongwu Peng, Jason D. Lee, Deming Chen, Tri Dao
2024ICMLLoRA Training in the NTK Regime has No Spurious Local Minima.Uijeong Jang, Jason D. Lee, Ernest K. Ryu
2024ICMLAn Information-Theoretic Analysis of In-Context Learning.Hong Jun Jeon, Jason D. Lee, Qi Lei, Benjamin Van Roy
2024ICMLHow Transformers Learn Causal Structure with Gradient Descent.Eshaan Nichani, Alex Damian, Jason D. Lee
2024ICMLTransformers Provably Learn Sparse Token Selection While Fully-Connected Nets Cannot.Zixuan Wang, Stanley Wei, Daniel Hsu, Jason D. Lee
2024ICMLRevisiting Zeroth-Order Optimization for Memory-Efficient LLM Fine-Tuning: A Benchmark.Yihua Zhang, Pingzhi Li, Junyuan Hong, Jiaxiang Li, Yimeng Zhang, Wenqing Zheng, Pin-Yu Chen, Jason D. Lee, Wotao Yin, Mingyi Hong, Zhangyang Wang, Sijia Liu, Tianlong Chen
2024NAACLREST: Retrieval-Based Speculative Decoding.Zhenyu He, Zexuan Zhong, Tianle Cai, Jason D. Lee, Di He
2023AISTATSProvable Hierarchy-Based Meta-Reinforcement Learning.Kurtland Chua, Qi Lei, Jason D. Lee
2023AISTATSOptimal Sample Complexity Bounds for Non-convex Optimization under Kurdyka-Lojasiewicz Condition.Qian Yu, Yining Wang, Baihe Huang, Qi Lei, Jason D. Lee
2023AISTATSProvably Efficient Reinforcement Learning via Surprise Bound.Hanlin Zhu, Ruosong Wang, Jason D. Lee
2023ICLRSelf-Stabilization: The Implicit Bias of Gradient Descent at the Edge of Stability.Alex Damian, Eshaan Nichani, Jason D. Lee
2023ICLRCan We Find Nash Equilibria at a Linear Rate in Markov Games?Zhuoqing Song, Jason D. Lee, Zhuoran Yang
2023ICLRDecentralized Optimistic Hyperpolicy Mirror Descent: Provably No-Regret Learning in Markov Games.Wenhao Zhan, Jason D. Lee, Zhuoran Yang
2023ICLRPAC Reinforcement Learning for Predictive State Representations.Wenhao Zhan, Masatoshi Uehara, Wen Sun, Jason D. Lee
2023ICMLLocal Optimization Achieves Global Optimality in Multi-Agent Reinforcement Learning.Yulai Zhao, Zhuoran Yang, Zhaoran Wang, Jason D. Lee
2023ICMLEfficient displacement convex optimization with particle gradient descent.Hadi Daneshmand, Jason D. Lee, Chi Jin
2023ICMLLooped Transformers as Programmable Computers.Angeliki Giannou, Shashank Rajput, Jy-yong Sohn, Kangwook Lee, Jason D. Lee, Dimitris Papailiopoulos
2023ICMLUnderstanding Incremental Learning of Gradient Descent: A Fine-grained Analysis of Matrix Sensing.Jikai Jin, Zhiyuan Li, Kaifeng Lyu, Simon Shaolei Du, Jason D. Lee
2023ICMLComputationally Efficient PAC RL in POMDPs with Latent Determinism and Conditional Embeddings.Masatoshi Uehara, Ayush Sekhari, Jason D. Lee, Nathan Kallus, Wen Sun
2022AISTATSProvably Efficient Policy Optimization for Two-Player Zero-Sum Markov Games.Yulai Zhao, Yuandong Tian, Jason D. Lee, Simon S. Du
2022COLTNeural Networks can Learn Representations with Gradient Descent.Alexandru Damian, Jason D. Lee, Mahdi Soltanolkotabi
2022COLTOptimization-Based Separations for Neural Networks.Itay Safran, Jason D. Lee
2022COLTOffline Reinforcement Learning with Realizability and Single-policy Concentrability.Wenhao Zhan, Baihe Huang, Audrey Huang, Nan Jiang, Jason D. Lee
2022ICASSPCompetitive Multi-Agent Reinforcement Learning with Self-Supervised Representation.DiJia Su, Jason D. Lee, John M. Mulvey, H. Vincent Poor
2022ICLRTowards General Function Approximation in Zero-Sum Markov Games.Baihe Huang, Jason D. Lee, Zhaoran Wang, Zhuoran Yang
2021COLTModeling from Features: a Mean-field Framework for Over-parameterized Deep Neural Networks.Cong Fang, Jason D. Lee, Pengkun Yang, Tong Zhang
2021COLTShape Matters: Understanding the Implicit Bias of the Noise Covariance.Jeff Z. HaoChen, Colin Wei, Jason D. Lee, Tengyu Ma
2021ICLRFew-Shot Learning via Learning the Representation, Provably.Simon Shaolei Du, Wei Hu, Sham M. Kakade, Jason D. Lee, Qi Lei
2021ICLRImpact of Representation Learning in Linear Bandits.Jiaqi Yang, Wei Hu, Jason D. Lee, Simon Shaolei Du
2021ICMLHow Important is the Train-Validation Split in Meta-Learning?Yu Bai, Minshuo Chen, Pan Zhou, Tuo Zhao, Jason D. Lee, Sham M. Kakade, Huan Wang, Caiming Xiong
2021ICMLA Theory of Label Propagation for Subpopulation Shift.Tianle Cai, Ruiqi Gao, Jason D. Lee, Qi Lei
2021ICMLBilinear Classes: A Structural Framework for Provable Generalization in RL.Simon S. Du, Sham M. Kakade, Jason D. Lee, Shachar Lovett, Gaurav Mahajan, Wen Sun, Ruosong Wang
2021ICMLNear-Optimal Linear Regression under Distribution Shift.Qi Lei, Wei Hu, Jason D. Lee
2020COLTOptimality and Approximation with Policy Gradient Methods in Markov Decision Processes.Alekh Agarwal, Sham M. Kakade, Jason D. Lee, Gaurav Mahajan
2020COLTKernel and Rich Regimes in Overparametrized Models.Blake E. Woodworth, Suriya Gunasekar, Jason D. Lee, Edward Moroshko, Pedro Savarese, Itay Golan, Daniel Soudry, Nathan Srebro
2020ICLRBeyond Linearization: On Quadratic and Higher-Order Approximation of Wide Neural Networks.Yu Bai, Jason D. Lee
2020ICMLSGD Learns One-Layer Networks in WGANs.Qi Lei, Jason D. Lee, Alex Dimakis, Constantinos Daskalakis
2020ICMLOptimal transport mapping via input convex neural networks.Ashok Vardhan Makkuva, Amirhossein Taghvaei, Sewoong Oh, Jason D. Lee
2019AISTATSConvergence of Gradient Descent on Separable Data.Mor Shpigel Nacson, Jason D. Lee, Suriya Gunasekar, Pedro Henrique Pamplona Savarese, Nathan Srebro, Daniel Soudry
2019ICMLGradient Descent Finds Global Minima of Deep Neural Networks.Simon S. Du, Jason D. Lee, Haochuan Li, Liwei Wang, Xiyu Zhai
2019ICMLLexicographic and Depth-Sensitive Margins in Homogeneous and Non-Homogeneous Deep Models.Mor Shpigel Nacson, Suriya Gunasekar, Jason D. Lee, Nathan Srebro, Daniel Soudry
2018ICLRLearning One-hidden-layer Neural Networks with Landscape Design.Rong Ge, Jason D. Lee, Tengyu Ma
2018ICLRWhen is a Convolutional Filter Easy to Learn?Simon S. Du, Jason D. Lee, Yuandong Tian
2018ICLRNo Spurious Local Minima in a Two Hidden Unit ReLU Network.Chenwei Wu, Jiajun Luo, Jason D. Lee
2018ICMLOn the Power of Over-parametrization in Neural Networks with Quadratic Activation.Simon S. Du, Jason D. Lee
2018ICMLGradient Descent Learns One-hidden-layer CNN: Don't be Afraid of Spurious Local Minima.Simon S. Du, Jason D. Lee, Yuandong Tian, Aarti Singh, Barnabs Pczos
2018ICMLCharacterizing Implicit Bias in Terms of Optimization Geometry.Suriya Gunasekar, Jason D. Lee, Daniel Soudry, Nathan Srebro
2018ICMLGradient Primal-Dual Algorithm Converges to Second-Order Stationary Solution for Nonconvex Distributed Optimization Over Networks.Mingyi Hong, Meisam Razaviyayn, Jason D. Lee
2017AISTATSBlack-box Importance Sampling.Qiang Liu, Jason D. Lee
2017AISTATSSketching Meets Random Projection in the Dual: A Provable Recovery Algorithm for Big and High-dimensional Data.Jialei Wang, Jason D. Lee, Mehrdad Mahdavi, Mladen Kolar, Nati Srebro
2017AISTATSOn the Learnability of Fully-Connected Neural Networks.Yuchen Zhang, Jason D. Lee, Martin J. Wainwright, Michael I. Jordan
2016COLTGradient Descent Only Converges to Minimizers.Jason D. Lee, Max Simchowitz, Michael I. Jordan, Benjamin Recht
2016ICMLA Kernelized Stein Discrepancy for Goodness-of-fit Tests.Qiang Liu, Jason D. Lee, Michael I. Jordan
2016ICMLL1-regularized Neural Networks are Improperly Learnable in Polynomial Time.Yuchen Zhang, Jason D. Lee, Michael I. Jordan
2013AISTATSStructure Learning of Mixed Graphical Models.Jason D. Lee, Trevor Hastie
2009ICCDA distributed concurrent on-line test scheduling protocol for many-core NoC-based systems.Jason D. Lee, Rabi N. Mahapatra, Praveen Bhojwani
2008ICCDIn-field NoC-based SoC testing with distributed test vector storage.Jason D. Lee, Rabi N. Mahapatra
2007ISLPEDSAPP: scalable and adaptable peak power management in nocs.Praveen Bhojwani, Jason D. Lee, Rabi N. Mahapatra