| 2025 | ICML | Global Convergence and Rich Feature Learning in L-Layer Infinite-Width Neural Networks under μ Parametrization. | Zixiang Chen, Greg Yang, Qingyue Zhao, Quanquan Gu |
| 2024 | ICLR | Tensor Programs VI: Feature Learning in Infinite Depth Neural Networks. | Greg Yang, Dingli Yu, Chen Zhu, Soufiane Hayou |
| 2023 | ICLR | Adaptive Optimization in the ∞-Width Limit. | Etai Littwin, Greg Yang |
| 2023 | ICML | Width and Depth Limits Commute in Residual Networks. | Soufiane Hayou, Greg Yang |
| 2022 | ICLR | Efficient Computation of Deep Nonlinear Infinite-Width Neural Networks that Learn Features. | Greg Yang, Michael Santacroce, Edward J. Hu |
| 2021 | ICML | Tensor Programs IV: Feature Learning in Infinite-Width Neural Networks. | Greg Yang, Edward J. Hu |
| 2021 | ICML | Tensor Programs IIb: Architectural Universality Of Neural Tangent Kernel Training Dynamics. | Greg Yang, Etai Littwin |
| 2020 | ICML | Randomized Smoothing of All Shapes and Sizes. | Greg Yang, Tony Duan, J. Edward Hu, Hadi Salman, Ilya P. Razenshteyn, Jerry Li |
| 2019 | ICLR | Bayesian Deep Convolutional Networks with Many Channels are Gaussian Processes. | Roman Novak, Lechao Xiao, Yasaman Bahri, Jaehoon Lee, Greg Yang, Jiri Hron, Daniel A. Abolafia, Jeffrey Pennington, Jascha Sohl-Dickstein |
| 2019 | ICLR | A Mean Field Theory of Batch Normalization. | Greg Yang, Jeffrey Pennington, Vinay Rao, Jascha Sohl-Dickstein, Samuel S. Schoenholz |
| 2017 | ICLR | Lie-Access Neural Turing Machines. | Greg Yang, Alexander M. Rush |