Skip to content

Stanislaw Jastrzebski

Publication record assembled from the DBLP archive of ranked conferences.

Papers indexed

13

Venues

6

Active years

2017–2022

Best venue rank

A*

Where they publish

Papers

13 indexed papers, newest first.

YearVenueTitleAuthors
2022AAAIHuggingMolecules: An Open-Source Library for Transformer-Based Molecular Property Prediction (Student Abstract).Piotr Gainski, Lukasz Maziarka, Tomasz Danel, Stanislaw Jastrzebski
2022ICMLCharacterizing and Overcoming the Greedy Nature of Learning in Multi-modal Deep Neural Networks.Nan Wu, Stanislaw Jastrzebski, Kyunghyun Cho, Krzysztof J. Geras
2021ICMLCatastrophic Fisher Explosion: Early Phase Fisher Matrix Impacts Generalization.Stanislaw Jastrzebski, Devansh Arpit, Oliver strand, Giancarlo Kerg, Huan Wang, Caiming Xiong, Richard Socher, Kyunghyun Cho, Krzysztof J. Geras
2020ICLRThe Break-Even Point on Optimization Trajectories of Deep Neural Networks.Stanislaw Jastrzebski, Maciej Szymczak, Stanislav Fort, Devansh Arpit, Jacek Tabor, Kyunghyun Cho, Krzysztof J. Geras
2020ICONIPNon-linear ICA Based on Cramer-Wold Metric.Przemyslaw Spurek, Aleksandra Nowak, Jacek Tabor, Lukasz Maziarka, Stanislaw Jastrzebski
2019AISTATSDynamical Isometry is Achieved in Residual Networks in a Universal Way for any Activation Function.Wojciech Tarnowski, Piotr Warchol, Stanislaw Jastrzebski, Jacek Tabor, Maciej A. Nowak
2019ICLROn the Relation Between the Sharpest Directions of DNN Loss and the SGD Step Length.Stanislaw Jastrzebski, Zachary Kenton, Nicolas Ballas, Asja Fischer, Yoshua Bengio, Amos J. Storkey
2019ICMLParameter-Efficient Transfer Learning for NLP.Neil Houlsby, Andrei Giurgiu, Stanislaw Jastrzebski, Bruna Morrone, Quentin de Laroussilhe, Andrea Gesmundo, Mona Attariyan, Sylvain Gelly
2018ICANNWidth of Minima Reached by Stochastic Gradient Descent is Influenced by Learning Rate to Batch Size Ratio.Stanislaw Jastrzebski, Zachary Kenton, Devansh Arpit, Nicolas Ballas, Asja Fischer, Yoshua Bengio, Amos J. Storkey
2018ICLRResidual Connections Encourage Iterative Inference.Stanislaw Jastrzebski, Devansh Arpit, Nicolas Ballas, Vikas Verma, Tong Che, Yoshua Bengio
2018ICLRFinding Flatter Minima with SGD.Stanislaw Jastrzebski, Zachary Kenton, Devansh Arpit, Nicolas Ballas, Asja Fischer, Yoshua Bengio, Amos J. Storkey
2017ICLRDeep Nets Don't Learn via Memorization.David Krueger, Nicolas Ballas, Stanislaw Jastrzebski, Devansh Arpit, Maxinder S. Kanwal, Tegan Maharaj, Emmanuel Bengio, Asja Fischer, Aaron C. Courville
2017ICMLA Closer Look at Memorization in Deep Networks.Devansh Arpit, Stanislaw Jastrzebski, Nicolas Ballas, David Krueger, Emmanuel Bengio, Maxinder S. Kanwal, Tegan Maharaj, Asja Fischer, Aaron C. Courville, Yoshua Bengio, Simon Lacoste-Julien