Skip to content

On Large-Batch Training for Deep Learning: Generalization Gap and Sharp Minima.

Nitish Shirish Keskar, Dheevatsa Mudigere, Jorge Nocedal, Mikhail Smelyanskiy, Ping Tak Peter Tang

VenueA*ICLR
Year2017
ProceedingsICLR

Browse the full ICLR paper archive.