arXiv · 2601.18276
Functional Large Deviations for Wide Deep Neural Networks with Gaussian Initialization and Lipschitz Activations
Abstract
We establish a functional large deviation principle for fully connected multi-layer perceptrons with i.i.d. Gaussian weights (LeCun initialization) and general Lipschitz activation functions, including therefore the popular case of ReLU. The large deviation principle holds for the entire network output process on any compact input set. The proof combines exponential tightness for recursively defined processes, finite-dimensional large deviations, and the Dawson-G\"artner theorem, extending existing results beyond finite input sets and less general activations.
Explore related subjects
Keep this discovery
Explore connections, maps & timelines
Claudio Macci, Barbara Pacchiarotti, Katerina Papagiannouli, Giovanni Luca Torrisi, Dario Trevisan. 2026-01-26. Functional Large Deviations for Wide Deep Neural Networks with Gaussian Initialization and Lipschitz Activations. https://arxiv.org/abs/2601.18276
Cite the original work for its findings. Save a collection to share your selection of sources.