Neural SDE: Stabilizing Neural ODE Networks with Stochastic Noise
Neural Ordinary Differential Equation (Neural ODE) has been proposed as a continuous approximation to the ResNet architecture. Some commonly used regularization mechanisms in discrete neural networks (e.g. dropout, Gaussian noise) are missing in current Neural ODE networks. In this paper, we propose a new continuous neural network framework called Neural Stochastic Differential Equation (Neural SDE) network, which naturally incorporates various commonly used regularization mechanisms based on random noise injection. Our framework can model various types of noise injection frequently used in discrete networks for regularization purpose, such as dropout and additive/multiplicative noise in each block. We provide theoretical analysis explaining the improved robustness of Neural SDE models against input perturbations/adversarial attacks. Furthermore, we demonstrate that the Neural SDE network can achieve better generalization than the Neural ODE and is more resistant to adversarial and non-adversarial input perturbations.
Neural Ordinary Differential Equation (Neural ODE) has been proposed as a continuous approximation to the ResNet architecture. Some commonly used regularization mechanisms in discrete neural networks (e.g. dropout, Gaussian noise) are missing in current Neural ODE networks. In this paper, we propose a new continuous neural network framework called Neural Stochastic Differential Equation (Neural SDE) network, which naturally incorporates various commonly used regularization mechanisms based on random noise injection. Our framework can model various types of noise injection frequently used in di
Explore this link on the map →related reading
- Neural Ordinary Differential Equationsarxiv.org
- Aman's AI Journal • Primers • Ilya Sutskever's Top 30aman.ai
- 1806.07366arxiv.org
- An SDE Framework for Adversarial Training, with Convergence and Robustness Analysisarxiv.org
- A Recipe for Training Neural Networkskarpathy.github.io
- DiffEqFlux.jl – A Julia Library for Neural Differential Equationsjulialang.org
- Stochastic Differential Equations, Deep Learning, and High-Dimensional PDEsmitmath.github.io
- A Recipe for Training Neural Networkskarpathy.github.io
- The Unreasonable Effectiveness of Recurrent Neural Networkskarpathy.github.io
- The Decade of Deep Learning | Leo Gaobmk.sh
- Residual neural network - Wikipediaen.wikipedia.org
- Clare Lyle | The state of plasticity in 2025clarelyle.com