Optimization for Deep Learning

September 28, 2018 ยท View on GitHub

Generalization

Loss Surface

Batch Size

General

Adaptive Gradient Methods

Distributed Optimization

Initialization

Low Precision

Noise

Normalization

Regularization

Meta-Learning

Hyperparameter

Bayesian Optimization