0Pricing
Deep Learning Academy · Leçon

Gradients qui s’évanouissent ou explosent

Ce qui déstabilise les réseaux profonds et les premières solutions.

Gradients qui s’évanouissent ou explosent est une leçon Deep Learning Academy gratuite sur CoddyKit. Ceci est la leçon 4 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Deep Learning Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Deep Learning Academy comprend 4 leçons au total.

Certaines parties de cette leçon n'ont pas encore été traduites et s'affichent en anglais.

Gradients Are a Product

Through many layers, backprop multiplies many local derivatives together. The size of that long product decides whether learning works or breaks.

Multiplying Small Numbers

If each link's derivative is below one, the product shrinks fast. After many layers the gradient becomes tiny, almost zero by the time it reaches early layers.

That Is Vanishing Gradients

When gradients shrink to near zero, early layers barely update and stop learning. This is the vanishing gradient problem that long stalled deep nets.

Multiplying Big Numbers

If each derivative is above one, the product blows up instead. Gradients grow huge as they travel back, and the weights lurch wildly.

That Is Exploding Gradients

Runaway gradients are the exploding gradient problem. Loss often jumps to NaN as updates overshoot far past any useful value. 💥

Sigmoid Made It Worse

Sigmoid and tanh squash inputs, so their derivatives stay well below one. Stacking them multiplied small numbers and made vanishing gradients common.

ReLU to the Rescue

ReLU has a derivative of exactly one for positive inputs, so it does not shrink the gradient. Switching to ReLU was a key early fix.

relu_grad = 1.0 if x > 0 else 0.0

Careful Weight Initialization

Smart schemes like Xavier and He initialization scale starting weights so the gradient product stays near one across many layers.

Clip Exploding Gradients

For explosions, gradient clipping caps the gradient's size before the update, keeping a single huge step from wrecking the model.

torch.nn.utils.clip_grad_norm_(model.parameters(), 1.0)

Skip Connections Help

ResNet adds skip connections that let gradients flow straight back, sidestepping the long chain of multiplications that causes vanishing.

Why It All Matters

Keeping the gradient product near one is what lets very deep nets train at all. Every fix here exists to protect that balance.

Quick Check

Let's check the failure modes.

Recap

Long products of derivatives can vanish or explode. ReLU, careful init, clipping, and skip connections keep gradients healthy through deep nets. 💥

Questions Fréquemment Posées

La leçon « Gradients qui s’évanouissent ou explosent » est-elle gratuite ?

Oui — le texte complet de « Gradients qui s’évanouissent ou explosent » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Deep Learning Academy, passe à CoddyKit PRO. Le cours Deep Learning Academy comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « Gradients qui s’évanouissent ou explosent » ?

Ce qui déstabilise les réseaux profonds et les premières solutions. Tu pratiques Deep Learning Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer Deep Learning Academy ?

Aucune expérience préalable n'est requise. Deep Learning Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 4 sur 4.

Combien de temps prend la leçon « Gradients qui s’évanouissent ou explosent » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon Deep Learning Academy ?

Oui. Chaque leçon Deep Learning Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. La règle de la chaîne, couche par couche
  2. Le passage avant met en cache, la rétropropagation réutilise
  3. Rétropropager un petit réseau à la main
  4. Gradients qui s’évanouissent ou explosent
← Retour à Deep Learning Academy