0Pricing
Deep Learning Academy · Leçon

Pas, remplissage et regroupement

Contrôlez la taille de sortie et réduisez la résolution.

Pas, remplissage et regroupement est une leçon Deep Learning Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Deep Learning Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Deep Learning Academy comprend 4 leçons au total.

Certaines parties de cette leçon n'ont pas encore été traduites et s'affichent en anglais.

Output Shrinks by Default

When a 3x3 kernel slides over an image, the edges have no room. So the output feature map comes out a little smaller than the input.

Padding Adds a Border

Padding wraps the image in a ring of zeros so the kernel can reach the corners. Now the output can stay the same size as the input.

Same Padding in Code

For a 3x3 kernel, padding of 1 keeps the spatial size unchanged. People call this same padding.

conv = nn.Conv2d(3, 16, kernel_size=3, padding=1)

Stride Sets the Step Size

Stride is how far the kernel jumps each move. A stride of 1 visits every position; a larger stride skips ahead.

Stride 2 Halves the Map

With stride 2 the kernel hops two pixels at a time, so the output is roughly half the width and height. It is a cheap way to downsample. ⬇️

Stride and Padding Together

Combine them to control the exact output size. Here stride 2 with padding 1 downsamples while keeping the corners covered.

conv = nn.Conv2d(16, 32, 3, stride=2, padding=1)

Why Downsample at All?

Shrinking the maps cuts computation and lets later layers see a wider region of the original image with each kernel.

Pooling: Another Way to Shrink

Pooling downsamples too, but with no learned weights. It just summarizes each small patch into a single value.

Max Pooling Keeps the Strongest

Max pooling takes the largest value in each 2x2 patch. It keeps the strongest signal and quietly drops the rest.

pool = nn.MaxPool2d(kernel_size=2)

Average Pooling Smooths

Average pooling takes the mean of each patch instead of the max, giving a smoother, gentler summary of the region.

pool = nn.AvgPool2d(kernel_size=2)

Pooling Adds Small Invariance

Because pooling summarizes a patch, a tiny shift in the input barely changes the output. This gives a touch of translation invariance.

Quick Check

Let us test what padding actually does for a convolution.

Recap: Control the Shape

You learned that padding preserves size, stride sets the step and downsamples, and pooling shrinks maps while adding a little shift tolerance. 🎯

Questions Fréquemment Posées

La leçon « Pas, remplissage et regroupement » est-elle gratuite ?

Oui — le texte complet de « Pas, remplissage et regroupement » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Deep Learning Academy, passe à CoddyKit PRO. Le cours Deep Learning Academy comprend 4 leçons au total.

Qu'est-ce que j'apprendrai dans « Pas, remplissage et regroupement » ?

Contrôlez la taille de sortie et réduisez la résolution. Tu pratiques Deep Learning Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.

Dois-je avoir de l'expérience pour commencer Deep Learning Academy ?

Aucune expérience préalable n'est requise. Deep Learning Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.

Combien de temps prend la leçon « Pas, remplissage et regroupement » ?

La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.

Peux-tu écrire et exécuter du code dans cette leçon Deep Learning Academy ?

Oui. Chaque leçon Deep Learning Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.

Toutes les leçons de ce cours

  1. Convolution : des noyaux glissent sur les pixels
  2. Pas, remplissage et regroupement
  3. Canaux, cartes de caractéristiques et champs réceptifs
  4. Assembler un classificateur d’images CNN
← Retour à Deep Learning Academy