Pas, remplissage et regroupement
Contrôlez la taille de sortie et réduisez la résolution.
Pas, remplissage et regroupement est une leçon Deep Learning Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage Deep Learning Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours Deep Learning Academy comprend 4 leçons au total.
Certaines parties de cette leçon n'ont pas encore été traduites et s'affichent en anglais.
Output Shrinks by Default
When a 3x3 kernel slides over an image, the edges have no room. So the output feature map comes out a little smaller than the input.
Padding Adds a Border
Padding wraps the image in a ring of zeros so the kernel can reach the corners. Now the output can stay the same size as the input.
Same Padding in Code
For a 3x3 kernel, padding of 1 keeps the spatial size unchanged. People call this same padding.
conv = nn.Conv2d(3, 16, kernel_size=3, padding=1)Stride Sets the Step Size
Stride is how far the kernel jumps each move. A stride of 1 visits every position; a larger stride skips ahead.
Stride 2 Halves the Map
With stride 2 the kernel hops two pixels at a time, so the output is roughly half the width and height. It is a cheap way to downsample. ⬇️
Stride and Padding Together
Combine them to control the exact output size. Here stride 2 with padding 1 downsamples while keeping the corners covered.
conv = nn.Conv2d(16, 32, 3, stride=2, padding=1)Why Downsample at All?
Shrinking the maps cuts computation and lets later layers see a wider region of the original image with each kernel.
Pooling: Another Way to Shrink
Pooling downsamples too, but with no learned weights. It just summarizes each small patch into a single value.
Max Pooling Keeps the Strongest
Max pooling takes the largest value in each 2x2 patch. It keeps the strongest signal and quietly drops the rest.
pool = nn.MaxPool2d(kernel_size=2)Average Pooling Smooths
Average pooling takes the mean of each patch instead of the max, giving a smoother, gentler summary of the region.
pool = nn.AvgPool2d(kernel_size=2)Pooling Adds Small Invariance
Because pooling summarizes a patch, a tiny shift in the input barely changes the output. This gives a touch of translation invariance.
Quick Check
Let us test what padding actually does for a convolution.
Recap: Control the Shape
You learned that padding preserves size, stride sets the step and downsamples, and pooling shrinks maps while adding a little shift tolerance. 🎯
Questions Fréquemment Posées
La leçon « Pas, remplissage et regroupement » est-elle gratuite ?
Oui — le texte complet de « Pas, remplissage et regroupement » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours Deep Learning Academy, passe à CoddyKit PRO. Le cours Deep Learning Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Pas, remplissage et regroupement » ?
Contrôlez la taille de sortie et réduisez la résolution. Tu pratiques Deep Learning Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer Deep Learning Academy ?
Aucune expérience préalable n'est requise. Deep Learning Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.
Combien de temps prend la leçon « Pas, remplissage et regroupement » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon Deep Learning Academy ?
Oui. Chaque leçon Deep Learning Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Convolution : des noyaux glissent sur les pixels
- Pas, remplissage et regroupement
- Canaux, cartes de caractéristiques et champs réceptifs
- Assembler un classificateur d’images CNN