VGG: Tumpukan Filter Kecil
Kedalaman dari blok 3x3 sederhana
VGG: Tumpukan Filter Kecil adalah pelajaran Deep Learning Academy gratis di CoddyKit. Ini adalah pelajaran 2 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar Deep Learning Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus Deep Learning Academy mencakup 4 pelajaran total.
Bagian dari pelajaran ini belum diterjemahkan dan ditampilkan dalam bahasa Inggris.
One Filter Size to Rule
VGG made a bold bet: use only tiny 3x3 convolutions everywhere, and just stack a lot of them.
Why Small Wins
Two stacked 3x3 layers see the same area as one 5x5, but with fewer parameters and an extra nonlinearity in between.
Depth Over Width
Instead of fat layers, VGG chose to go deep, reaching 16 or 19 layers and learning richer feature hierarchies.
Uniform and Predictable
Every conv keeps the same padding and size, so shapes stay easy to reason about. This uniformity made VGG simple to copy.
Pool to Shrink
After each block of convs, a 2x2 max pool halves the spatial size while doubling the channel count.
import torch.nn as nn
pool = nn.MaxPool2d(kernel_size=2, stride=2)A VGG Block
The repeating unit is conv, ReLU, conv, ReLU, pool. Chain these blocks and you have most of VGG.
import torch.nn as nn
block = nn.Sequential(nn.Conv2d(64, 128, 3, padding=1), nn.ReLU(), nn.MaxPool2d(2))A Heavy Classifier Head
VGG ends with three large dense layers. They hold most of its weights, which is why the model is so big on disk.
The Memory Cost
That elegance has a price: VGG is slow and memory-hungry. Beauty in design did not mean cheap to run.
A Strong Feature Extractor
Even today, VGGs early layers make excellent reusable features for transfer learning and style transfer.
Build It with Loops
Because the pattern repeats, you can generate VGG from a config list, looping to add each layer programmatically.
cfg = [64, 64, "M", 128, 128, "M"]
# "M" means insert a max-pool hereThe Lasting Lesson
VGGs gift was a clear principle: prefer many small filters over a few large ones. Modern nets still follow it.
Quick Check
Recall the central design choice behind VGG.
Recap: Small but Mighty
VGG proved that depth built from simple 3x3 blocks beats clever big filters. Simple, repeatable, and influential. Well done!
Pertanyaan yang Sering Diajukan
Apakah pelajaran “VGG: Tumpukan Filter Kecil” gratis?
Ya — teks lengkap “VGG: Tumpukan Filter Kecil” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus Deep Learning Academy, upgrade ke CoddyKit PRO. Kursus Deep Learning Academy mencakup 4 pelajaran total.
Apa yang akan aku pelajari di “VGG: Tumpukan Filter Kecil”?
Kedalaman dari blok 3x3 sederhana Kamu berlatih Deep Learning Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.
Apakah aku perlu pengalaman untuk memulai Deep Learning Academy?
Tidak diperlukan pengalaman sebelumnya. Deep Learning Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 2 dari 4.
Berapa lama pelajaran “VGG: Tumpukan Filter Kecil” memakan waktu?
Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.
Bisakah aku menulis dan menjalankan kode dalam pelajaran Deep Learning Academy ini?
Ya. Setiap pelajaran Deep Learning Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.
Semua pelajaran dalam kursus ini
- LeNet dan AlexNet: Keberhasilan Pertama
- VGG: Tumpukan Filter Kecil
- ResNet: Koneksi Lompatan Menjadi Dalam
- Muat Model torchvision