0Pricing
Deep Learning Academy · Pelajaran

SGD dengan Momentum

Menghaluskan pembaruan agar melewati derau

SGD dengan Momentum adalah pelajaran Deep Learning Academy gratis di CoddyKit. Ini adalah pelajaran 1 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar Deep Learning Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus Deep Learning Academy mencakup 4 pelajaran total.

Bagian dari pelajaran ini belum diterjemahkan dan ditampilkan dalam bahasa Inggris.

Plain SGD Forgets

Vanilla SGD steps using only the current gradient. Every update starts from scratch, so a noisy slope makes it wobble and crawl toward the minimum.

Borrow Some Inertia

Momentum gives SGD memory. It keeps a running average of past gradients and rolls in that direction, like a ball gathering speed downhill.

The Velocity Vector

Momentum tracks a velocity that blends the old velocity with the new gradient. The weights then move by that smoothed velocity each step.

v = beta * v + grad
w = w - lr * v

The Beta Knob

The momentum coefficient beta sets how much past steps count. A common value is 0.9, meaning most of the velocity carries over.

Smooths Out Noise

Because momentum averages many gradients, random noise in any single batch mostly cancels. The path to the minimum becomes smoother and steadier.

Rolls Past Small Bumps

Built-up speed lets the optimizer coast through tiny dips and flat spots that would stall plain SGD. The ball does not stop at every pebble.

Turn It On in PyTorch

You do not code this by hand. Just pass momentum to the built-in SGD optimizer and PyTorch tracks the velocity for you.

opt = torch.optim.SGD(model.parameters(), lr=0.01, momentum=0.9)

Nesterov Looks Ahead

A sharper variant, Nesterov momentum, peeks at where the velocity is heading before measuring the gradient. It often converges a touch faster.

opt = torch.optim.SGD(model.parameters(), lr=0.01, momentum=0.9, nesterov=True)

Mind the Overshoot

Too much speed can carry you past the valley floor. If loss bounces or diverges, lower the learning rate or trim momentum a little.

Why It Still Matters

Even with fancy optimizers around, SGD with momentum remains a strong baseline and often generalizes beautifully on vision models.

A Faster Descent

The payoff is real: momentum usually reaches a good minimum in fewer epochs than plain SGD, with less zig-zagging along the way.

Quick Check

Make sure momentum's role is clear.

Recap

Momentum gives SGD a velocity that blends past gradients, smoothing noise and coasting past small bumps. Set momentum near 0.9 for a faster, steadier descent. 🏂

Pertanyaan yang Sering Diajukan

Apakah pelajaran “SGD dengan Momentum” gratis?

Ya — teks lengkap “SGD dengan Momentum” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus Deep Learning Academy, upgrade ke CoddyKit PRO. Kursus Deep Learning Academy mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “SGD dengan Momentum”?

Menghaluskan pembaruan agar melewati derau Kamu berlatih Deep Learning Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai Deep Learning Academy?

Tidak diperlukan pengalaman sebelumnya. Deep Learning Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 1 dari 4.

Berapa lama pelajaran “SGD dengan Momentum” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran Deep Learning Academy ini?

Ya. Setiap pelajaran Deep Learning Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. SGD dengan Momentum
  2. Adam dan AdamW Dijelaskan
  3. Peluruhan Bobot vs Regularisasi L2
  4. Jadwal Laju Pembelajaran dan Warmup
← Kembali ke Deep Learning Academy