CUDA Academy · Ders

Genel Belleğin Ödünleşimleri

Büyük, yavaş ve her iş parçacığı tarafından görülebilirdir.

2. ders / 413 adım

Genel Belleğin Ödünleşimleri, CoddyKit'te ücretsiz bir CUDA Academy dersidir. Bu, 4 dersinin 2. dersidir. Aşağıdan dersin tamamını ücretsiz okuyabilir, sonra tarayıcıda yerleşik kod editörü ve 7/24 yapay zeka koçu ile uygulamalı olarak pratik yapabilirsin. Bu, CUDA Academy öğrenme yolunun bir parçasıdır ve ilerlemeniz web ve CoddyKit uygulaması arasında senkronize olur. CUDA Academy kursu toplamda 4 dersten oluşur.

Sahip Olduğunuz En Büyük Alan

Genel bellek, GPU'nun çoğu zaman gigabaytlarca kapasiteye sahip ana DRAM'idir. Büyük giriş ve çıkış dizileriniz çekirdek çalışırken doğal olarak burada bulunur.

Herkes Tarafından Görülebilir

Her bloktaki her iş parçacığı genel belleği okuyabilir ve yazabilir. Verilerinizi başlatmadan önce buraya kopyalamanızın nedeni tam olarak bu ortak görünürlüktür. 🌍

cudaMalloc ile Ayırırsınız

Genel belleği ana bilgisayardan cudaMalloc ile ayırırsınız; bu çağrı size o DRAM bölgesini gösteren bir aygıt işaretçisi verir.

float *d_a;
cudaMalloc(&d_a, n * sizeof(float));

Büyük ama Yavaştır

Sorun gecikmedir. Tek bir genel bellek okuması yüzlerce saat döngüsüne mal olabilir; bu, bir yazmaç erişiminden çok daha fazladır.

Asıl Sınır Bant Genişliğidir

Birçok çekirdeği sınırlayan şey matematik değil, baytların DRAM'den ne kadar hızlı aktığıdır. Bu çekirdeklere bellek sınırlı çekirdekler deriz.

İş Parçacıklarıyla Gecikmeyi Gizlemek

Bir iş parçacığı demeti beklerken GPU, yavaş okumaları diğer hazır demetlere geçerek gizler. Bu gecikme gizleme, çok sayıda iş parçacığına sahip olmanın neden bu kadar önemli olduğunu açıklar.

Başlatmalar Arasında Kalır

Genel bellekteki veriler, belleği serbest bırakana kadar çekirdek başlatmaları arasında yerinde kalır. Aynı arabellekler üzerinde birden fazla çekirdek çalıştırabilirsiniz.

L2 Tarafından Önbelleğe Alınır

Birleşik bir L2 önbelleği, tüm GPU için genel belleğin önünde bulunur. Yeniden kullanılan adresler yavaş DRAM yerine buradan karşılanabilir.

Erişim Düzeni Hızı Belirler

İş parçacıklarının adreslerle nasıl eşleştirildiği aktarım hızını büyük ölçüde etkiler. Komşu iş parçacıklarının komşu adreslere erişmesi, sonraki derslerin birleştirme olarak adlandırdığı şeydir.

Ayırdığınız Belleği Serbest Bırakın

Temel strateji basittir: genel belleğe mümkün olduğunca az kez erişin. Bir kez okuyun, çip üzerinde yeniden kullanın, ardından bir kez yazın.

Ayırdığınız Her Şeyi Serbest Bırakın

Global bellek sınırlı bir kaynak olduğundan, işiniz bittiğinde aygıt belleğinde sızıntı oluşmasını önlemek için cudaFree ile serbest bırakın.

cudaFree(d_a);

Hızlı Kontrol

Global belleğin ödünleşimini en iyi açıklayan ifade hangisidir?

Özet: Büyük, Paylaşımlı, Yavaş

Artık global belleğin, yüksek gecikme karşılığında kapasite sunan, GPU'nun büyük ve herkes tarafından görülebilen DRAM'i olduğunu biliyorsunuz. Ona seyrek erişin ve verileri çip üzerinde yeniden kullanın. 🚀

Başlamak ücretsiz

Yapay zeka eğitmeniyle C++ öğren — ücretsiz

Tarayıcında gerçek kod yaz ve çalıştır, 7/24 yapay zeka eğitmeninden anında yardım al; web'de ya da uygulamada kaldığın yerden devam et.

Kurslar
30
Dersler
120

Sıkça Sorulan Sorular

“Genel Belleğin Ödünleşimleri” dersi ücretsiz mi?

Evet — “Genel Belleğin Ödünleşimleri” dersin tüm metni burada web'de ücretsiz olarak okunabilir. Etkileşimli olarak pratik yapmak (yerleşik kod editörü ve 7/24 yapay zeka koçu) ve CUDA Academy kursunun geri kalanını açmak için CoddyKit PRO'ya yükselt. CUDA Academy kursu toplamda 4 dersten oluşur.

“Genel Belleğin Ödünleşimleri” dersinde ne öğreneceğim?

Büyük, yavaş ve her iş parçacığı tarafından görülebilirdir. CUDA Academy ile uygulamalı kodu tarayıcıda doğrudan çalıştırarak pratik yaparsın ve 7/24 yapay zeka koçu dersi çalışırken sorularını yanıtlar.

CUDA Academy öğrenmeye başlamak için deneyim gerekli mi?

Önceden deneyim gerekmez. CoddyKit'te CUDA Academy, başlangıçtan ileri seviyeye kadar yapılandırıldığı için buradan başlayabilir veya başından başlayıp kendi hızında ilerleme yapabilirsin. Bu, 4 dersinin 2. dersidir.

“Genel Belleğin Ödünleşimleri” dersi ne kadar sürer?

Çoğu CoddyKit dersi yaklaşık 5–10 dakika sürer. Her biri kısa ve etkileşimli olduğu için sabit ilerleme yaparsın ve web ile uygulama arasında tam olarak bıraktığın yerden devam edebilirsin.

Bu CUDA Academy dersinde kod yazıp çalıştırabilir miyim?

Evet. Her CUDA Academy dersi yerleşik bir kod editörü içerir, bu sayede tarayıcıda gerçek kod yazıp çalıştırabilir ve anlık yapay zeka geri bildirimi alırsın — yerel kurulum gerekli değildir.

Bu kursun tüm dersleri

  1. Kayıtlar ve Yerel Bellek
  2. Genel Belleğin Ödünleşimleri
  3. Sabit Bellek ve Önbelleği
  4. Hiyerarşinin Zihinsel Modeli
← CUDA Academy Sayfasına Dön