CUDA Academy · Pelajaran

Model Mental Hierarki

Cocokkan data dengan ruang yang tepat.

Pelajaran 4 dari 413 langkah

Model Mental Hierarki adalah pelajaran CUDA Academy gratis di CoddyKit. Ini adalah pelajaran 4 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar CUDA Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus CUDA Academy mencakup 4 pelajaran total.

Piramida Pertukaran

Bayangkan memori GPU sebagai sebuah piramida. Bagian atasnya kecil dan sangat cepat, sedangkan dasarnya besar tetapi lambat. Tugas Anda adalah menggunakan setiap lapisan dengan baik.

Puncak: Register

Di puncak terdapat register: per thread, tercepat, dan sangat terbatas. Jika memungkinkan, simpan nilai kerja yang paling sering digunakan di sini.

Berikutnya: Memori Bersama

Tepat di bawahnya terdapat memori bersama, yaitu tempat kerja sementara di dalam cip yang terlihat oleh semua thread dalam satu blok. Memori ini merupakan alat Anda untuk kerja sama cepat dalam blok.

Jalur Samping: Cache Konstan

Di sampingnya terdapat cache konstan, yang ideal untuk nilai kecil hanya-baca yang dibaca secara seragam oleh warp dan disiarkan dalam satu pengambilan.

Dasar: Memori Global

Dasar yang lebar adalah memori global: berukuran gigabita, terlihat oleh semua pihak, tetapi memiliki latensi tinggi. Memori ini menyimpan input dan output besar Anda.

Jebakan: Memori Lokal

Waspadalah terhadap memori lokal. Namanya terdengar dekat, tetapi memori ini berada di DRAM yang lambat dan hanya digunakan saat register tumpah. Hindari ketergantungan padanya.

Cakupan Menentukan Ruang

Pilih berdasarkan pihak yang memerlukan data. Jika hanya satu thread yang memerlukannya, gunakan register; jika satu blok bekerja bersama, gunakan memori bersama; jika semua pihak memerlukannya, gunakan memori global.

Masa Hidup Juga Menentukan

Register dan memori bersama menghilang saat kernel berakhir, tetapi memori global tetap ada di antara peluncuran. Sesuaikan penyimpanan dengan lamanya data harus bertahan.

Aturan Emas

Pola yang unggul adalah memuat sekali dari memori global, menghitung di memori cepat dalam cip, lalu menulis sekali kembali. Ini meminimalkan lalu lintas memori global yang lambat.

Kapasitas Mengurangi Okupansi

Menggunakan banyak register atau memori bersama per blok membuat lebih sedikit blok dapat berjalan sekaligus. Okupansi adalah keseimbangan yang terus-menerus Anda sesuaikan.

Menggabungkan Semuanya

Kernel yang baik dengan sengaja mengarahkan setiap bagian data ke lapisan yang tepat. Kebiasaan tunggal inilah yang membedakan kode lambat dari kode CUDA yang cepat. 💪

Pemeriksaan Cepat

Dua thread dalam blok SAME perlu berbagi hasil antara. Ruang mana yang paling sesuai?

Rangkuman: Sesuaikan Data dengan Lapisan

Anda telah membangun peta mental: register, memori bersama, memori konstan, dan memori global menukar kecepatan dengan ukuran dan cakupan. Mengarahkan data ke lapisan yang tepat adalah inti dari semuanya. 🧠

Gratis untuk memulai

Belajar C++ dengan tutor AI — gratis

Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.

Kursus
30
Pelajaran
120

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Model Mental Hierarki” gratis?

Ya — teks lengkap “Model Mental Hierarki” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus CUDA Academy, upgrade ke CoddyKit PRO. Kursus CUDA Academy mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Model Mental Hierarki”?

Cocokkan data dengan ruang yang tepat. Kamu berlatih CUDA Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai CUDA Academy?

Tidak diperlukan pengalaman sebelumnya. CUDA Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 4 dari 4.

Berapa lama pelajaran “Model Mental Hierarki” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran CUDA Academy ini?

Ya. Setiap pelajaran CUDA Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Register dan Memori Lokal
  2. Pertukaran dalam Memori Global
  3. Memori Konstan dan Cache-nya
  4. Model Mental Hierarki
← Kembali ke CUDA Academy