CUDA Academy · Pelajaran

Hierarki Thread

Thread dikelompokkan menjadi blok, lalu blok menjadi grid.

Pelajaran 1 dari 413 langkah

Hierarki Thread adalah pelajaran CUDA Academy gratis di CoddyKit. Ini adalah pelajaran 1 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar CUDA Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus CUDA Academy mencakup 4 pelajaran total.

Banyak Thread, Satu Tugas

Kernel CUDA berjalan secara paralel pada banyak thread, dan setiap thread melakukan pekerjaan yang sama pada bagian datanya sendiri. 🧵

Thread Memerlukan Struktur

Meluncurkan jutaan thread yang tidak teratur akan menimbulkan kekacauan. CUDA mengaturnya dalam hierarki yang rapi agar perangkat keras dapat menjadwalkannya dengan baik.

Thread Membentuk Blok

Thread dikelompokkan ke dalam sebuah blok. Setiap thread dalam blok menjalankan kernel yang sama dan dapat bekerja sama erat dengan tetangganya.

Blok Membentuk Kisi

Semua blok untuk satu peluncuran secara bersama-sama membentuk kisi. Jadi rantainya sederhana: thread berada dalam blok, dan blok berada dalam kisi.

Mengapa Dua Tingkat?

Desain dua tingkat memungkinkan satu kernel ditingkatkan skalanya dari GPU kecil hingga GPU besar. Anda mendeskripsikan pekerjaan sekali, lalu kisi menyesuaikan ukurannya.

Memilih Bentuk Saat Peluncuran

Anda memilih jumlah blok dan jumlah thread per blok tepat saat peluncuran, menggunakan sintaks kurung sudut tiga.

myKernel<<<numBlocks, threadsPerBlock>>>(data);

Contoh Nyata

Misalnya Anda meluncurkan 4 blok yang masing-masing berisi 256 thread. Hasilnya adalah 4 kali 256, atau 1024 thread yang berjalan sekaligus.

Blok Tidak Saling Bergantung

Blok yang berbeda tidak boleh mengasumsikan urutan tertentu atau berkomunikasi langsung satu sama lain. Kemandirian inilah yang memungkinkan GPU menjalankannya dalam urutan apa pun.

Thread dalam Blok Bekerja Sama

Di dalam satu blok, thread dapat berbagi memori cepat pada cip dan menyinkronkan diri satu sama lain. Kerja sama itu adalah keunggulan blok.

Kisi dan Blok Dapat Berbentuk 3D

Kisi dan setiap blok dapat berbentuk 1D, 2D, atau 3D. Tipe dim3 memungkinkan Anda memetakan struktur secara alami ke gambar atau volume.

dim3 block(16, 16);
dim3 grid(32, 32);

Satu Thread, Satu Elemen

Tujuan umumnya adalah memberikan tepat satu elemen data kepada setiap utas untuk ditangani. Hierarki tersebut hanya menentukan cara Anda mencapai pemetaan itu.

Pemeriksaan Cepat

Mari kita periksa bagaimana bagian-bagian tersebut tersusun satu di dalam yang lain.

Ringkasan: Hierarki

Anda telah mempelajari tingkatan CUDA: utas membentuk blok, dan blok membentuk kisi. Blok-blok independen dapat diskalakan, sedangkan utas di dalam sebuah blok dapat bekerja sama. 🎯

Gratis untuk memulai

Belajar C++ dengan tutor AI — gratis

Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.

Kursus
30
Pelajaran
120

Pertanyaan yang Sering Diajukan

Apakah pelajaran “Hierarki Thread” gratis?

Ya — teks lengkap “Hierarki Thread” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus CUDA Academy, upgrade ke CoddyKit PRO. Kursus CUDA Academy mencakup 4 pelajaran total.

Apa yang akan aku pelajari di “Hierarki Thread”?

Thread dikelompokkan menjadi blok, lalu blok menjadi grid. Kamu berlatih CUDA Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.

Apakah aku perlu pengalaman untuk memulai CUDA Academy?

Tidak diperlukan pengalaman sebelumnya. CUDA Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 1 dari 4.

Berapa lama pelajaran “Hierarki Thread” memakan waktu?

Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.

Bisakah aku menulis dan menjalankan kode dalam pelajaran CUDA Academy ini?

Ya. Setiap pelajaran CUDA Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.

Semua pelajaran dalam kursus ini

  1. Hierarki Thread
  2. threadIdx, blockIdx, blockDim
  3. Mengapa Blok Ada
  4. Memilih Jumlah Thread per Blok
← Kembali ke CUDA Academy