cudaMemcpyAsync dalam Aliran
Transfer tanpa pemblokiran yang dapat berlangsung tumpang tindih.
cudaMemcpyAsync dalam Aliran adalah pelajaran CUDA Academy gratis di CoddyKit. Ini adalah pelajaran 3 dari 4. Kamu bisa membaca pelajaran lengkapnya di bawah secara gratis — lalu praktikkan langsung di browser dengan editor kode bawaan dan tutor AI 24/7. Ini adalah bagian dari jalur belajar CUDA Academy, dan progresmu tersinkronisasi di web dan aplikasi CoddyKit. Kursus CUDA Academy mencakup 4 pelajaran total.
Memblokir secara Bawaan
cudaMemcpy biasa menghentikan CPU Anda sampai penyalinan selesai. Utas host Anda hanya menunggu tanpa melakukan pekerjaan yang berguna saat byte-byte dipindahkan.
Kerabat Asinkron
Kenali cudaMemcpyAsync. Fungsi ini mengantrekan penyalinan dan segera mengembalikan kendali ke CPU Anda, sehingga host dapat terus bekerja saat transfer berlangsung.
Memerlukan Aliran
Penyalinan asinkron memerlukan argumen tambahan: sebuah aliran. Aliran adalah antrean berurutan tempat transfer menunggu gilirannya untuk berjalan.
cudaMemcpyAsync(d_data, h_data, bytes, cudaMemcpyHostToDevice, stream);Harus Terkunci
Inilah syaratnya: penyalinan asinkron hanya benar-benar berjalan tanpa pemblokiran dari memori host yang terkunci. Jika Anda memberikan penyangga yang dapat dipindahkan ke penyimpanan sekunder, CUDA diam-diam beralih ke penyalinan yang memblokir.
Mengembalikan Kendali, Bukan Menyelesaikan
Saat pemanggilan fungsi dikembalikan, penyalinan baru dijadwalkan, belum selesai. Data mungkin masih dalam perjalanan, jadi jangan membacanya dahulu.
Urutan dalam Satu Aliran
Pekerjaan dalam satu aliran berjalan secara berurutan, satu per satu. Jadi, penyalinan yang dikeluarkan sebelum inti dalam aliran yang sama dijamin selesai terlebih dahulu.
Tunggu Saat Diperlukan
Sebelum menyentuh hasil di CPU, pastikan antrean sudah kosong. Panggil cudaStreamSynchronize untuk memblokir sampai pekerjaan aliran tersebut selesai.
cudaStreamSynchronize(stream);Intinya: Tumpang Tindih
Penyalinan asinkron memungkinkan transfer dalam satu aliran berjalan saat inti di aliran lain melakukan komputasi. Konkurensi tersebut menyembunyikan waktu transfer.
Waspadai Aliran Bawaan
Jika Anda memberikan aliran 0, yaitu aliran bawaan lama, aliran tersebut dapat diserialkan terhadap semua pekerjaan lain. Gunakan aliran yang Anda buat sendiri agar tumpang tindih benar-benar terjadi.
Pertahankan Penyangga
Karena penyalinan selesai nanti, penyangga host harus tetap valid sampai saat itu. Jika dibebaskan terlalu cepat, transfer yang masih berlangsung akan membaca data acak.
Pola Umum
Alur klasiknya adalah penyalinan asinkron masuk, menjalankan inti, lalu penyalinan asinkron keluar, semuanya dalam satu aliran. Lakukan sinkronisasi hanya di bagian paling akhir.
cudaMemcpyAsync(d_in, h_in, bytes, cudaMemcpyHostToDevice, stream);
kernel<<<grid, block, 0, stream>>>(d_in, d_out);Pemeriksaan Singkat
Apa yang diperlukan cudaMemcpyAsync agar benar-benar tidak memblokir?
Rangkuman
cudaMemcpyAsync mengantrekan penyalinan dalam sebuah aliran dan segera mengembalikan kendali, tetapi memerlukan memori terkunci agar dapat berjalan tumpang tindih. Sinkronkan aliran sebelum membaca hasil. ⚡
Belajar C++ dengan tutor AI — gratis
Tulis dan jalankan kode asli di browser kamu, dapatkan bantuan instan dari tutor AI 24/7, dan lanjutkan di mana kamu tinggalkan di web atau aplikasi.
- Kursus
- 30
- Pelajaran
- 120
Pertanyaan yang Sering Diajukan
Apakah pelajaran “cudaMemcpyAsync dalam Aliran” gratis?
Ya — teks lengkap “cudaMemcpyAsync dalam Aliran” gratis dibaca di sini di web. Untuk praktiknya secara interaktif (editor kode bawaan dan tutor AI 24/7) dan buka sisa kursus CUDA Academy, upgrade ke CoddyKit PRO. Kursus CUDA Academy mencakup 4 pelajaran total.
Apa yang akan aku pelajari di “cudaMemcpyAsync dalam Aliran”?
Transfer tanpa pemblokiran yang dapat berlangsung tumpang tindih. Kamu berlatih CUDA Academy dengan kode praktik yang langsung kamu jalankan di browser, dan tutor AI 24/7 menjawab pertanyaanmu saat kamu mengerjakan pelajaran ini.
Apakah aku perlu pengalaman untuk memulai CUDA Academy?
Tidak diperlukan pengalaman sebelumnya. CUDA Academy di CoddyKit dirancang untuk pemula hingga pelajar tingkat lanjut, jadi kamu bisa memulai di sini atau dari awal dan belajar sesuai kecepatan kamu sendiri. Ini adalah pelajaran 3 dari 4.
Berapa lama pelajaran “cudaMemcpyAsync dalam Aliran” memakan waktu?
Sebagian besar pelajaran CoddyKit memakan waktu sekitar 5–10 menit. Setiap pelajaran ringkas dan interaktif, jadi kamu membuat kemajuan stabil dan melanjutkan dari tempat kamu tinggalkan di web dan aplikasi.
Bisakah aku menulis dan menjalankan kode dalam pelajaran CUDA Academy ini?
Ya. Setiap pelajaran CUDA Academy menyertakan editor kode bawaan, jadi kamu menulis dan menjalankan kode nyata langsung di browser dan mendapatkan umpan balik AI instan — tidak diperlukan penyiapan lokal.
Semua pelajaran dalam kursus ini
- Mengapa Memori Pageable Lambat
- Memori Terkunci dengan cudaMallocHost
- cudaMemcpyAsync dalam Aliran
- Pipeline Penyangga Ganda