Pertukaran Memori Global
Besar, perlahan dan boleh dilihat oleh setiap urutan.
Pertukaran Memori Global ialah pelajaran CUDA Academy percuma di CoddyKit. Ini ialah pelajaran 2 daripada 4. Anda boleh membaca keseluruhan pelajaran di bawah secara percuma — kemudian berlatih secara praktikal dalam pelayar menggunakan penyunting kod terbina dalam dan tutor kecerdasan buatan 24/7. Pelajaran ini merupakan sebahagian daripada laluan pembelajaran CUDA Academy, dan kemajuan anda disegerakkan merentas web serta aplikasi CoddyKit. Kursus CUDA Academy merangkumi sejumlah 4 pelajaran.
Ruang Terbesar yang Anda Ada
Memori global ialah DRAM utama GPU, yang selalunya berkapasiti berbilang gigabait. Di sinilah tatasusunan input dan output besar anda biasanya berada semasa kernel berjalan.
Kelihatan kepada Semua
Setiap bebenang dalam setiap blok boleh membaca dan menulis memori global. Kebolehlihatan dikongsi itu ialah sebab tepat anda menyalin data ke sana sebelum melancarkan kernel. 🌍
Anda Memperuntukkannya dengan cudaMalloc
Anda menempah memori global daripada hos dengan cudaMalloc, yang memberikan anda penuding peranti kepada rantau DRAM tersebut.
float *d_a;
cudaMalloc(&d_a, n * sizeof(float));Besar tetapi Perlahan
Masalahnya ialah kependaman. Satu bacaan memori global boleh menelan kos ratusan kitaran jam, jauh lebih banyak daripada capaian daftar.
Jalur Lebar ialah Had Sebenar
Banyak kernel terhad bukan oleh pengiraan matematik, tetapi oleh kelajuan bait mengalir dari DRAM. Kernel sebegini dipanggil kernel terikat memori.
Menyembunyikan Kependaman dengan Bebenang
GPU menyembunyikan bacaan perlahan dengan beralih kepada warp lain yang sedia ada sementara satu warp menunggu. Penyembunyian kependaman inilah sebab banyak bebenang sangat penting.
Kekal Merentas Pelancaran
Data dalam memori global kekal di situ antara pelancaran kernel sehingga anda membebaskannya. Anda boleh menjalankan beberapa kernel pada penimbal yang sama.
Dicache oleh L2
Cache L2 bersatu terletak di hadapan memori global untuk seluruh GPU. Alamat yang digunakan semula boleh disediakan daripada cache itu dan bukannya DRAM yang perlahan.
Corak Capaian Menentukan Kelajuan
Cara bebenang dipetakan kepada alamat sangat mempengaruhi daya pemprosesan. Bebenang bersebelahan yang menyentuh alamat bersebelahan ialah perkara yang dipanggil penggabungan capaian dalam pelajaran seterusnya.
Kurangkan Perjalanan
Strategi terasnya mudah: sentuh memori global sesedikit mungkin. Baca sekali, guna semula pada cip, kemudian tulis sekali.
Bebaskan Apa yang Anda Peruntukkan
Oleh sebab memori global ialah sumber terhingga, lepaskannya dengan cudaFree apabila anda selesai untuk mengelakkan kebocoran memori peranti.
cudaFree(d_a);Semakan Pantas
Pernyataan manakah yang paling tepat menggambarkan pertukaran dalam memori global?
Imbas Kembali: Besar, Dikongsi, Perlahan
Kini anda tahu bahawa memori global ialah DRAM GPU yang besar dan kelihatan kepada semua, yang menukar kapasiti dengan kependaman tinggi. Sentuhnya jarang-jarang dan guna semula data pada cip. 🚀
Pelajari C++ dengan tutor kecerdasan buatan — percuma
Tulis dan jalankan kod sebenar dalam pelayar anda, dapatkan bantuan segera daripada tutor kecerdasan buatan yang tersedia 24/7, dan sambung semula dari tempat anda berhenti di web atau dalam aplikasi.
- Kursus
- 30
- Pelajaran
- 120
Soalan Lazim
Adakah pelajaran “Pertukaran Memori Global” percuma?
Ya — teks penuh “Pertukaran Memori Global” boleh dibaca secara percuma di web ini. Untuk berlatih secara interaktif menggunakan penyunting kod terbina dalam dan tutor kecerdasan buatan 24/7, serta membuka kunci baki kursus CUDA Academy, tingkat taraf kepada CoddyKit PRO. Kursus CUDA Academy merangkumi sejumlah 4 pelajaran.
Apakah yang akan saya pelajari dalam “Pertukaran Memori Global”?
Besar, perlahan dan boleh dilihat oleh setiap urutan. Anda berlatih CUDA Academy menggunakan kod praktikal yang dijalankan terus dalam pelayar, manakala tutor kecerdasan buatan 24/7 menjawab soalan anda semasa anda mengikuti pelajaran.
Adakah saya memerlukan pengalaman untuk memulakan CUDA Academy?
Tiada pengalaman terdahulu diperlukan. Pembelajaran CUDA Academy di CoddyKit disusun untuk pelajar daripada peringkat pemula hingga lanjutan, jadi anda boleh bermula di sini atau dari awal dan belajar mengikut kadar anda sendiri. Ini ialah pelajaran 2 daripada 4.
Berapa lamakah pelajaran “Pertukaran Memori Global” diambil?
Kebanyakan pelajaran CoddyKit mengambil masa kira-kira 5–10 minit. Setiap pelajaran ringkas dan interaktif, jadi anda boleh membuat kemajuan secara berterusan dan menyambung tepat dari tempat anda berhenti di web atau aplikasi.
Bolehkah saya menulis dan menjalankan kod dalam pelajaran CUDA Academy ini?
Ya. Setiap pelajaran CUDA Academy menyertakan penyunting kod terbina dalam, jadi anda boleh menulis dan menjalankan kod sebenar terus dalam pelayar serta menerima maklum balas kecerdasan buatan serta-merta — tanpa memerlukan persediaan setempat.
Semua pelajaran dalam kursus ini
- Daftar dan Memori Setempat
- Pertukaran Memori Global
- Memori Tetap dan Cache-nya
- Model Mental Hierarki