CUDA Academy · บทเรียน

cudaMalloc และ cudaFree

จองและคืนหน่วยความจำส่วนกลาง

บทเรียน 1 จาก 413 ขั้นตอน

cudaMalloc และ cudaFree เป็นบทเรียน CUDA Academy ฟรีบน CoddyKit นี่คือบทเรียนที่ 1 จากทั้งหมด 4 บทเรียน คุณสามารถอ่านบทเรียนทั้งหมดด้านล่างฟรี — จากนั้นลองปฏิบัติด้วยตัวคุณเองในเบราว์เซอร์พร้อมตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7 บทเรียนนี้เป็นส่วนหนึ่งของเส้นทางการเรียน CUDA Academy และความก้าวหน้าของคุณจะซิงค์ข้ามเว็บและแอป CoddyKit คอร์ส CUDA Academy มีบทเรียนทั้งหมด 4 บทเรียน

GPU มี RAM ของตัวเอง

GPU ของคุณไม่ได้ยืมหน่วยความจำหลักของคอมพิวเตอร์ แต่มีพื้นที่แยกต่างหากที่เรียกว่า หน่วยความจำโกลบอล ซึ่งเคอร์เนลใช้สำหรับอ่านและเขียน 🧠

คุณต้องขอพื้นที่ก่อน

ก่อนที่เคอร์เนลจะใช้หน่วยความจำบนอุปกรณ์ได้ คุณต้องจองพื้นที่ส่วนหนึ่งด้วยตนเอง ฟังก์ชันที่ใช้จองพื้นที่นี้คือ cudaMalloc

รูปแบบการประกาศของ cudaMalloc

cudaMalloc รับแอดเดรสของตัวชี้และจำนวนไบต์ จากนั้นใส่แอดเดรสใหม่บนอุปกรณ์ลงในตัวชี้นั้น

float* d_data;
cudaMalloc(&d_data, n * sizeof(float));

เหตุใดจึงใช้ตัวชี้ไปยังตัวชี้

คุณส่ง &d_data เพื่อให้ cudaMalloc เขียนแอดเดรสใหม่กลับลงในตัวแปรของคุณ ค่าที่ส่งคืนสงวนไว้สำหรับรหัสข้อผิดพลาด

นับเป็นไบต์เสมอ

cudaMalloc คิดเป็นหน่วย ไบต์ดิบ ไม่ใช่จำนวนสมาชิก ให้คูณจำนวนสมาชิกด้วย sizeof(type) เพื่อให้บัฟเฟอร์มีขนาดถูกต้อง

cudaMalloc(&d_arr, count * sizeof(int));

คืนพื้นที่ด้วย cudaFree

เมื่อใช้บัฟเฟอร์เสร็จแล้ว ให้คืนพื้นที่แก่ GPU ด้วย cudaFree วิธีนี้จะปล่อยหน่วยความจำโกลบอลให้กับงานอื่น

cudaFree(d_data);

เป็นคู่กันเหมือนกุญแจกับแม่กุญแจ

ให้ถือว่า cudaMalloc และ cudaFree เป็นคู่กัน การจองพื้นที่ทุกครั้งควรมีการคืนพื้นที่ที่ตรงกันเพียงครั้งเดียว

หน่วยความจำยังไม่ได้กำหนดค่า

หน่วยความจำใหม่จาก cudaMalloc มีค่าขยะอยู่ การอ่านก่อนเขียนหรือคัดลอกข้อมูลลงไปจะให้ผลลัพธ์ที่คาดเดาไม่ได้

การจองพื้นที่อาจล้มเหลว

หาก GPU ไม่มีหน่วยความจำเหลือ cudaMalloc จะส่งคืนข้อผิดพลาดแทนการทำให้โปรแกรมหยุดทำงาน ในโค้ดจริงควรตรวจสอบรหัสที่ส่งคืนเสมอ

หน่วยความจำโกลบอลมีมากแต่ช้า

บัฟเฟอร์จาก cudaMalloc อยู่ใน หน่วยความจำโกลบอล ซึ่งมีพื้นที่ระดับกิกะไบต์ แต่เป็นระดับที่ช้าที่สุดบนชิป จึงใช้ได้มากตามต้องการ แต่ควรใส่ใจรูปแบบการเข้าถึง

จังหวะของทุกโปรแกรม

โปรแกรม CUDA เกือบทุกโปรแกรมทำตามลำดับเดียวกัน: cudaMalloc คัดลอกข้อมูลเข้า เปิดใช้งานเคอร์เนล คัดลอกผลลัพธ์ออก แล้วจึง cudaFree

ตรวจสอบอย่างรวดเร็ว

มาดูกันว่า cudaMalloc รับตัวชี้เป้าหมายของมันอย่างไร

สรุปทบทวน

คุณได้เรียนรู้การจองหน่วยความจำ GPU ด้วย cudaMalloc โดยกำหนดขนาดเป็นไบต์ และคืนพื้นที่ด้วย cudaFree เป็นคู่ที่ตรงกัน 🎉

เริ่มต้นได้ฟรี

เรียนรู้ C++ ด้วย AI tutor — ฟรี

เขียนและเรียกใช้โค้ดจริงในเบราว์เซอร์ของคุณ รับความช่วยเหลือทันทีจาก AI tutor 24/7 และเรียนรู้ต่อจากที่คุณหยุดบนเว็บหรือในแอป

คอร์ส
30
บทเรียน
120

คำถามที่พบบ่อย

บทเรียน “cudaMalloc และ cudaFree” ฟรีหรือไม่

ใช่ — ข้อความเต็มของ “cudaMalloc และ cudaFree” ฟรีให้อ่านที่นี่บนเว็บ เพื่อปฏิบัติแบบโต้ตอบ (ตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7) และปลดล็อคส่วนที่เหลือของคอร์ส CUDA Academy ให้อัปเกรดเป็น CoddyKit PRO คอร์ส CUDA Academy มีบทเรียนทั้งหมด 4 บทเรียน

คุณจะเรียนรู้อะไรในบทเรียน “cudaMalloc และ cudaFree”

จองและคืนหน่วยความจำส่วนกลาง คุณปฏิบัติ CUDA Academy ด้วยโค้ดที่ใช้งานได้จริงที่คุณเรียกใช้โดยตรงในเบราว์เซอร์ และติวเตอร์ AI ตลอด 24/7 ตอบคำถามของคุณขณะที่คุณไปผ่านบทเรียน

คุณต้องมีประสบการณ์ก่อนที่จะเริ่มเรียน CUDA Academy หรือไม่

ไม่จำเป็นต้องมีประสบการณ์มาก่อน CUDA Academy บน CoddyKit ออกแบบมาสำหรับผู้เริ่มต้นไปจนถึงผู้เรียนขั้นสูง คุณสามารถเริ่มต้นที่นี่หรือเริ่มจากตัวแรกและเรียนด้วยความเร็วของคุณเอง นี่คือบทเรียนที่ 1 จากทั้งหมด 4 บทเรียน

บทเรียน “cudaMalloc และ cudaFree” ใช้เวลานานแค่ไหน

บทเรียน CoddyKit ส่วนใหญ่ใช้เวลาประมาณ 5–10 นาที แต่ละบทเรียนจึงสั้นและเป็นแบบโต้ตอบ คุณสามารถก้าวหน้าอย่างต่อเนื่องและกลับมาเรียนต่อจากตรงที่เพิ่งหยุดบนเว็บและแอปได้เลย

ฉันเขียนและรันโค้ดในบทเรียน CUDA Academy นี้ได้ไหม

ได้ บทเรียน CUDA Academy ทุกบทมีตัวแก้ไขโค้ดในตัว คุณจึงเขียนและรันโค้ดจริงได้เลยในเบราว์เซอร์ และได้รับข้อเสนอแนะจาก AI ในทันที — ไม่ต้องติดตั้งในเครื่องของคุณ

บทเรียนทั้งหมดในหลักสูตรนี้

  1. cudaMalloc และ cudaFree
  2. พอยน์เตอร์ไปยังหน่วยความจำ GPU
  3. เริ่มต้นข้อมูลด้วย cudaMemset
  4. หลีกเลี่ยงหน่วยความจำรั่วและการคืนซ้ำ
← กลับไปที่ CUDA Academy