CUDA Academy · บทเรียน

หน่วยความจำคงที่และแคชของมัน

กระจายค่าที่อ่านได้อย่างเดียวด้วยต้นทุนต่ำ

บทเรียน 3 จาก 413 ขั้นตอน

หน่วยความจำคงที่และแคชของมัน เป็นบทเรียน CUDA Academy ฟรีบน CoddyKit นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน คุณสามารถอ่านบทเรียนทั้งหมดด้านล่างฟรี — จากนั้นลองปฏิบัติด้วยตัวคุณเองในเบราว์เซอร์พร้อมตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7 บทเรียนนี้เป็นส่วนหนึ่งของเส้นทางการเรียน CUDA Academy และความก้าวหน้าของคุณจะซิงค์ข้ามเว็บและแอป CoddyKit คอร์ส CUDA Academy มีบทเรียนทั้งหมด 4 บทเรียน

พื้นที่สำหรับค่าที่อ่านอย่างเดียว

หน่วยความจำค่าคงที่เป็นพื้นที่ขนาดเล็กที่ออกแบบมาสำหรับข้อมูลที่ทุกเธรดอ่าน แต่ไม่มีเธรดใดเขียนระหว่างที่เคอร์เนลทำงาน

การประกาศ

คุณกำหนดให้อาร์เรย์ในขอบเขตส่วนกลางมีตัวระบุ __constant__ อาร์เรย์นี้อยู่นอกฟังก์ชันใด ๆ และเคอร์เนลทั้งหมดของคุณมองเห็นได้

__constant__ float weights[256];

มีขนาดเล็กจริง ๆ

หน่วยความจำค่าคงที่ทั้งหมดมีขนาดเพียง 64 KB บน GPU ทั่วไป หน่วยความจำนี้เหมาะสำหรับสัมประสิทธิ์และพารามิเตอร์ ไม่ใช่ชุดข้อมูลขนาดใหญ่

เติมข้อมูลจากโฮสต์

คุณเขียนข้อมูลไปยังหน่วยความจำค่าคงที่จาก CPU โดยใช้ cudaMemcpyToSymbol เนื่องจากเคอร์เนลไม่สามารถแก้ไขข้อมูลนี้ได้เอง

cudaMemcpyToSymbol(weights, h_w,
    256 * sizeof(float));

มีแคชพิเศษรองรับ

การอ่านจะผ่านแคชค่าคงที่เฉพาะบนมัลติโพรเซสเซอร์แต่ละตัว ค่าที่อยู่ในแคชจะถูกส่งกลับมาเร็วเกือบเท่ากับรีจิสเตอร์

พลังพิเศษด้านการกระจายข้อมูล

เมื่อทั้งวาร์ปอ่านตำแหน่งเดียวกัน ฮาร์ดแวร์จะดึงข้อมูลเพียงครั้งเดียวแล้วกระจายข้อมูลไปยังทั้ง 32 เธรดในขั้นตอนเดียว 📡

ตำแหน่งเดียวกันคือกุญแจสำคัญ

ประโยชน์นี้ขึ้นอยู่กับการเข้าถึงที่เป็นแบบเดียวกัน หากเธรดในวาร์ปอ่านตำแหน่งค่าคงที่ต่างกัน การอ่านเหล่านั้นจะถูกทำให้เป็นลำดับ และความเร็วที่เพิ่มขึ้นจะหายไป

การอ่านดูเป็นเรื่องปกติ

ภายในเคอร์เนล คุณอ่านหน่วยความจำค่าคงที่ได้เหมือนอาร์เรย์ทั่วไป คอมไพเลอร์จะเปลี่ยนเส้นทางการเข้าถึงไปยังแคชค่าคงที่ความเร็วสูงให้อย่างเงียบ ๆ

__global__ void k(float *out, int i) {
    out[i] = weights[0] * 2.0f;
}

เหมาะอย่างยิ่งสำหรับตัวกรอง

เคอร์เนลการคอนโวลูชันและตารางค้นหาทำงานได้ดีในพื้นที่นี้ เพราะทุกเธรดใช้ชุดสัมประสิทธิ์ขนาดเล็กชุดเดียวกันซ้ำแล้วซ้ำเล่า

กำหนดครั้งเดียว ใช้ซ้ำบ่อย ๆ

โดยทั่วไปคุณจะอัปโหลดข้อมูลไปยังหน่วยความจำค่าคงที่เพียงครั้งเดียว แล้วเริ่มการทำงานของเคอร์เนลหลายตัวที่อ่านค่าเดิมเหล่านั้นได้อย่างประหยัด

เมื่อใดที่ไม่ควรใช้

หลีกเลี่ยงหน่วยความจำค่าคงที่หากข้อมูลของคุณมีขนาดใหญ่ หรือหากเธรดอ่านตำแหน่งที่กระจัดกระจาย ในกรณีเหล่านั้นหน่วยความจำส่วนกลางทั่วไปจะเหมาะกว่า

ตรวจสอบอย่างรวดเร็ว

หน่วยความจำค่าคงที่ให้ความเร็วเพิ่มขึ้นมากที่สุดเมื่อใด

ทบทวน: เล็ก มีแคช กระจายข้อมูล

คุณได้เรียนรู้ว่าหน่วยความจำค่าคงที่เป็นพื้นที่ขนาดเล็กมากสำหรับอ่านอย่างเดียว โดยแคชจะกระจายการอ่านแบบเดียวกันไปยังทั้งวาร์ป ใช้พื้นที่นี้กับค่าขนาดเล็กที่ใช้ร่วมกัน ✨

เริ่มต้นได้ฟรี

เรียนรู้ C++ ด้วย AI tutor — ฟรี

เขียนและเรียกใช้โค้ดจริงในเบราว์เซอร์ของคุณ รับความช่วยเหลือทันทีจาก AI tutor 24/7 และเรียนรู้ต่อจากที่คุณหยุดบนเว็บหรือในแอป

คอร์ส
30
บทเรียน
120

คำถามที่พบบ่อย

บทเรียน “หน่วยความจำคงที่และแคชของมัน” ฟรีหรือไม่

ใช่ — ข้อความเต็มของ “หน่วยความจำคงที่และแคชของมัน” ฟรีให้อ่านที่นี่บนเว็บ เพื่อปฏิบัติแบบโต้ตอบ (ตัวแก้ไขโค้ดในตัวและติวเตอร์ AI ตลอด 24/7) และปลดล็อคส่วนที่เหลือของคอร์ส CUDA Academy ให้อัปเกรดเป็น CoddyKit PRO คอร์ส CUDA Academy มีบทเรียนทั้งหมด 4 บทเรียน

คุณจะเรียนรู้อะไรในบทเรียน “หน่วยความจำคงที่และแคชของมัน”

กระจายค่าที่อ่านได้อย่างเดียวด้วยต้นทุนต่ำ คุณปฏิบัติ CUDA Academy ด้วยโค้ดที่ใช้งานได้จริงที่คุณเรียกใช้โดยตรงในเบราว์เซอร์ และติวเตอร์ AI ตลอด 24/7 ตอบคำถามของคุณขณะที่คุณไปผ่านบทเรียน

คุณต้องมีประสบการณ์ก่อนที่จะเริ่มเรียน CUDA Academy หรือไม่

ไม่จำเป็นต้องมีประสบการณ์มาก่อน CUDA Academy บน CoddyKit ออกแบบมาสำหรับผู้เริ่มต้นไปจนถึงผู้เรียนขั้นสูง คุณสามารถเริ่มต้นที่นี่หรือเริ่มจากตัวแรกและเรียนด้วยความเร็วของคุณเอง นี่คือบทเรียนที่ 3 จากทั้งหมด 4 บทเรียน

บทเรียน “หน่วยความจำคงที่และแคชของมัน” ใช้เวลานานแค่ไหน

บทเรียน CoddyKit ส่วนใหญ่ใช้เวลาประมาณ 5–10 นาที แต่ละบทเรียนจึงสั้นและเป็นแบบโต้ตอบ คุณสามารถก้าวหน้าอย่างต่อเนื่องและกลับมาเรียนต่อจากตรงที่เพิ่งหยุดบนเว็บและแอปได้เลย

ฉันเขียนและรันโค้ดในบทเรียน CUDA Academy นี้ได้ไหม

ได้ บทเรียน CUDA Academy ทุกบทมีตัวแก้ไขโค้ดในตัว คุณจึงเขียนและรันโค้ดจริงได้เลยในเบราว์เซอร์ และได้รับข้อเสนอแนะจาก AI ในทันที — ไม่ต้องติดตั้งในเครื่องของคุณ

บทเรียนทั้งหมดในหลักสูตรนี้

  1. รีจิสเตอร์และหน่วยความจำเฉพาะที่
  2. ข้อแลกเปลี่ยนของหน่วยความจำส่วนกลาง
  3. หน่วยความจำคงที่และแคชของมัน
  4. แบบจำลองทางความคิดของลำดับชั้น
← กลับไปที่ CUDA Academy