Mémoire épinglée avec cudaMallocHost
Des tampons verrouillés en mémoire pour accélérer le DMA.
Mémoire épinglée avec cudaMallocHost est une leçon CUDA Academy gratuite sur CoddyKit. Ceci est la leçon 2 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage CUDA Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours CUDA Academy comprend 4 leçons au total.
Découvrez la mémoire épinglée
La mémoire épinglée est une mémoire hôte que le système d’exploitation s’engage à ne jamais déplacer ni échanger sur le disque. Comme son adresse physique est fixe, le GPU peut la lire directement.
Également appelée verrouillée en mémoire
Vous verrez le terme verrouillée en mémoire utilisé comme synonyme d’épinglée. Les deux désignent la même chose : des pages verrouillées à leur emplacement, de sorte qu’aucun échange sur le disque ne puisse avoir lieu.
Allouez-la correctement
Demandez à CUDA de la mémoire épinglée avec cudaMallocHost. Cette fonction renvoie un pointeur hôte ordinaire que vous pouvez lire et modifier comme n’importe quel tableau C++.
float* h_data;
cudaMallocHost(&h_data, N * sizeof(float));Utilisez-la normalement
Le pointeur renvoyé se comporte comme n’importe quel tampon hôte, votre code CPU reste donc inchangé. Il vous suffit de le remplir et de le lire exactement comme avant.
for (int i = 0; i < N; ++i) h_data[i] = i * 1.0f;Plus de mise en tampon intermédiaire
Comme les pages ne peuvent pas être déplacées, le pilote ignore sa copie intermédiaire cachée. Le GPU lit directement depuis votre tampon, et la copie en double disparaît.
Des transferts plus rapides
Le gain concerne réellement la bande passante. Les transferts depuis une mémoire épinglée atteignent souvent presque la vitesse de pointe de la liaison, parfois environ deux fois celle de la version paginable.
Libérez-la correctement
La mémoire épinglée nécessite sa propre fonction de libération correspondante. Utilisez cudaFreeHost, jamais la libération ordinaire, sinon vous risquez un plantage et une fuite mémoire.
cudaFreeHost(h_data);Ce n’est pas une ressource illimitée
Les pages épinglées ne peuvent pas être échangées sur le disque et immobilisent donc de la RAM bien réelle. Si vous en épinglez trop, vous privez le reste du système de mémoire utilisable.
L’allocation est plus lente
Le verrouillage des pages demande du travail, donc cudaMallocHost est plus lent à allouer que l’allocation ordinaire. Réutilisez un même tampon épinglé pour plusieurs transferts au lieu de le réallouer.
Le véritable superpouvoir
Au-delà de la vitesse, la mémoire épinglée est la clé qui permet des copies véritablement asynchrones. Sans elle, cudaMemcpyAsync ne peut se chevaucher avec aucune autre opération.
Quand l’utiliser
Épinglez les tampons que vous transférez souvent ou qui alimentent des flux. Pour la copie unique d’un petit tableau, l’allocation ordinaire convient parfaitement. 🙂
Vérification rapide
Vous avez alloué un tampon avec cudaMallocHost. Comment devez-vous le libérer ?
Récapitulatif
cudaMallocHost épingle les pages hôtes afin que le GPU les lise directement, ce qui accélère les copies et permet le chevauchement asynchrone. Libérez-les toujours avec cudaFreeHost. 🔒
Questions Fréquemment Posées
La leçon « Mémoire épinglée avec cudaMallocHost » est-elle gratuite ?
Oui — le texte complet de « Mémoire épinglée avec cudaMallocHost » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours CUDA Academy, passe à CoddyKit PRO. Le cours CUDA Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Mémoire épinglée avec cudaMallocHost » ?
Des tampons verrouillés en mémoire pour accélérer le DMA. Tu pratiques CUDA Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer CUDA Academy ?
Aucune expérience préalable n'est requise. CUDA Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 2 sur 4.
Combien de temps prend la leçon « Mémoire épinglée avec cudaMallocHost » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon CUDA Academy ?
Oui. Chaque leçon CUDA Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Pourquoi la mémoire paginable est lente
- Mémoire épinglée avec cudaMallocHost
- cudaMemcpyAsync dans un flux
- Le pipeline à double tampon