Transferts de l’hôte vers l’appareil
Téléversez les données d’entrée vers le GPU.
Transferts de l’hôte vers l’appareil est une leçon CUDA Academy gratuite sur CoddyKit. Ceci est la leçon 1 sur 4. Tu peux lire la leçon complète ci-dessous gratuitement — puis la pratiquer en direct dans le navigateur avec un éditeur de code intégré et un tuteur IA 24/7. Elle fait partie du parcours d'apprentissage CUDA Academy, et ta progression se synchronise sur le web et l'application CoddyKit. Le cours CUDA Academy comprend 4 leçons au total.
Deux mémoires, un seul objectif
Vos données commencent dans la RAM hôte, mais le GPU ne peut traiter que les nombres présents dans sa propre mémoire d'appareil. Vous devez d'abord les transférer. 🚚
Découvrez cudaMemcpy
La fonction cudaMemcpy est votre camion de livraison : elle copie un bloc d'octets d'une adresse à une autre, qu'elle soit sur l'hôte ou l'appareil.
cudaMemcpy(dst, src, bytes, kind);Le sens du transfert vers l'appareil
Pour envoyer les données d’entrée vers le GPU, utilisez cudaMemcpyHostToDevice. La source est la RAM de l’hôte et la destination est la mémoire du périphérique.
cudaMemcpy(d_a, h_a, n*sizeof(float), cudaMemcpyHostToDevice);L’ordre des arguments compte
Comme avec memcpy, la destination vient en premier, puis la source. Si vous les inversez par accident, votre tampon GPU reste vide. 😬
cudaMemcpy(d_dst, h_src, bytes, cudaMemcpyHostToDevice);Comptez les octets, pas les éléments
L’argument de taille est exprimé en octets : multipliez donc le nombre d’éléments par la taille du type avec sizeof.
size_t bytes = n * sizeof(float);Allouez avant de copier
Le pointeur du périphérique doit déjà pointer vers une véritable zone de mémoire GPU. Faites toujours un cudaMalloc de la destination avant d’y envoyer les données.
cudaMalloc(&d_a, bytes);
cudaMemcpy(d_a, h_a, bytes, cudaMemcpyHostToDevice);Une attente synchrone
cudaMemcpy est bloquant : votre thread CPU se met en pause jusqu’à ce que chaque octet soit arrivé sans erreur sur le GPU.
Lancez ensuite votre noyau
Envoyez d’abord les données, puis effectuez le calcul. Une fois l’entrée présente sur le périphérique, votre noyau peut la lire et commencer le vrai travail.
cudaMemcpy(d_a, h_a, bytes, cudaMemcpyHostToDevice);
myKernel<<<blocks, threads>>>(d_a, n);Les tailles doivent correspondre
Vérifiez que le nombre d’octets envoyé tient dans le tampon que vous avez alloué. Copier plus de données que prévu est une erreur classique de dépassement de capacité.
Vérifiez le code de retour
cudaMemcpy renvoie un cudaError_t. Examinez-le afin qu’un pointeur ou une taille incorrecte provoque une erreur visible au lieu de corrompre votre exécution.
cudaError_t err = cudaMemcpy(d_a, h_a, bytes, cudaMemcpyHostToDevice);Les copies ne sont pas gratuites
Chaque envoi passe par le bus PCIe, relativement lent. Ne copiez donc que les données dont vous avez réellement besoin sur le périphérique.
Vérification rapide
Vous voulez envoyer un tableau d’entrée de la RAM du CPU vers le GPU. Quel appel est correct ?
Récapitulatif
Vous avez appris à envoyer des données avec cudaMemcpyHostToDevice : allouer le tampon du périphérique, placer la destination en premier, indiquer la taille en octets, puis copier avant le lancement. 🎉
Apprends C++ avec un tuteur IA — gratuit
Écris et exécute du vrai code dans ton navigateur, obtiens de l'aide instantanée d'un tuteur IA disponible 24h/24, et reprends là où tu t'es arrêté sur le web ou dans l'app.
- Cours
- 30
- Leçons
- 120
Questions Fréquemment Posées
La leçon « Transferts de l’hôte vers l’appareil » est-elle gratuite ?
Oui — le texte complet de « Transferts de l’hôte vers l’appareil » est gratuit à lire ici sur le web. Pour la pratiquer de manière interactive (un éditeur de code intégré et un tuteur IA 24/7) et déverrouiller le reste du cours CUDA Academy, passe à CoddyKit PRO. Le cours CUDA Academy comprend 4 leçons au total.
Qu'est-ce que j'apprendrai dans « Transferts de l’hôte vers l’appareil » ?
Téléversez les données d’entrée vers le GPU. Tu pratiques CUDA Academy avec du code pratique que tu exécutes directement dans le navigateur, et un tuteur IA 24/7 répond à tes questions au fur et à mesure que tu avances dans la leçon.
Dois-je avoir de l'expérience pour commencer CUDA Academy ?
Aucune expérience préalable n'est requise. CUDA Academy sur CoddyKit est structuré pour les débutants jusqu'aux apprenants avancés, donc tu peux commencer ici ou depuis le début et avancer à ton rythme. Ceci est la leçon 1 sur 4.
Combien de temps prend la leçon « Transferts de l’hôte vers l’appareil » ?
La plupart des leçons CoddyKit prennent environ 5–10 minutes. Chacune est courte et interactive, tu progresses régulièrement et tu repiques exactement où tu t'es arrêté sur le web et l'app.
Peux-tu écrire et exécuter du code dans cette leçon CUDA Academy ?
Oui. Chaque leçon CUDA Academy inclut un éditeur de code intégré, tu écris et exécutes du vrai code directement dans ton navigateur et tu reçois des retours IA instantanés — aucune configuration locale requise.
Toutes les leçons de ce cours
- Transferts de l’hôte vers l’appareil
- Transferts de l’appareil vers l’hôte
- Énumération de la direction de copie
- Le goulot d’étranglement des transferts PCIe