De Occupancy Calculator-API
cudaOccupancyMaxPotentialBlockSize.
De Occupancy Calculator-API is een gratis CUDA Academy-les op CoddyKit. Dit is les 3 van 4. Je kunt de volledige les hieronder gratis lezen en daarna in de browser praktisch oefenen met een ingebouwde code-editor en een AI-begeleider die 24/7 beschikbaar is. Deze les maakt deel uit van het leertraject CUDA Academy. Je voortgang wordt gesynchroniseerd op het web en in de CoddyKit-app. De cursus CUDA Academy bevat in totaal 4 lessen.
Stop met de blokgrootte te gokken
In plaats van handmatig af te stemmen biedt CUDA een occupancy-API die automatisch een goede blokgrootte voor je kernel berekent.
De belangrijkste functie
Eén aanroep doet het zware werk: cudaOccupancyMaxPotentialBlockSize stelt een blokgrootte voor die occupancy maximaliseert.
cudaOccupancyMaxPotentialBlockSize(&grid, &block, myKernel);Wat de functie retourneert
De functie vult een voorgestelde blokgrootte in en de minimale rastergrootte die nodig is om het apparaat voor je kernel volledig te benutten.
De functie kent je kernel
De API leest het werkelijke gebruik van registers en gedeeld geheugen door je kernel, zodat de suggestie bij precies die kernel past en niet bij een algemene aanname.
Occupancy voorspellen
Een verwante aanroep rapporteert hoeveel actieve blokken per SM een configuratie oplevert, zodat je occupancy kunt voorspellen voordat je start.
cudaOccupancyMaxActiveBlocksPerMultiprocessor(&n, k, 256, 0);Het percentage berekenen
Vermenigvuldig het aantal blokken per SM met het aantal warps per blok, deel dit door het maximale aantal warps van de SM en je krijgt het percentage theoretische occupancy.
Dynamisch gedeeld geheugen
Deze aanroepen accepteren een argument voor dynamisch gedeeld geheugen, zodat de voorspelling nauwkeurig blijft wanneer je kernel de hoeveelheid gedeeld geheugen bij het starten bepaalt.
Overdraagbaar tussen GPU's
Omdat de functie het actieve apparaat bevraagt, kiest dezelfde code goede groottes op verschillende GPU's, zonder dat je getallen hard hoeft te coderen.
Gebruik dit bij het opstarten
Roep de occupancy-API één keer aan tijdens de initialisatie, bewaar de blokgrootte en gebruik deze vervolgens opnieuw bij elke start van die kernel.
Een sterke standaardkeuze
De voorgestelde grootte is een uitstekend uitgangspunt. Je kunt nog steeds enkele nabijgelegen waarden benchmarken om de echte beste keuze voor je gegevens te vinden.
Waarom dit beter is dan magische getallen
Hardgecodeerde groottes zoals 256 werken niet meer wanneer bronnen veranderen. De API past zich aan en houdt je kernel automatisch dicht bij maximale occupancy.
Korte controle
Haal terug wat cudaOccupancyMaxPotentialBlockSize je geeft.
Samenvatting
Je hebt kennisgemaakt met de occupancy-API: deze stelt een overdraagbare, kernelbewuste blokgrootte voor en voorspelt occupancy voordat je ook maar één keer start. ⚙️
Leer C++ met een AI-tutor — gratis
Schrijf echte code en voer die uit in je browser, krijg direct hulp van een AI-tutor die 24/7 beschikbaar is en ga verder waar je gebleven bent op het web of in de app.
- Cursussen
- 30
- Lessen
- 120
Veelgestelde vragen
Is de les “De Occupancy Calculator-API” gratis?
Ja — de volledige tekst van “De Occupancy Calculator-API” kun je hier gratis op het web lezen. Als je interactief wilt oefenen met een ingebouwde code-editor en een AI-begeleider die 24/7 beschikbaar is, en de rest van de cursus CUDA Academy wilt ontgrendelen, kun je upgraden naar CoddyKit PRO. De cursus CUDA Academy bevat in totaal 4 lessen.
Wat leer ik in “De Occupancy Calculator-API”?
cudaOccupancyMaxPotentialBlockSize. Je oefent met CUDA Academy door code rechtstreeks in de browser uit te voeren. Een AI-begeleider die 24/7 beschikbaar is beantwoordt je vragen terwijl je de les doorwerkt.
Heb ik ervaring nodig om met CUDA Academy te beginnen?
Ervaring vooraf is niet nodig. CUDA Academy op CoddyKit is opgebouwd voor beginners tot gevorderden, zodat je hier of bij het begin kunt starten en in je eigen tempo kunt leren. Dit is les 3 van 4.
Hoe lang duurt de les “De Occupancy Calculator-API”?
De meeste lessen van CoddyKit duren ongeveer 5–10 minuten. Elke les is kort en interactief, zodat je gestaag vooruitgaat en op het web en in de app precies verdergaat waar je was gebleven.
Kan ik code schrijven en uitvoeren in deze les over CUDA Academy?
Ja. Elke les over CUDA Academy bevat een ingebouwde code-editor, zodat je rechtstreeks in je browser echte code kunt schrijven en uitvoeren en direct feedback van AI krijgt — lokale installatie is niet nodig.
Alle lessen in deze cursus
- Wat occupancy werkelijk betekent
- Limieten van registers en shared memory
- De Occupancy Calculator-API
- Occupancy is niet het hele verhaal