A API do calculador de ocupação
cudaOccupancyMaxPotentialBlockSize.
A API do calculador de ocupação é uma aula grátis de CUDA Academy no CoddyKit. Esta é a aula 3 de 4. Você pode ler a aula completa abaixo gratuitamente — depois pratica ao vivo no navegador com um editor de código integrado e um tutor de IA 24/7. Faz parte do caminho de aprendizado de CUDA Academy, e seu progresso é sincronizado entre a web e o app CoddyKit. O curso de CUDA Academy inclui 4 aulas no total.
Pare de adivinhar o tamanho do bloco
Em vez de ajustar manualmente, o CUDA oferece uma API de ocupação que calcula automaticamente um bom tamanho de bloco para o seu kernel.
A função principal
Uma chamada faz o trabalho pesado: cudaOccupancyMaxPotentialBlockSize sugere um tamanho de bloco que maximiza a ocupação.
cudaOccupancyMaxPotentialBlockSize(&grid, &block, myKernel);O que ela retorna
Ela preenche um tamanho de bloco sugerido e o tamanho mínimo da grade necessário para ocupar completamente o dispositivo com o seu kernel.
Ela conhece o seu kernel
A API lê o uso real de registradores e memória compartilhada do seu kernel, portanto a sugestão se ajusta a esse kernel específico, e não a uma suposição genérica.
Prevendo a ocupação
Uma chamada relacionada informa quantos blocos ativos por SM uma configuração oferece, para que você possa prever a ocupação antes do lançamento.
cudaOccupancyMaxActiveBlocksPerMultiprocessor(&n, k, 256, 0);Calculando a porcentagem
Multiplique os blocos por SM pelas warps por bloco, divida pelo número máximo de warps do SM e você obterá a porcentagem de ocupação teórica.
Memória compartilhada dinâmica
Essas chamadas recebem um argumento de memória compartilhada dinâmica, mantendo a previsão precisa quando o seu kernel define o tamanho da memória compartilhada no lançamento.
Portátil entre GPUs
Como consulta o dispositivo em execução, o mesmo código escolhe bons tamanhos em GPUs diferentes, sem que você precise codificar números fixos.
Use na inicialização
Chame a API de ocupação uma vez durante a inicialização, armazene o tamanho do bloco e reutilize-o em cada lançamento desse kernel.
Um ótimo padrão
O tamanho sugerido é um excelente ponto de partida. Ainda assim, você pode testar alguns tamanhos próximos para encontrar o melhor de fato para os seus dados.
Por que é melhor do que números mágicos
Tamanhos codificados, como 256, deixam de funcionar quando os recursos mudam. A API se adapta e mantém automaticamente o seu kernel próximo da ocupação máxima.
Verificação rápida
Lembre-se do que cudaOccupancyMaxPotentialBlockSize fornece.
Recapitulação
Você conheceu a API de ocupação: ela sugere um tamanho de bloco portátil e ciente do kernel, além de prever a ocupação antes mesmo do lançamento. ⚙️
Aprenda C++ com um tutor de IA — grátis
Escreva e execute código real no seu navegador, obtenha ajuda instantânea de um tutor de IA 24/7 e continue de onde parou na web ou no app.
- Cursos
- 30
- Aulas
- 120
Perguntas Frequentes
A aula “A API do calculador de ocupação” é grátis?
Sim — o texto completo de “A API do calculador de ocupação” é grátis para ler aqui na web. Para praticá-la interativamente (um editor de código integrado e um tutor de IA 24/7) e desbloquear o restante do curso de CUDA Academy, atualize para CoddyKit PRO. O curso de CUDA Academy inclui 4 aulas no total.
O que vou aprender em “A API do calculador de ocupação”?
cudaOccupancyMaxPotentialBlockSize. Você pratica CUDA Academy com código prático que executa diretamente no navegador, e um tutor de IA 24/7 responde suas dúvidas enquanto trabalha na aula.
Preciso ter experiência prévia para começar CUDA Academy?
Nenhuma experiência prévia é necessária. CUDA Academy no CoddyKit é estruturado para alunos iniciantes até avançados, então você pode começar aqui ou desde o início e aprender no seu ritmo. Esta é a aula 3 de 4.
Quanto tempo leva a aula “A API do calculador de ocupação”?
A maioria das aulas CoddyKit leva cerca de 5–10 minutos. Cada uma é compacta e interativa, então você faz progresso constante e retoma exatamente de onde parou entre web e app.
Posso escrever e executar código nesta aula de CUDA Academy?
Sim. Cada aula de CUDA Academy inclui um editor de código integrado, então você escreve e executa código real direto no navegador e recebe feedback de IA instantaneamente — nenhuma configuração local necessária.
Todas as aulas deste curso
- O que a ocupação realmente significa
- Limites de registradores e memória compartilhada
- A API do calculador de ocupação
- A ocupação não é tudo