CUDA Academy · Урок

Что на самом деле означает заполненность

Сравнение активных варпов с максимальным числом для SM.

Урок 1 из 413 шагов

«Что на самом деле означает заполненность» — бесплатный урок CUDA Academy на CoddyKit. Это урок 1 из 4. Ты можешь прочитать весь урок бесплатно ниже — а потом практиковать его прямо в браузере с встроенным редактором кода и ИИ-репетитором 24/7. Это часть пути обучения CUDA Academy, и твой прогресс синхронизируется между веб-версией и приложением CoddyKit. Курс CUDA Academy содержит 4 уроков всего.

Знакомство с загрузкой

Каждое ядро GPU, называемое SM, может одновременно удерживать множество активных варпов. Загрузка показывает, насколько полно используется эта ёмкость. 🎯

Простое соотношение

Загрузка — это отношение числа активных варпов на SM к максимальному числу варпов, которое может удерживать этот SM. Чем больше активных варпов, тем полнее загружено устройство.

Почему важны активные варпы

Когда один варп останавливается из-за медленного чтения из памяти, SM немедленно запускает другой готовый варп. Благодаря такой замене GPU скрывает задержку.

Максимум SM

Каждая архитектура задаёт предел — часто 64 варпа на SM. Загрузка сравнивает ваше ядро с этим аппаратным ограничением.

Теоретическая и достигнутая загрузка

Теоретическая загрузка — это то, что конфигурация запуска позволяет получить на бумаге. Достигнутая загрузка — то, что действительно выполнялось, по данным профилировщика.

Короткий пример

Если SM удерживает 64 варпа, а ваше ядро поддерживает активными только 32, его загрузка составляет 50%. Половина возможностей скрытия задержки простаивает.

Подсчёт варпов

Загрузка всегда измеряется в варпах, а не в отдельных потоках. Варп состоит из 32 потоков, поэтому блок из 256 потоков содержит ровно 8 варпов.

Блоки превращаются в варпы

Планировщик разделяет каждый активный блок на варпы. Поэтому произведение числа блоков на SM на числа варпов в блоке даёт количество активных варпов.

Что ограничивает загрузку

Загрузку ограничивают три ресурса: регистры на поток, общая память на блок и лимит варпов SM. Определяющим становится самое жёсткое ограничение.

Больше — не всегда лучше

Более высокая загрузка обычно лучше скрывает задержку, но после определённого предела не даёт дополнительного выигрыша. Это инструмент, а не конечная цель.

Где это увидеть

Профилировщики вроде Nsight Compute показывают достигнутую загрузку рядом с вашим ядром. Это число — отправная точка для настройки.

Быстрая проверка

Подумайте, что на самом деле измеряет загрузка.

Итоги

Вы узнали, что загрузка — это отношение активных варпов к максимуму SM; она измеряется в варпах и помогает скрывать задержку. 🚀

Можно начать бесплатно

Изучай C++ с ИИ-репетитором — бесплатно

Пиши и запускай код прямо в браузере, получай мгновенную помощь от ИИ-репетитора 24/7 и продолжи учиться на сайте или в приложении.

Курсы
30
Уроки
120

Часто задаваемые вопросы

Урок «Что на самом деле означает заполненность» бесплатный?

Да — полный текст урока «Что на самом деле означает заполненность» бесплатно доступен здесь в веб-версии. Чтобы практиковать его интерактивно (встроенный редактор кода и ИИ-репетитор 24/7) и разблокировать остальной курс CUDA Academy, подпишись на CoddyKit PRO. Курс CUDA Academy содержит 4 уроков всего.

Чему я научусь в уроке «Что на самом деле означает заполненность»?

Сравнение активных варпов с максимальным числом для SM. Ты практикуешь CUDA Academy с помощью реального кода, который запускаешь прямо в браузере, и ИИ-репетитор 24/7 отвечает на твои вопросы во время урока.

Нужен ли мне опыт, чтобы начать CUDA Academy?

Предыдущий опыт не требуется. CUDA Academy на CoddyKit структурирован для всех уровней — от новичков до продвинутых, поэтому ты можешь начать отсюда или с самого начала и учиться в своем темпе. Это урок 1 из 4.

Сколько времени занимает урок «Что на самом деле означает заполненность»?

Большинство уроков CoddyKit занимают около 5–10 минут. Каждый из них компактный и интерактивный, поэтому ты постоянно делаешь прогресс и продолжаешь с того же места в веб-версии и приложении.

Можно ли писать и запускать код в этом уроке CUDA Academy?

Да. Каждый урок CUDA Academy включает встроенный редактор кода, поэтому ты пишешь и запускаешь реальный код прямо в браузере и получаешь моментальную обратную связь от AI — локальная установка не требуется.

Все уроки этого курса

  1. Что на самом деле означает заполненность
  2. Ограничения регистров и общей памяти
  3. API для расчёта заполненности
  4. Заполненность — не всё
← Назад к CUDA Academy