CUDA Academy · 강의

기본 인덱스 공식

blockIdx.x * blockDim.x + threadIdx.x.

레슨 1/413개 단계

기본 인덱스 공식은(는) CoddyKit의 무료 CUDA Academy 강의입니다. 이것은 4개 중 1번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 CUDA Academy 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. CUDA Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

스레드 하나, 요소 하나

CUDA 커널의 핵심은 모든 스레드가 데이터 조각 하나를 처리하는 것입니다. 그러려면 각 스레드에 고유한 전역 인덱스가 필요합니다.

로컬 ID만으로는 부족한 이유

블록 내부에서 threadIdx.x는 0부터 blockDim에서 1을 뺀 값까지만 셉니다. 여러 블록이 같은 작은 숫자를 재사용하므로 최종 인덱스로 사용할 수 없습니다.

블록은 나란히 배치됩니다

그리드를 끝과 끝이 맞닿은 블록들로 이루어진 것으로 생각해 보십시오. 각 블록은 배열의 연속된 구간을 담당하며, blockIdx.x가 현재 어느 구간에 있는지 알려 줍니다.

블록의 너비는 얼마일까요?

blockDim.x는 블록당 스레드 수입니다. 각 구간의 너비이므로 블록 오프셋을 올바른 위치로 확장하는 데 사용됩니다.

기본 공식

세 값을 결합하십시오. 앞선 블록들을 건너뛴 다음 현재 블록 안에서 자신의 위치를 더합니다. 이 한 줄로 모든 스레드에 고유한 인덱스가 부여됩니다.

int i = blockIdx.x * blockDim.x + threadIdx.x;

단계별로 살펴보기

블록당 스레드가 4개라면 블록 0은 0부터 3, 블록 1은 4부터 7, 블록 2는 8부터 11을 담당합니다. 오프셋은 서로 겹치지 않습니다.

구체적인 예

blockDim이 256일 때 블록 3의 스레드 2는 3 곱하기 256 더하기 2인 770에 도달합니다. 이것이 데이터에서 해당 스레드의 전역 위치입니다.

// blockIdx.x=3, blockDim.x=256, threadIdx.x=2
int i = 3 * 256 + 2; // i == 770

인덱스 사용하기

i를 얻은 뒤에는 이를 배열 첨자로 취급합니다. 각 스레드는 겹치지 않도록 자신의 요소만 읽고 씁니다.

out[i] = a[i] + b[i];

일대일로 매핑됩니다

n개의 스레드를 실행하면 공식은 0부터 n에서 1을 뺀 값까지의 모든 값을 정확히 한 번씩 만듭니다. 배열 전체를 완벽하게 일대일로 덮는 것입니다.

순서가 중요합니다

항상 더하기 전에 곱하십시오. blockIdx.x * blockDim.x는 구간의 시작점이고, threadIdx.x는 그 안에서의 위치입니다.

1차원을 넘어

같은 개념을 .y 및 .z 멤버를 사용해 2차원과 3차원으로 확장할 수 있지만, 평탄한 배열에서는 .x 공식만 있으면 됩니다. 🚀

빠른 확인

한 스레드의 전역 인덱스를 계산해 보십시오.

복습

모든 커널에서 사용하는 공식을 배웠습니다. blockIdx.x * blockDim.x + threadIdx.x는 각 스레드에 배열 안의 고유한 슬롯 하나를 할당합니다. 🎉

무료로 시작

AI 튜터와 함께 C++을(를) 배우세요 — 무료

브라우저에서 실제 코드를 작성하고 실행하며, 24/7 AI 튜터로부터 즉각적인 도움을 받고, 웹이나 앱에서 중단한 부분부터 계속 학습하세요.

코스
30
레슨
120

자주 묻는 질문

“기본 인덱스 공식” 강의는 무료인가요?

네 — “기본 인덱스 공식” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 CUDA Academy 강의 전체를 잠금 해제할 수 있습니다. CUDA Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

“기본 인덱스 공식”에서 뭘 배우나요?

blockIdx.x * blockDim.x + threadIdx.x. 브라우저에서 직접 실행하는 실습 코드로 CUDA Academy을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.

CUDA Academy을(를) 시작하는 데 경험이 필요한가요?

사전 경험은 필요하지 않습니다. CoddyKit의 CUDA Academy은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 1번째 강의입니다.

“기본 인덱스 공식” 강의는 얼마나 걸리나요?

대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.

이 CUDA Academy 강의에서 코드를 작성하고 실행할 수 있나요?

네. 모든 CUDA Academy 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.

이 강의의 모든 강의

  1. 기본 인덱스 공식
  2. 범위를 벗어나지 않도록 보호하기
  3. 블록 수 올림 처리하기
  4. 그리드 보폭 반복문
← CUDA Academy(으)로 돌아가기