0Pricing
SQL Academy · 강의

단일 GROUP BY를 넘어

여러 수준에서 집계합니다.

단일 GROUP BY를 넘어은(는) CoddyKit의 무료 SQL Academy 강의입니다. 이것은 4개 중 1번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 SQL Academy 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. SQL Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

단일 GROUP BY의 한계

표준 GROUP BY 절을 사용하면 한 가지 특정 수준에서 행을 집계할 수 있습니다. 예를 들어 지역별 총매출을 구할 수 있습니다. 그렇다면 같은 쿼리에서 제품 범주별 합계와 전체 합계도 함께 구하려면 어떻게 해야 할까요?

쿼리를 세 번 반복하고 UNION ALL을 사용하는 방법도 있지만 장황하고 느립니다. SQL은 이 문제를 한 번의 처리로 깔끔하게 해결하는 세 가지 강력한 확장 기능인 GROUPING SETS, ROLLUP, CUBE를 제공합니다.

SELECT region, SUM(amount) AS total_sales
FROM sales
GROUP BY region;

예제 테이블 설정

이 수업 전체에서 각 판매 내역에 지역, 카테고리, 금액을 기록하는 간단한 sales 테이블을 사용하겠습니다. 테이블을 생성하고 데이터를 입력하여 앞으로 나올 모든 쿼리를 맥락에 맞게 이해할 수 있도록 하겠습니다.

CREATE TABLE sales (
  id       SERIAL PRIMARY KEY,
  region   TEXT,
  category TEXT,
  amount   NUMERIC
);

INSERT INTO sales (region, category, amount) VALUES
  ('North', 'Electronics', 1200),
  ('North', 'Clothing',     800),
  ('South', 'Electronics',  950),
  ('South', 'Clothing',     600),
  ('East',  'Electronics', 1100),
  ('East',  'Clothing',     750);

GROUPING SETS란 무엇인가요?

GROUPING SETS를 사용하면 하나의 GROUP BY 절 안에서 여러 개의 독립적인 그룹화 수준을 정의할 수 있습니다. 목록의 각 세트는 별도의 쿼리를 작성한 다음 UNION ALL로 결합한 것처럼 자체 행 그룹을 생성합니다.

구문은 다음과 같습니다: GROUP BY GROUPING SETS ( (col1, col2), (col1), () ). 빈 세트 ()는 모든 행의 총합을 나타냅니다.

SELECT region, category, SUM(amount) AS total
FROM sales
GROUP BY GROUPING SETS (
  (region, category),
  (region),
  ()
);

GROUPING SETS 출력 읽기

GROUPING SETS 쿼리를 실행하면 서로 다른 그룹화 수준의 행이 한데 쌓입니다. 특정 세트에 포함되지 않은 열은 해당 행에서 NULL로 표시됩니다.

예를 들어 (region) 세트에 속한 행의 category 열은 NULL입니다. 이는 해당 지역의 모든 카테고리를 포함하는 총합임을 나타냅니다. 총합 행(빈 세트)에서는 region과 category가 모두 NULL입니다.

SELECT
  COALESCE(region,   'ALL REGIONS')   AS region,
  COALESCE(category, 'ALL CATEGORIES') AS category,
  SUM(amount) AS total
FROM sales
GROUP BY GROUPING SETS (
  (region, category),
  (region),
  ()
)
ORDER BY region NULLS LAST, category NULLS LAST;

ROLLUP 소개

ROLLUP은 자주 사용하는 계층 구조의 그룹화 세트를 간단히 표현하는 방법입니다. 열 (A, B)가 주어지면 ROLLUP(A, B)는 자동으로 (A, B), (A), () 세트를 생성합니다.

이는 연도에서 월, 일로 이어지는 데이터나 지역에서 카테고리로 이어지는 계층형 데이터에 적합합니다. 생성되는 세트의 수는 항상 나열된 열의 개수를 나타내는 n에 1을 더한 n + 1개입니다.

-- ROLLUP(region, category) is equivalent to:
-- GROUPING SETS ( (region, category), (region), () )

SELECT region, category, SUM(amount) AS total
FROM sales
GROUP BY ROLLUP(region, category)
ORDER BY region NULLS LAST, category NULLS LAST;

3단계 ROLLUP

ROLLUP에 세 번째 열을 추가하면 계층 구조가 한 단계 더 확장됩니다. ROLLUP(A, B, C)는 네 개의 세트 (A, B, C), (A, B), (A), ()를 생성합니다.

아래 예제에서는 year가 가장 바깥쪽 수준이고 category가 가장 세분화된 수준입니다. 쿼리는 계층 구조의 각 단계에 대한 소계와 총합 행 하나를 생성합니다.

SELECT
  year,
  region,
  category,
  SUM(amount) AS total
FROM (
  VALUES
    (2024, 'North', 'Electronics', 1200),
    (2024, 'North', 'Clothing',     800),
    (2024, 'South', 'Electronics',  950),
    (2025, 'North', 'Electronics', 1400),
    (2025, 'South', 'Clothing',     700)
) AS t(year, region, category, amount)
GROUP BY ROLLUP(year, region, category)
ORDER BY year NULLS LAST, region NULLS LAST, category NULLS LAST;

CUBE 소개

CUBE는 ROLLUP보다 훨씬 포괄적입니다. n개의 열이 주어지면 총합을 포함하여 그룹화 세트로 만들 수 있는 모든 2^n가지 조합을 생성합니다.

CUBE(region, category)가 생성하는 세트는 (region, category), (region), (category), ()이며, 총 네 개입니다. 단일 계층 구조가 아니라 모든 방향의 조합별 총합을 원할 때 유용합니다.

-- CUBE(region, category) produces:
-- GROUPING SETS ( (region,category), (region), (category), () )

SELECT region, category, SUM(amount) AS total
FROM sales
GROUP BY CUBE(region, category)
ORDER BY region NULLS LAST, category NULLS LAST;

CUBE와 ROLLUP 비교 — 언제 무엇을 사용할까요?

차원에 자연스러운 계층 구조가 있는지에 따라 선택하세요:

  • 열이 계층적일 때(예: 국가에서 도시, 매장으로 이어지는 구조) ROLLUP을 사용하세요. 소계는 하나의 경로를 따라서만 상위 수준으로 집계됩니다.
  • 열이 서로 독립적인 차원일 때(예: 지역과 카테고리) 그리고 가능한 모든 조합별 결과를 원할 때 CUBE를 사용하세요.
  • 세밀하게 제어해야 하고 ROLLUP이나 CUBE가 정확한 요구 사항에 맞지 않을 때 GROUPING SETS를 사용하세요.

GROUPING() 함수

NULL은 실제 누락된 값일 수도 있고 그룹화 자리 표시자일 수도 있으므로 SQL은 GROUPING() 함수를 제공합니다. 이 함수는 열이 상위 집계(자리 표시자) 행의 일부이면 1을 반환하고, 해당 열을 실제로 기준으로 그룹화했으면 0을 반환합니다.

이를 사용하면 실제 NULL인 지역 값과 모든 지역을 포함하는 소계 행을 구분할 수 있습니다.

SELECT
  region,
  category,
  SUM(amount)        AS total,
  GROUPING(region)   AS is_region_subtotal,
  GROUPING(category) AS is_category_subtotal
FROM sales
GROUP BY CUBE(region, category)
ORDER BY region NULLS LAST, category NULLS LAST;

GROUPING()으로 행에 레이블 지정

일반적인 방법은 GROUPING()을 CASE 식과 함께 사용하여 원시 NULL 값 대신 사람이 읽기 쉬운 레이블을 만드는 것입니다. 이렇게 하면 ROLLUP 또는 CUBE 쿼리의 출력을 보고서에서 훨씬 쉽게 읽을 수 있습니다.

SELECT
  CASE GROUPING(region)
    WHEN 1 THEN 'Grand Total'
    ELSE region
  END AS region_label,
  CASE GROUPING(category)
    WHEN 1 THEN 'All Categories'
    ELSE category
  END AS category_label,
  SUM(amount) AS total
FROM sales
GROUP BY ROLLUP(region, category)
ORDER BY GROUPING(region), region, GROUPING(category), category;

고정 열과 ROLLUP 함께 사용하기

같은 절에서 일반 GROUP BY 열과 ROLLUP 또는 CUBE를 함께 사용할 수 있습니다. ROLLUP(...) 바깥에 나열된 열은 모든 그룹화 세트에 항상 포함되며, 상위 수준으로 집계되지 않습니다.

아래 쿼리에서는 year가 고정 그룹화 열이고 region과 category가 롤업에 참여합니다. 따라서 모든 연도를 합친 결과가 아니라 연도별 소계를 얻습니다.

SELECT
  2024           AS year,
  region,
  category,
  SUM(amount)    AS total
FROM sales
GROUP BY 2024, ROLLUP(region, category)
ORDER BY region NULLS LAST, category NULLS LAST;

빠른 확인

GROUPING SETS, ROLLUP, CUBE에 대한 이해도를 확인해 보세요.

복습 — 단일 GROUP BY를 넘어

이번 수업에서는 하나의 쿼리에서 여러 집계 수준을 생성할 수 있게 해 주는 강력한 SQL 확장 기능 세 가지를 배웠습니다.

  • GROUPING SETS — 완전한 수동 제어를 제공하며, 필요한 조합을 정확히 나열합니다.
  • ROLLUP — 계층 구조에 적합하며, 가장 세부적인 수준에서 총합까지 순서대로 상위 수준으로 집계합니다.
  • CUBE — 나열된 차원으로 만들 수 있는 모든 조합별 결과를 생성합니다.

또한 GROUPING()은 실제 NULL 값과 상위 집계 자리 표시자 행을 구분하며, CASE GROUPING(...) 패턴을 사용하면 깔끔하고 읽기 쉬운 보고서 출력을 만들 수 있다는 것도 배웠습니다.

다차원 요약이 필요할 때 이러한 도구는 없어서는 안 됩니다. 피벗 형식 보고서, 대시보드, 데이터 웨어하우스 쿼리는 모두 이러한 도구를 광범위하게 사용합니다.

자주 묻는 질문

“단일 GROUP BY를 넘어” 강의는 무료인가요?

네 — “단일 GROUP BY를 넘어” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 SQL Academy 강의 전체를 잠금 해제할 수 있습니다. SQL Academy 강의에는 총 4개의 강의가 포함되어 있습니다.

“단일 GROUP BY를 넘어”에서 뭘 배우나요?

여러 수준에서 집계합니다. 브라우저에서 직접 실행하는 실습 코드로 SQL Academy을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.

SQL Academy을(를) 시작하는 데 경험이 필요한가요?

사전 경험은 필요하지 않습니다. CoddyKit의 SQL Academy은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 1번째 강의입니다.

“단일 GROUP BY를 넘어” 강의는 얼마나 걸리나요?

대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.

이 SQL Academy 강의에서 코드를 작성하고 실행할 수 있나요?

네. 모든 SQL Academy 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.

이 강의의 모든 강의

  1. 단일 GROUP BY를 넘어
  2. 소계를 위한 ROLLUP
  3. 모든 조합을 위한 CUBE
  4. GROUPING SETS 설명
← SQL Academy(으)로 돌아가기