고유한 값 세기
COUNT(DISTINCT ...)를 실제로 사용해 봅니다.
고유한 값 세기은(는) CoddyKit의 무료 SQL Academy 강의입니다. 이것은 4개 중 4번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 SQL Academy 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. SQL Academy 강의에는 총 4개의 강의가 포함되어 있습니다.
고유 값을 세는 이유
COUNT(*)를 사용하면 중복을 포함한 모든 행을 셉니다. 하지만 때로는 열에 고유한 값이 몇 개 있는지만 알고 싶을 때가 있습니다.
예를 들어 고객이 어느 국가에서 왔는지, 지난달에 몇 개의 고유 제품이 주문되었는지 알고 싶을 수 있습니다. 이럴 때 COUNT(DISTINCT ...)를 사용합니다.
샘플 테이블 설정하기
연습을 위해 주문 테이블을 만들어 보겠습니다. 각 주문에는 고객 이름, 제품, 국가가 있습니다.
일부 고객과 국가가 두 번 이상 나타나는 것을 확인할 수 있습니다. 모든 행을 세는 것과 고유 값을 세는 것의 차이를 확인하기 위한 의도적인 구성입니다.
CREATE TABLE orders (
id INT,
customer VARCHAR(50),
product VARCHAR(50),
country VARCHAR(50)
);
INSERT INTO orders VALUES
(1, 'Alice', 'Laptop', 'USA'),
(2, 'Bob', 'Phone', 'UK'),
(3, 'Alice', 'Tablet', 'USA'),
(4, 'Carol', 'Laptop', 'Canada'),
(5, 'Bob', 'Laptop', 'UK'),
(6, 'Dave', 'Phone', 'USA'),
(7, 'Carol', 'Phone', 'Canada'),
(8, 'Eve', 'Tablet', 'Germany');COUNT(*)와 COUNT(DISTINCT) 비교
두 쿼리를 실행하고 결과를 비교해 보세요. COUNT(*)는 각 행에 하나씩 대응하므로 8을 반환합니다. COUNT(DISTINCT 고객)은 고유한 고객이 5명뿐이므로 5를 반환합니다(앨리스, 밥, 캐럴, 데이브, 이브).
핵심 개념은 다음과 같습니다. COUNT(DISTINCT column)은 반복되는 값을 무시하고 고유한 값만 셉니다.
SELECT COUNT(*) AS total_orders,
COUNT(DISTINCT customer) AS unique_customers
FROM orders;고유한 국가 세기
고객이 어느 국가에서 왔는지에 따라 몇 개의 국가가 있는지 알아보겠습니다. 주문 테이블에는 8개의 행이 있지만 여러 행이 같은 국가를 공유합니다.
각 국가가 몇 번 나타나는지와 관계없이 결과는 4입니다. USA, UK, 캐나다, 독일입니다.
SELECT COUNT(DISTINCT country) AS unique_countries
FROM orders;고유한 제품 세기
같은 패턴을 모든 열에 적용할 수 있습니다. 여기서는 주문된 제품이 몇 종류인지 셉니다.
‘노트북’이 세 번, ‘휴대전화’가 세 번 나타나더라도 각 제품은 한 번만 계산됩니다. 답은 3입니다. 노트북, 휴대전화, 태블릿입니다.
SELECT COUNT(DISTINCT product) AS unique_products
FROM orders;WHERE와 함께 COUNT(DISTINCT) 사용하기
COUNT(DISTINCT ...)를 WHERE 절과 결합하면 세기 전에 행의 범위를 좁힐 수 있습니다. 여기서는 USA 고객이 주문한 고유 제품만 셉니다.
국가 = 'USA'인 행만 고려한 다음 해당 행에서 고유한 제품을 셉니다.
SELECT COUNT(DISTINCT product) AS usa_unique_products
FROM orders
WHERE country = 'USA';GROUP BY와 함께 COUNT(DISTINCT) 사용하기
GROUP BY와 함께 사용하면 COUNT(DISTINCT ...)로 그룹별 고유 개수를 구할 수 있습니다. 이 쿼리는 각 국가에서 몇 명의 고유 고객이 주문했는지에 대한 답을 제공합니다.
각 그룹은 독립적으로 처리되므로 개수를 세기 전에 그룹 내 중복이 제거됩니다.
SELECT country,
COUNT(DISTINCT customer) AS unique_customers
FROM orders
GROUP BY country
ORDER BY unique_customers DESC;여러 열에서 고유 값 세기
하나의 SELECT에서 여러 COUNT(DISTINCT ...) 표현식을 사용할 수 있습니다. 이를 통해 각 열이 보유한 고유 값의 개수인 카디널리티를 한 쿼리에서 빠르게 파악할 수 있습니다.
카디널리티는 새로운 데이터 집합을 탐색할 때 유용한 지표입니다.
SELECT COUNT(DISTINCT customer) AS unique_customers,
COUNT(DISTINCT product) AS unique_products,
COUNT(DISTINCT country) AS unique_countries
FROM orders;NULL 처리 방식
일반적인 COUNT(column)과 마찬가지로 COUNT(DISTINCT column)은 NULL 값을 무시합니다. NULL은 고유한 값으로 계산되지 않습니다.
이 예에서는 두 행의 국가가 NULL입니다. 따라서 결과는 5개가 아니라 NULL이 아닌 고유한 국가 4개입니다.
INSERT INTO orders VALUES
(9, 'Frank', 'Phone', NULL),
(10, 'Grace', 'Laptop', NULL);
SELECT COUNT(DISTINCT country) AS unique_countries_no_null
FROM orders;COUNT(*), COUNT(열), COUNT(DISTINCT 열) 비교
세 가지 COUNT 형식을 나란히 살펴보면 도움이 됩니다:
- COUNT(*) — NULL을 포함한 모든 행을 셉니다.
- COUNT(국가) — 국가가 NULL이 아닌 행을 셉니다.
- COUNT(DISTINCT 국가) — NULL이 아닌 고유한 국가 값을 셉니다.
업데이트된 테이블(이제 10개 행이며 그중 2개의 국가가 NULL임)에 이 쿼리를 실행하여 차이를 확인해 보세요.
SELECT COUNT(*) AS total_rows,
COUNT(country) AS non_null_countries,
COUNT(DISTINCT country) AS unique_countries
FROM orders;실제 활용 사례: 일일 활성 사용자
분석에서 COUNT(DISTINCT ...)를 사용하는 가장 일반적인 사례 중 하나는 일일 활성 사용자(DAU)를 세는 것입니다. 이벤트 기록이 있을 때 매일 활동한 고유 사용자가 몇 명인지 알고 싶을 수 있습니다.
날짜로 GROUP BY하고 COUNT(DISTINCT 사용자 식별자)를 사용하면 일별 고유 사용자 수를 구할 수 있습니다. 같은 사용자가 여러 번 클릭하여 생기는 중복은 자동으로 제외됩니다.
CREATE TABLE user_events (
event_date DATE,
user_id INT
);
INSERT INTO user_events VALUES
('2024-01-01', 1), ('2024-01-01', 2), ('2024-01-01', 1),
('2024-01-02', 2), ('2024-01-02', 3), ('2024-01-02', 2),
('2024-01-03', 1), ('2024-01-03', 4);
SELECT event_date,
COUNT(DISTINCT user_id) AS daily_active_users
FROM user_events
GROUP BY event_date
ORDER BY event_date;빠른 확인
COUNT(DISTINCT ...)에 관한 다음 질문으로 이해도를 확인해 보세요.
강의 요약
잘하셨습니다! COUNT(DISTINCT ...)에 대해 배운 내용을 정리해 보겠습니다:
COUNT(DISTINCT column)은 열에서 NULL이 아닌 고유한 값만 셉니다.COUNT(*)(모든 행) 및COUNT(column)(NULL이 아닌 행)과는 다릅니다.- WHERE와 함께 사용하여 세기 전에 행을 필터링할 수 있습니다.
- GROUP BY와 함께 사용하여 그룹별 고유 값을 셀 수 있습니다.
- NULL 값은 고유 개수에서 항상 제외됩니다.
- 하나의 SELECT에 여러
COUNT(DISTINCT ...)표현식을 포함할 수 있습니다. - 일반적인 실제 활용 사례로는 고유 사용자, 제품, 국가 및 세션 수 세기가 있습니다.
이 함수를 능숙하게 사용하면 데이터 탐색과 분석을 위한 강력한 도구를 얻을 수 있습니다.
자주 묻는 질문
“고유한 값 세기” 강의는 무료인가요?
네 — “고유한 값 세기” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 SQL Academy 강의 전체를 잠금 해제할 수 있습니다. SQL Academy 강의에는 총 4개의 강의가 포함되어 있습니다.
“고유한 값 세기”에서 뭘 배우나요?
COUNT(DISTINCT ...)를 실제로 사용해 봅니다. 브라우저에서 직접 실행하는 실습 코드로 SQL Academy을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.
SQL Academy을(를) 시작하는 데 경험이 필요한가요?
사전 경험은 필요하지 않습니다. CoddyKit의 SQL Academy은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 4번째 강의입니다.
“고유한 값 세기” 강의는 얼마나 걸리나요?
대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.
이 SQL Academy 강의에서 코드를 작성하고 실행할 수 있나요?
네. 모든 SQL Academy 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.