상태 확인 및 DNS 장애 조치
엔드포인트, 계산된 상태 확인 및 CloudWatch 경보 상태 확인을 설정하여 Route 53이 비정상 엔드포인트에서 트래픽을 자동으로 우회하도록 합니다.
상태 확인 및 DNS 장애 조치은(는) CoddyKit의 무료 Cloud & IT Cert Prep 강의입니다. 이것은 4개 중 4번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 Cloud & IT Cert Prep 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. Cloud & IT Cert Prep 강의에는 총 4개의 강의가 포함되어 있습니다.
Route 53 상태 확인이란 무엇인가요
Route 53 상태 확인은 웹 서버, 로드 밸런서 또는 인터넷에서 접근할 수 있는 HTTP/HTTPS/TCP 종단점 등 대상의 상태를 지속적으로 모니터링합니다. 상태 확인 결과를 기반으로 Route 53은 DNS 라우팅을 자동으로 업데이트하여 비정상 리소스로 트래픽이 전송되는 것을 방지할 수 있습니다.
상태 확인에는 확인 항목별 월별 요금이 부과됩니다. Route 53의 전역 상태 확인기(여러 Region에 위치)는 종단점을 동시에 점검하므로 상태 확인 자체에 중복성을 제공합니다. 확인기 중 설정된 임계값 수가 실패했다고 판단한 경우에만 종단점이 비정상으로 간주됩니다.
종단점 상태 확인
종단점 상태 확인은 선택한 프로토콜(HTTP, HTTPS 또는 TCP), 포트 및 선택적 경로를 사용하여 특정 IP 주소 또는 도메인 이름을 모니터링합니다. HTTP/HTTPS 확인의 경우 Route 53은 제한 시간 내에 종단점이 2xx 또는 3xx HTTP 상태 코드를 반환하는지 확인합니다. HTTPS 확인에서는 선택적으로 TLS 인증서의 유효성도 검사합니다.
주요 구성 옵션은 다음과 같습니다. 요청 간격(10초 또는 30초—10초는 더 빠르게 감지할 수 있지만 비용이 더 많이 듭니다), 실패 임계값(비정상으로 표시하기 전 연속 실패 횟수 1~10회), 문자열 일치(응답 본문에 특정 문자열이 포함되어 있는지 선택적으로 확인)입니다.
# Create an HTTP health check
aws route53 create-health-check \
--caller-reference hc-2026-06-20 \
--health-check-config '{
"Type": "HTTP",
"IPAddress": "54.100.1.1",
"Port": 80,
"ResourcePath": "/health",
"FailureThreshold": 3,
"RequestInterval": 30
}'계산된 상태 확인
계산된 상태 확인은 Boolean 논리(AND, OR, NOT)를 사용하여 여러 하위 상태 확인 결과를 결합합니다. 이를 통해 복잡한 라우팅 연쇄를 만들지 않고도 여러 신호를 기반으로 애플리케이션 수준의 상태를 정의할 수 있습니다.
예를 들어 웹 애플리케이션은 API 서버 확인과 데이터베이스 확인이 모두 통과한 경우에만 정상으로 간주할 수 있습니다. 두 종단점 확인을 참조하는 유형이 AND인 계산된 상태 확인을 생성합니다. 둘 중 하나라도 실패하면 계산된 상태 확인이 실패하고 Route 53은 연결된 DNS 레코드를 응답에서 제거합니다.
# Create a calculated health check (AND of two child checks)
aws route53 create-health-check \
--caller-reference hc-calc-2026 \
--health-check-config '{
"Type": "CALCULATED",
"ChildHealthChecks": [
"hc-api-id",
"hc-db-id"
],
"HealthThreshold": 2
}'CloudWatch 경보 상태 확인
CloudWatch 경보 상태 확인은 Route 53 상태 확인을 CloudWatch 경보의 상태에 연결합니다. 경보가 ALARM 상태이면 상태 확인이 비정상으로 표시되고, OK 또는 INSUFFICIENT_DATA이면 정상으로 표시됩니다.
이 패턴은 VPC 내부의 종단점(Route 53의 외부 상태 확인기가 접근할 수 없음)에 특히 유용합니다. 프라이빗 종단점을 직접 점검하는 대신 해당 종단점에 대한 CloudWatch 지표와 경보를 생성한 다음, 경보 상태를 기반으로 Route 53 상태 확인을 구성합니다. 또한 오류율이나 대기열 깊이와 같은 비즈니스 지표를 기반으로 상태를 확인할 수도 있습니다.
# Create a health check based on a CloudWatch alarm
aws route53 create-health-check \
--caller-reference hc-cw-2026 \
--health-check-config '{
"Type": "CLOUDWATCH_METRIC",
"AlarmIdentifier": {
"Region": "us-east-1",
"Name": "HighErrorRate-Alarm"
},
"InsufficientDataHealthStatus": "Healthy"
}'프라이빗 종단점 상태 확인
Route 53 상태 확인기는 VPC 외부에 있는 AWS 관리형 서버로, 공용 인터넷을 통해 종단점에 접근합니다. 프라이빗 서브넷의 리소스는 표준 종단점 상태 확인으로 접근할 수 없습니다. 프라이빗 종단점에는 다음 방법 중 하나를 사용하십시오.
- VPC 내부에서 사용자 지정 CloudWatch 지표를 게시하고(예: 애플리케이션의 성공/실패 신호), 경보를 생성한 다음 CloudWatch 경보 상태 확인을 사용합니다
- VPC 내부의 ELB, RDS 또는 애플리케이션 지표를 집계하는 CloudWatch 복합 경보를 사용합니다
이 패턴은 프라이빗 서브넷의 데이터베이스, 내부 로드 밸런서 및 백엔드 서비스에 매우 중요합니다.
상태 확인 상태 및 모니터링
Route 53 콘솔의 상태 확인에서 상태 확인 상태를 확인하거나 API를 통해 조회할 수 있습니다. Route 53은 AWS/Route53 네임스페이스에 상태 확인 지표를 게시하며, 여기에는 HealthCheckStatus(1 = 정상, 0 = 비정상)와 HealthCheckPercentageHealthy(종단점을 정상으로 보고하는 Route 53 확인기의 비율)가 포함됩니다.
HealthCheckStatus에 CloudWatch 경보를 설정하면 종단점이 비정상으로 전환될 때 SNS 알림을 받을 수 있습니다. 이를 통해 담당 운영 팀이 DNS 장애 조치가 이미 발생한 사실을 알아차리기 전에 상황을 파악할 수 있습니다.
# Get health check status
aws route53 get-health-check-status \
--health-check-id a1b2c3d4-e5f6-7890-abcd-ef1234567890 \
--query 'CheckerIpRanges'장애 조치 라우팅을 사용한 DNS 장애 조치
Route 53이 기본 레코드의 상태 확인이 실패했음을 감지하면 DNS 응답에서 기본 레코드를 제거하고 보조 대상의 주소를 반환합니다. 이를 DNS 장애 조치라고 합니다. 전환은 평가 기간(상태 확인기 실패 횟수 × 요청 간격)에 레코드의 TTL을 더한 시간 내에 발생합니다.
예를 들어 요청 간격이 30초, 실패 임계값이 3, TTL이 60초라면 최악의 경우 장애 조치 시간은 약 3 × 30 + 60 = 150초입니다. 더 낮은 TTL(예: 10초)과 더 빠른 상태 확인 간격(10초)을 설정하면 이를 3 × 10 + 10 = 40초로 줄일 수 있습니다.
가중치 및 지연 시간 레코드의 상태 확인
상태 확인은 장애 조치 레코드뿐 아니라 가중치 및 지연 시간 레코드에도 연결할 수 있습니다. 가중치 레코드의 상태 확인이 실패하면 Route 53은 정상인 가중치 레코드에 해당 레코드의 트래픽 가중치를 비례하여 재분배합니다. 지연 시간 레코드의 상태 확인이 실패하면 Route 53은 다음으로 지연 시간이 짧은 정상 레코드로 쿼리를 라우팅합니다.
이를 통해 명시적인 장애 조치 레코드 없이도 가중치 및 지연 시간 라우팅 정책이 종단점 장애에 대응할 수 있습니다. 이는 일반적인 SAA-C03 패턴입니다. 상태 확인을 사용하는 Region 간 지연 시간 라우팅은 성능 최적화와 자동 재해 복구를 모두 제공합니다.
상태 확인을 사용한 액티브-액티브 다중 Region
Route 53을 사용하는 복원력 있는 다중 Region 액티브-액티브 패턴은 다음과 같습니다.
- 각 Region(us-east-1, eu-west-1, ap-southeast-1)에 상태 확인이 연결된 지연 시간 레코드를 생성합니다
- 모든 Region이 정상인 경우 사용자는 지연 시간이 가장 짧은 Region으로 라우팅됩니다
- 한 Region의 상태 확인이 실패하면(애플리케이션이 중단되었거나 응답하지 않으면) Route 53은 해당 Region을 DNS 응답에서 자동으로 제거하고 다음으로 적합한 정상 Region으로 쿼리를 라우팅합니다
- 실패한 Region이 복구되면 상태 확인이 통과하고 Route 53은 해당 Region을 라우팅 순환에 다시 포함합니다
이를 통해 성능 최적화와 함께 자동 전역 장애 조치를 제공하며, 수동 개입이 필요하지 않습니다.
Route 53 상태 확인기의 IP 범위
Route 53 상태 확인기는 AWS IP 범위 JSON 파일의 ROUTE53_HEALTHCHECKS 섹션에 게시된 IP 범위 집합에서 요청을 보냅니다. 종단점이 인바운드 액세스를 제한하는 방화벽 또는 보안 그룹으로 보호되는 경우 상태 확인이 성공하도록 이러한 IP 범위의 트래픽을 허용해야 합니다.
또는 프라이빗 백엔드(예: ALB)로 프록시하는 퍼블릭 엔드포인트를 상태 확인에 사용할 수 있습니다. ALB의 보안 그룹은 Route 53 IP 범위만 허용하면 되고, 백엔드의 보안 그룹은 ALB 보안 그룹만 허용하면 되므로 심층 방어 방식을 유지할 수 있습니다.
# Fetch Route 53 health checker IP ranges
curl -s https://ip-ranges.amazonaws.com/ip-ranges.json | \
python3 -c "
import json,sys
data=json.load(sys.stdin)
ranges=[p['ip_prefix'] for p in data['prefixes'] if p['service']=='ROUTE53_HEALTHCHECKS']
print('\n'.join(ranges))
"상태 확인 모범 사례
Route 53 상태 확인의 모범 사례는 다음과 같습니다.
- 모든 핵심 종속성(데이터베이스 연결, 캐시 접근 가능 여부)을 확인하고 완전히 작동할 때만 200을 반환하는 전용 /health 종단점을 생성합니다
- 장애를 더 빠르게 감지할 수 있도록 중요한 프로덕션 종단점에는 10초 요청 간격을 사용합니다
- CloudWatch에서
HealthCheckPercentageHealthy를 모니터링합니다. 일부 Route 53 확인기만 실패하는 부분 장애는 Region 네트워크 문제나 간헐적인 문제를 나타낼 수 있습니다 - VPC 프라이빗 리소스에는 애플리케이션 지표를 기반으로 하는 CloudWatch 경보 상태 확인을 사용합니다
- 프로덕션에서 장애 조치에 의존하기 전에 비프로덕션 환경에서 이를 테스트합니다
빠른 확인
이 강의에서 다룬 AWS Solutions Architect(SAA-C03) 개념에 대한 이해도를 확인해 보십시오.
강의 요약
이 강의에서는 다음을 학습했습니다. 종단점 상태 확인은 외부 Route 53 확인기에서 HTTP/HTTPS/TCP를 점검하고, CloudWatch 경보 상태 확인은 프라이빗 VPC 리소스의 모니터링을 지원하며, 계산된 상태 확인은 Boolean 논리로 여러 신호를 결합합니다. DNS 장애 조치 속도는 상태 확인 간격, 실패 임계값 및 TTL에 따라 달라집니다. 다음에는 CloudFront 배포와 오리진을 살펴보겠습니다.
자주 묻는 질문
“상태 확인 및 DNS 장애 조치” 강의는 무료인가요?
네 — “상태 확인 및 DNS 장애 조치” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 Cloud & IT Cert Prep 강의 전체를 잠금 해제할 수 있습니다. Cloud & IT Cert Prep 강의에는 총 4개의 강의가 포함되어 있습니다.
“상태 확인 및 DNS 장애 조치”에서 뭘 배우나요?
엔드포인트, 계산된 상태 확인 및 CloudWatch 경보 상태 확인을 설정하여 Route 53이 비정상 엔드포인트에서 트래픽을 자동으로 우회하도록 합니다. 브라우저에서 직접 실행하는 실습 코드로 Cloud & IT Cert Prep을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.
Cloud & IT Cert Prep을(를) 시작하는 데 경험이 필요한가요?
사전 경험은 필요하지 않습니다. CoddyKit의 Cloud & IT Cert Prep은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 4번째 강의입니다.
“상태 확인 및 DNS 장애 조치” 강의는 얼마나 걸리나요?
대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.
이 Cloud & IT Cert Prep 강의에서 코드를 작성하고 실행할 수 있나요?
네. 모든 Cloud & IT Cert Prep 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.
이 강의의 모든 강의
- 호스팅 영역 및 DNS 레코드 유형
- 라우팅 정책: 단순, 가중치 기반 및 지연 시간 기반
- 장애 조치 및 지리적 위치 라우팅
- 상태 확인 및 DNS 장애 조치