Azure Monitor 메트릭 및 경고
VM과 App Service의 플랫폼 메트릭을 수집하고, 정적 및 동적 임계값 경고를 구성하며, 이메일과 웹후크를 통해 작업 그룹으로 경고 알림을 전달합니다.
Azure Monitor 메트릭 및 경고은(는) CoddyKit의 무료 Azure Fundamentals 강의입니다. 이것은 4개 중 1번째 강의입니다. 아래에서 전체 강의를 무료로 읽을 수 있으며, 내장 코드 에디터와 24/7 AI 튜터와 함께 브라우저에서 직접 실습할 수 있습니다. 이 강의는 Azure Fundamentals 학습 경로의 일부이며, 진행 상황이 웹과 CoddyKit 앱에 동기화됩니다. Azure Fundamentals 강의에는 총 4개의 강의가 포함되어 있습니다.
Azure Monitor란 무엇인가요
Azure 모니터는 모든 Azure 리소스를 위한 통합 관찰 가능성 플랫폼입니다. 배포하는 모든 서비스에서 메트릭(시간에 따른 수치 데이터)과 로그(이벤트의 구조화된 기록)를 수집합니다. Azure 모니터가 없으면 성능 저하나 용량 문제를 사용자에게 영향을 주기 전에 감지할 수 없어 상황을 파악하지 못한 채 운영하게 됩니다.
플랫폼 메트릭 이해하기
플랫폼 메트릭은 추가 비용 없이 모든 Azure 리소스에 대해 자동으로 수집됩니다. 가상 머신의 경우 Azure 모니터는 Percentage CPU, Network In, Network Out, Disk Read Bytes 등을 수집합니다. 이러한 메트릭은 메트릭 저장소에 1분 단위로 93일 동안 저장됩니다. 메트릭을 확인하기 위해 에이전트를 설치하거나 별도로 구성할 필요가 없습니다.
# View available metrics for a VM via Azure CLI
az monitor metrics list-definitions \
--resource /subscriptions/<sub-id>/resourceGroups/<rg>/providers/Microsoft.Compute/virtualMachines/<vm-name> \
--output tableMetrics Explorer에서 메트릭 보기
Azure 포털의 Metrics Explorer를 사용하면 모든 플랫폼 메트릭을 대화형 차트로 표시할 수 있습니다. 리소스를 선택하고 메트릭 네임스페이스를 선택한 다음 메트릭과 집계 유형(Average, Maximum, Minimum, Count 또는 Sum)을 선택하십시오. 여러 메트릭을 겹쳐 표시하거나, 차원을 기준으로(예: 디스크 또는 네트워크 인터페이스별) 나누어 표시하거나, 차트를 Azure Dashboard에 고정할 수 있습니다.
정적 임계값 경고
메트릭 경고 규칙은 정의된 평가 기간 동안 메트릭이 고정된 임계값을 넘으면 트리거됩니다. 예를 들어 Percentage CPU가 5분 연속으로 85%를 초과하면 경고를 발생시킬 수 있습니다. 경고 규칙은 대상 리소스, 조건, 경고가 발생했을 때 수행할 작업을 정의하는 작업 그룹으로 구성됩니다.
# Create a static CPU alert via CLI
az monitor metrics alert create \
--name 'High-CPU-Alert' \
--resource-group myRG \
--scopes /subscriptions/<sub>/resourceGroups/myRG/providers/Microsoft.Compute/virtualMachines/myVM \
--condition 'avg Percentage CPU > 85' \
--window-size 5m \
--evaluation-frequency 1m \
--action myActionGroup동적 임계값 경고
동적 임계값은 머신 러닝을 사용하여 과거 동작을 기반으로 경고 경계를 자동 설정합니다. CPU 백분율을 하드코딩하는 대신 Azure 모니터가 메트릭의 정상적인 패턴을 학습하고 값이 크게 벗어날 때만 경고를 발생시킵니다. 이를 통해 시간대나 요일에 따라 정상 수준이 달라지는 메트릭에서 오탐을 줄일 수 있습니다. 민감도를 Low, Medium 또는 High로 설정하십시오.
작업 그룹
작업 그룹은 경고가 발생했을 때 실행되는 알림과 자동화된 작업을 정의합니다. 지원되는 알림 유형에는 Email/SMS/Push, Voice, Azure 앱 알림이 있습니다. 자동화된 작업으로는 Azure Function 호출, Logic App 게시, 웹훅 트리거, Automation Runbook 실행 등이 있습니다. 하나의 작업 그룹을 여러 경고 규칙에서 공유할 수 있습니다.
# Create an action group with email notification
az monitor action-group create \
--name 'OpsTeam' \
--resource-group myRG \
--action email 'ops-lead' 'ops@example.com'경고 심각도 수준
모든 경고 규칙에는 Sev 0(Critical)부터 Sev 4(Verbose)까지의 심각도가 할당됩니다. 심각도는 경고가 발생하는 시점에 영향을 주지 않으며, 운영 팀이 인시던트의 우선순위를 정하고 분류하는 데 사용하는 메타데이터입니다. 일반적으로 Sev 0 및 Sev 1 경고에만 당직 엔지니어를 호출하고, Sev 2는 티켓 대기열로 전달하며, Sev 3~4는 정보 제공용으로 처리하는 것이 좋습니다.
활동 로그 경고
활동 로그 경고는 메트릭이 아니라 Azure 활동 로그에 기록된 관리 작업을 기준으로 발생합니다. 누군가 리소스 그룹을 삭제하거나, 네트워크 보안 그룹 규칙을 변경하거나, VM을 다시 시작할 때 알림을 받는 데 사용하십시오. 메트릭 경고와 동일한 방식으로 구성하지만, 작업 이름이나 리소스 유형과 같은 활동 로그 조건을 대상으로 합니다.
# Alert when any VM in a resource group is deleted
az monitor activity-log alert create \
--name 'VM-Delete-Alert' \
--resource-group myRG \
--condition category=Administrative operationName=Microsoft.Compute/virtualMachines/delete \
--action-group myActionGroup경고 상태 및 경고 처리 규칙
경고 인스턴스는 세 가지 상태를 거칩니다: 발화됨 → 확인됨 → 해결됨. 경고 처리 규칙(이전의 억제 규칙)을 사용하면 예약된 유지 관리 기간 동안 알림을 억제하거나, 범위에 일치하는 모든 경고에 작업 그룹을 추가할 수 있습니다. 각 경고 규칙을 개별적으로 수정할 필요가 없습니다. 이는 배포 중 경고 알림 과다를 관리하는 데 필수적입니다.
PaaS 서비스의 메트릭 경고
플랫폼 메트릭은 VM에만 적용되지 않습니다. App Service는 Http5xx, RequestCount, AverageResponseTime을 제공합니다. Azure SQL Database는 cpu_percent와 dtu_consumption_percent를 제공합니다. Azure Storage는 UsedCapacity와 Transactions를 제공합니다. 이러한 모든 서비스에 동일한 메트릭 경고 모델을 적용할 수 있으므로 리소스 유형과 관계없이 일관된 모니터링 방식을 사용할 수 있습니다.
# Alert on App Service HTTP 5xx errors
az monitor metrics alert create \
--name 'AppService-5xx-Alert' \
--resource-group myRG \
--scopes /subscriptions/<sub>/resourceGroups/myRG/providers/Microsoft.Web/sites/myApp \
--condition 'total Http5xx > 10' \
--window-size 5m \
--evaluation-frequency 1m \
--action myActionGroup다중 리소스 경고
Azure Monitor는 구독 또는 리소스 그룹에서 동일한 유형의 모든 리소스에 단일 규칙을 적용하는 다중 리소스 메트릭 경고를 지원합니다. 예를 들어 하나의 경고 규칙으로 리소스 그룹의 모든 VM에서 높은 CPU 사용률을 모니터링할 수 있습니다. VM마다 하나의 규칙을 만드는 방식과 비교하면 관리해야 하는 규칙 수를 크게 줄일 수 있습니다. 다중 리소스 경고의 범위는 리소스 그룹 또는 구독과 특정 리소스 유형으로 지정됩니다.
빠른 확인
이 단원에서 다룬 Microsoft Azure Fundamentals (AZ-900) 개념을 얼마나 이해했는지 테스트해 보십시오.
단원 복습
이 단원에서는 다음을 배웠습니다. Azure Monitor는 모든 Azure 리소스에서 플랫폼 메트릭을 자동으로 수집하고, 메트릭 경고 규칙은 정적 또는 동적 임계값에 따라 트리거되어 작업 그룹을 통해 팀에 알림을 보내며, 활동 로그 경고는 리소스 삭제와 같은 관리 작업이 수행될 때 발생합니다. 다음 단원에서는 구조화된 로그 데이터를 쿼리하는 Log Analytics와 KQL을 살펴봅니다.
자주 묻는 질문
“Azure Monitor 메트릭 및 경고” 강의는 무료인가요?
네 — “Azure Monitor 메트릭 및 경고” 전체 내용을 이 웹사이트에서 무료로 읽을 수 있습니다. 인터랙티브하게 실습하려면(내장 코드 에디터와 24/7 AI 튜터), CoddyKit PRO로 업그레이드하면 Azure Fundamentals 강의 전체를 잠금 해제할 수 있습니다. Azure Fundamentals 강의에는 총 4개의 강의가 포함되어 있습니다.
“Azure Monitor 메트릭 및 경고”에서 뭘 배우나요?
VM과 App Service의 플랫폼 메트릭을 수집하고, 정적 및 동적 임계값 경고를 구성하며, 이메일과 웹후크를 통해 작업 그룹으로 경고 알림을 전달합니다. 브라우저에서 직접 실행하는 실습 코드로 Azure Fundamentals을(를) 배우며, 24/7 AI 튜터가 강의를 진행하면서 질문에 답변해줍니다.
Azure Fundamentals을(를) 시작하는 데 경험이 필요한가요?
사전 경험은 필요하지 않습니다. CoddyKit의 Azure Fundamentals은(는) 초급자부터 고급 학습자까지를 위해 구성되어 있으므로, 여기서 시작하거나 처음부터 시작할 수 있으며 자신의 속도대로 진행할 수 있습니다. 이것은 4개 중 1번째 강의입니다.
“Azure Monitor 메트릭 및 경고” 강의는 얼마나 걸리나요?
대부분의 CoddyKit 강의는 약 5~10분이 소요됩니다. 각 강의는 간결하고 인터랙티브하여 꾸준한 진행이 가능하며, 웹과 앱에서 중단한 부분부터 바로 시작할 수 있습니다.
이 Azure Fundamentals 강의에서 코드를 작성하고 실행할 수 있나요?
네. 모든 Azure Fundamentals 강의에는 내장 코드 에디터가 포함되어 있으므로, 브라우저에서 바로 실제 코드를 작성하고 실행한 후 즉시 AI 피드백을 받을 수 있습니다 — 로컬 설정이 필요 없습니다.
이 강의의 모든 강의
- Azure Monitor 메트릭 및 경고
- Log Analytics 및 KQL 기초
- Application Insights
- Azure 대시보드 및 통합 문서