이 문서에서는 관리형 인스턴스 그룹 (MIG)에서 가상 머신 (VM) 인스턴스 배포를 모니터링하는 이점, 사용 사례, 절차를 설명합니다. 절차에는 Cloud Monitoring에서 GCE MIG 인스턴스 배포 모니터링 대시보드를 보고, 맞춤설정하고, 쿼리하는 방법이 포함됩니다.
MIG에서 위치 유연성 을 사용하여 여러 영역에 인스턴스를 배포하거나, 인스턴스 유연성 을 사용하여 호환되는 여러 머신 유형을 지정하거나, 둘 다 사용하는 경우 MIG는 실시간 리소스 가용성을 기반으로 인스턴스를 동적으로 선택하고 프로비저닝합니다. 모든 MIG에서 런타임 시 이 동적 동작을 관찰하려면 GCE MIG 인스턴스 배포 모니터링 대시보드를 사용하면 됩니다. 이 사전 구성된 대시보드는 시간이 지남에 따라 인스턴스가 영역과 머신 유형에 어떻게 배포되는지 실시간으로 보여줍니다. 또한 대시보드에는 기간 동안 실행 중인(활성) 인스턴스와 실행 중이 아닌 (비활성) 인스턴스, 총 인스턴스 수가 표시됩니다. 예를 들어 대시보드 측정항목을 해석하여 용량 할당, 영역별 균형, 대체 동작을 진단할 수 있습니다.
MIG에서 인스턴스 배포 모니터링의 이점
MIG가 리전 그룹의 여러 영역에 인스턴스를 배포하거나 인스턴스 유연성 정책에서 여러 머신 유형과 순위를 지정하는 경우 위치 및 머신 유형의 실제 배포는 리소스 가용성에 따라 동적으로 변경됩니다.
런타임 인스턴스 배포를 모니터링하면 다음을 수행할 수 있습니다.
획득 가능성 개선 및 용량 제약조건 완화: 확장 시 MIG가 리소스를 성공적으로 획득하는지 확인합니다. 대체 순위에서 인스턴스를 생성하면 인스턴스 유연성 정책이 일시적인 용량 제약조건을 효율적으로 완화하고 있음을 알 수 있습니다. 하지만 이러한 대체에도 불구하고 그룹이 지속적으로 목표 크기에 도달하는 데 어려움을 겪는다면 허용되는 머신 유형을 확장하거나 영역을 추가하여 향후 리소스 가용성 오류가 발생할 가능성을 줄이는 것이 좋습니다.
위치 유연성 및 영역별 균형 확인: 리전 MIG가 의도한 대로 영역 간에 용량을 균형 있게 조정하는지 (
EVEN또는BALANCED) 확인하거나ANY또는ANY_SINGLE_ZONE목표 분산 형태를 사용할 때 영역 간에 용량이 동적으로 이동하는 방식을 관찰합니다.비용과 성능의 균형: 인스턴스 유연성이 있는 MIG에 선택된 머신 유형을 추적하면 지출과 성능을 더 잘 파악하고 개선 기회를 찾을 수 있습니다. 예를 들어 인스턴스가 워크로드에 필요한 것보다 지속적으로 더 높은 성능을 제공하는 경우 워크로드에서 비용이 낮은 옵션에 우선순위를 지정할 수 있는지 조사해 보세요. 또는 성능 문제가 발견되면 획득 가능성을 기반으로 더 많은 머신에 워크로드를 분산하는 대신 고성능 머신 유형에 우선순위를 지정하는 것이 좋습니다.
모니터링 대시보드가 관측 가능성 질문에 어떻게 도움이 되는지 자세히 알아보려면 이 문서에서 대시보드 해석을 참고하세요.
MIG 인스턴스 배포 모니터링
다음 방법 중 하나를 사용하여 MIG의 인스턴스 배포를 모니터링할 수 있습니다.
Cloud Monitoring 대시보드를 사용하여 인스턴스 배포를 시각적으로 표현합니다. 자세한 내용은 이 문서의 모니터링 대시보드 정보를 참고하세요.
기본 측정항목을 프로그래매틱 방식으로 쿼리 합니다. PromQL을 코드 기반 대안으로 사용하여 인스턴스 배포 데이터를 커스텀 관측 가능성 대시보드 또는 Grafana와 같은 외부 모니터링 도구에 통합할 수 있습니다. 자세한 내용은 이 문서에서 PromQL을 사용하여 프로그래매틱 방식으로 쿼리를 참고하세요.
모니터링 대시보드 정보
Cloud Monitoring은 Google 서비스 카테고리에서 사전 구성된 대시보드를 제공합니다. MIG의 경우 GCE MIG 인스턴스 배포 모니터링 대시보드는 다음과 같은 4가지 특수 차트를 제공합니다.
영역별 인스턴스 배포: 영역별로 그룹화된 인스턴스 수를 표시하는 차트로, 리전 전반의 위치 유연성과 영역별 배포를 보여줍니다.
머신 유형별 인스턴스 배포: 머신 유형별로 그룹화된 인스턴스 수를 표시하는 차트로, 그룹이 여러 머신 유형과 크기에 용량을 할당하는 방법 을 보여줍니다.
활성 인스턴스와 비활성 인스턴스: 활성 또는 비활성 여부에 따라 그룹화된 인스턴스 수를 표시하는 차트입니다. 활성 인스턴스는 완전히 작동하고 실행 중 (
RUNNING)입니다. 비활성 인스턴스는 실행 중이 아니지만 삭제되지 않은 인스턴스입니다. 여기에는 생성 중(PROVISIONING,STAGING), 일시중지 (SUSPENDED), 종료 (STOPPED,TERMINATED)된 인스턴스가 포함됩니다.총 인스턴스 수: 기간 동안 MIG의 총 인스턴스 수를 표시하는 차트입니다.
기본적으로 대시보드는 프로젝트의 모든 MIG에서 데이터를 집계합니다. 단일 MIG를 보려면 MIG (instance_group)로 필터링하면 됩니다. 프로젝트에 여러 위치에 동일한 이름의 MIG가 포함되어 있는 경우 리전(region) 또는 영역 (zone) 필터를 적용하여 특정 MIG를 타겟팅합니다.
GCE MIG 인스턴스 배포 모니터링 대시보드의 차트는 compute.googleapis.com/instance/cpu/utilization 및 metadata.system_labels.machine_type과 같은 표준 Compute Engine 시스템 메타데이터 라벨 및 측정항목을 사용합니다. 이러한 시스템 측정항목 및 메타데이터 라벨은 모든 Compute Engine 인스턴스에 대해 Cloud Monitoring에서 자동으로 수집됩니다. 이 대시보드에서 인스턴스 배포, 영역, 머신 유형 또는 상태 차트를 보려면 인스턴스 내에 운영 에이전트를 설치하거나 커스텀 게스트 원격 분석을 구성할 필요가 없습니다.
필요한 역할
-
콘솔을 사용하여 Google Cloud 대시보드를 보는 데 필요한 권한을 얻으려면 관리자에게 프로젝트에 대한 Monitoring 뷰어 (
roles/monitoring.viewer) IAM 역할을 부여해 달라고 요청하세요. 역할 부여에 대한 자세한 내용은 프로젝트, 폴더, 조직에 대한 액세스 관리를 참고하세요.커스텀 역할이나 다른 사전 정의된 역할을 통해 필요한 권한을 얻을 수도 있습니다.
역할에 대한 자세한 내용은 Identity and Access Management로 액세스 제어를 참고하세요.
대시보드 보기 및 맞춤설정
콘솔에서 GCE MIG 인스턴스 배포 모니터링 대시보드를 보고Google Cloud , 선택적으로 복사하여 맞춤설정하여 특정 리전, 영역 또는 MIG를 모니터링할 수 있습니다.
사전 구성된 GCE MIG 인스턴스 배포 모니터링 대시보드를 보려면 다음 단계를 따르세요.
콘솔에서 Google Cloud Monitoring > 대시보드 페이지로 이동합니다.
필터에서 GCE MIG 인스턴스 배포 모니터링 대시보드를 검색하고 대시보드를 선택합니다. 유형 메뉴 > Google 서비스 카테고리에서 이 대시보드를 찾을 수도 있습니다.
대시보드를 그대로 사용하거나 복사하여 추가로 맞춤설정할 수 있습니다.
선택사항: 대시보드를 맞춤설정하려면 먼저 대시보드를 복사한 후 다음과 같이 수정해야 합니다.
복사하려면 대시보드 복사 를 클릭합니다.
복사된 대시보드를 수정하고 필요에 따라 이름, 차트, 필터 적용, 커스텀 레이아웃 구조 구성을 수정합니다.
유형 메뉴 > 커스텀 카테고리에서 복사하거나 맞춤설정한 대시보드를 볼 수 있습니다.
대시보드 맞춤설정에 대한 자세한 내용은 Cloud Monitoring 문서의 다음 페이지를 참고하세요.
각 차트에 표시되는 데이터를 수정하려면 위젯의 쿼리 업데이트를 참고하세요.
대시보드를 맞춤설정하려면 서비스 대시보드를 복사하여 커스텀 대시보드 만들기 Google Cloud 를 참고하세요.
대시보드 필터 적용
GCE MIG 인스턴스 배포 모니터링 대시보드에는 MIG의 특정 하위 집합으로 드릴다운할 수 있는 기본 필터 변수가 포함되어 있습니다.
리전 (
region): 차트를 필터링하여 하나 이상의 특정 Google Cloud 리전에 있는 인스턴스를 표시합니다.영역 (
zone): 차트를 필터링하여 영역별 배포를 관찰하고 인스턴스가 균등하게 균형을 이루는지 또는 특정 영역 간에 용량이 이동하는지 확인합니다.인스턴스 그룹 (
instance_group): 프로젝트에 여러 MIG가 포함되어 있는 경우 차트를 필터링하여 단일 MIG를 격리합니다.
콘솔 Google Cloud 에서 필터를 적용하려면 복사된 대시보드 상단의 필터 버튼을 클릭하고 필터 속성 (예: region,
zone, 또는 instance_group)을 선택한 후 선택한 값을 선택합니다.
필터 사용에 대한 자세한 내용은 Cloud Monitoring 문서에서 커스텀 대시보드에 임시 필터 추가 를 참고하세요.
이벤트 주석 구성
영역 및 머신 유형 간의 인스턴스 배포 변경사항을 분석할 때 수명 주기 이벤트 또는 배포에 주석을 구성하면 용량 이동을 특정 운영 활동과 연결하는 데 도움이 됩니다. 예를 들어 차트 타임라인에 주석을 추가하여 다음과 같은 이벤트를 강조할 수 있습니다.
목표 분산 형태,
instanceSelections또는rank순서 수정과 같은 MIG 구성 업데이트그룹 내에서 시작된 순차적 업데이트 또는 인스턴스 복구
시뮬레이션된 영역별 서비스 중단 이벤트 또는 실제 영역별 서비스 중단 이벤트
자동 확장 처리 의사 결정
사용 가능한 이벤트 유형 및 주석을 추가하는 방법에 대한 자세한 내용은 Cloud Monitoring 문서의 다음 페이지를 참고하세요.
대시보드에 추가할 수 있는 이벤트 유형에 대해 자세히 알아보려면 Compute Engine 이벤트 유형을 참고하세요.
대시보드 차트에 주석 또는 오버레이 이벤트 마커를 추가하려면 이벤트를 표시하도록 대시보드 구성을 참고하세요.
대시보드 해석
MIG 인스턴스 배포 대시보드를 볼 때 다음 안내에 따라 일반적인 관측 가능성 질문에 답하고 동적 위치 및 머신 유형 동작을 해석하세요.
인스턴스가 특정 영역에서 실행되거나 영역 간에 이동하는 이유는 무엇인가요?
영역별 인스턴스 배포 차트에 리전 MIG의 영역 간에 불균등한 배포 또는 위치 간에 갑작스러운 용량 이동이 표시되면 다음 위치 유연성 요인을 확인하세요.
목표 분산 형태: 구성된 목표 분산 형태를 확인합니다. MIG가
ANY또는ANY_SINGLE_ZONE으로 구성된 경우 MIG는 인스턴스를 균등하게 균형 조정하는 대신 용량 또는 사용하지 않는 예약이 가장 쉽게 사용 가능한 영역에 우선순위를 지정합니다. MIG에서BALANCED를 사용하는 경우 그룹은 영역 간에 인스턴스 수를 균형 있게 유지하려고 하지만 특정 영역에 일시적인 용량 부족이 발생하면 인스턴스를 대체 영역에 일시적으로 배치할 수 있습니다.리전 용량 재배포: 영역별 서비스 중단과 같은 이벤트로 인해 일시적인 용량 부족이 발생하면 고가용성을 위해 구성된 리전 MIG는 리전 내의 대체 영역에서 대체 인스턴스를 자동으로 찾아 할당합니다. 대시보드는 이 위치 유연성을 영향을 받는 영역의 인스턴스 수 감소와 대체 영역의 인스턴스 수 증가로 반영합니다.
MIG가 대체 머신 유형에서 실행되는 이유는 무엇인가요?
MIG에서 인스턴스 유연성을 사용하고 머신 유형별 인스턴스 배포 차트에 그룹이 기본 선택 항목 대신 우선순위가 낮은 (순위 값이 높은) 머신 유형에서 인스턴스를 적극적으로 생성하고 실행하는 것으로 표시되면 다음과 같은 잠재적 원인을 고려하세요.
일시적인 리소스 제약조건: 기본 머신 유형에 수요가 많거나 일시적인 리소스 제약조건이 있는 경우 MIG는 목표 용량을 확보하기 위해 자동으로 보조 선택 항목으로 대체됩니다. 선호 머신 유형을 다시 사용할 수 있게 되더라도 MIG는 대체 머신 유형을 계속 사용하고 선호 머신 유형으로 적극적으로 다시 전환하지 않습니다.
할당량 제한: Google Cloud 프로젝트에 선택한 리전에서 선호하는 머신 시리즈에 대한 vCPU 및 리소스 할당량이 충분한지 확인합니다. 기본 머신 유형의 할당량이 소진되면 MIG는 사용 가능한 보조 선택 항목에서 프로비저닝합니다.
자세한 내용은 MIG에서 머신 유형을 선택하는 방법을 참고하세요.
을 참고하세요.PromQL을 사용하여 프로그래매틱 방식으로 쿼리
MIG의 인스턴스 배포를 모니터링하려면 Cloud Monitoring용 PromQL을 사용하여 기본 측정항목을 프로그래매틱 방식으로 쿼리할 수도 있습니다. 프로그래매틱 방식으로 쿼리하면 인스턴스 배포 데이터를 커스텀 관측 가능성 대시보드 또는 Grafana와 같은 외부 모니터링 도구에 통합할 수 있습니다. PromQL을 사용하여 인스턴스를 영역별 또는 머신 유형별로 쿼리할 수 있습니다.
다음 섹션에 설명된 대로 코드 편집기에서 PromQL 쿼리를 실행합니다.
코드 편집기에 액세스
Google Cloud 콘솔의 다음 페이지에서 PromQL에 액세스할 수 있습니다.
- 측정항목 탐색기
- 대시보드를 만들 때 위젯 추가
측정항목 탐색기를 사용할 때 코드 편집기를 열려면 다음을 수행합니다.
-
Google Cloud 콘솔에서 leaderboard 측정항목 탐색기 페이지로 이동합니다.
검색창을 사용하여 이 페이지를 찾은 경우 부제목이 Monitoring 인 결과를 선택합니다.
쿼리 빌더 창의 툴바에서 code PromQL 버튼을 선택합니다.
텍스트 필드에 쿼리를 입력하고 쿼리 실행 을 클릭합니다. 다음 섹션에서는 쿼리 예를 제공합니다.
코드 편집기에 대한 자세한 내용은 PromQL용 코드 편집기 사용에 대한 Cloud Monitoring 문서를 참고하세요.
영역별 활성 인스턴스 쿼리
영역별 활성 인스턴스를 쿼리하려면 코드 편집기에서 다음 쿼리를 실행합니다.
count by (zone) (compute_googleapis_com:instance_cpu_utilization{metadata_system_instance_group="YOUR_MIG_NAME"})
YOUR_MIG_NAME을 MIG 이름으로 바꿉니다.
머신 유형별 활성 인스턴스 쿼리
머신 유형별 활성 인스턴스를 쿼리하려면 코드 편집기에서 다음 쿼리를 실행합니다.
count by (metadata_system_machine_type) (compute_googleapis_com:instance_cpu_utilization{metadata_system_instance_group="YOUR_MIG_NAME"})
YOUR_MIG_NAME을 MIG 이름으로 바꿉니다.
다음 단계
- 리전 MIG의 위치 유연성에 대해 알아봅니다.
- 인스턴스 유연성에 대해 알아봅니다.
- MIG에 인스턴스 유연성을 추가합니다.
- MIG에서 인스턴스 유연성 구성 을 봅니다.
- 커스텀 대시보드를 만들고 관리하는 방법을 알아봅니다.