메트릭 수집
IBM Cloud® 또는 IBM Cloud외부에서 사용할 수 있는 Prometheus, JMX, StatsD, Kubernetes 및 기타 애플리케이션 스택과 같은 다양한 플랫폼, 오케스트레이션 및 광범위한 애플리케이션에서 메트릭을 수집할 수 있습니다. 또한 사용자 정의 메트릭을 작성하고 통합을 추가하여 메트릭을 추가할 수도 있습니다.
메트릭 및 레이블
메트릭은 해당 특성을 정의하기 위한 하나 이상의 레이블이 있는 정량적 측정값입니다.
메트릭을 사용하여 숫자 값을 지닌 데이터를 통계적으로 분석할 수 있습니다.
메트릭은 시계열에 의해 표시됩니다. 시계열은 메트릭 이름과 레이블 키-값 쌍의 고유한 조합입니다. 예를 들면, website_failedRequest |region='Asia', customer_ID='abc'. 데이터 점은 특정 시점의 시계열에 대해 생성된 값입니다.
레이블은 인프라 레이블 및 메트릭 디스크립터 레이블로 분류됩니다. 각 메트릭에는 사전 정의된 레이블 세트가 있습니다. 사용자 정의 메트릭의 경우에는 추가 레이블을 구성할 수 있습니다.
레이블을 사용하여 메트릭의 특성을 식별하고 구분할 수 있습니다, 예를 들어, 다음을 수행할 수 있습니다.
- 인프라 오브젝트를 논리 계층 구조로 그룹화할 수 있습니다.
- 데이터를 필터링하여 걸러낼 수 있습니다.
- 집계된 데이터를 세그먼트로 분할할 수 있습니다.
Monitoring 에이전트를 사용하여 기본 메트릭 수집
Monitoring 에이전트를 구성하면 기본 메트릭에 대한 데이터가 자동으로 수집됩니다. 이러한 메트릭에는 모니터할 때 메트릭을 레이블, 세그먼트 및 표시하는 데 사용할 수 있는 메타데이터가 포함됩니다. 에이전트에서 발생하는 상황에 대한 통찰력을 얻기 위해 에이전트가 자동으로 수집하는 메트릭을 얻기 위해 호스트에서 추가 계측 또는 구성이 필요하지 않습니다.
IBM Cloud® Monitoring 서비스를 사용하여 인프라, 네트워크 및 애플리케이션을 모니터하기 위해 지원되는 호스트에 Monitoring 에이전트를 배치할 수 있습니다. 호스트는 배치할 수 있는 에이전트 유형을 판별합니다. 에이전트 유형은 해당 호스트에 대해 자동으로 수집되는 지표를 판별합니다.
기본 메트릭 수집을 시작하려면 모니터할 환경별로 Monitoring 에이전트를 구성해야 합니다.
Monitoring 에이전트는 호스트마다 다음 유형의 시스템 메트릭을 자동으로 수집합니다.
-
System hosts metrics은(는) 모든 프로세스의 성능 및 리소스 활용도를 분석하는 데 사용할 수 있는 CPU, 메모리 및 스토리지 사용량 메트릭에 대한 정보를 제공합니다. -
File and File System metrics은(는) 시스템에서 발생하는 파일 상호작용을 분석하는 데 사용할 수 있는 파일 및 파일 시스템에 대한 정보를 제공합니다. 예를 들어, 열린 파일, 진행 중인 바이트 수 또는 주어진 파일 시스템의 사용 백분율에 대한 정보를 찾을 수 있습니다. -
Process metrics은(는) 서버에서 실행되는 프로세스에 대한 정보를 제공합니다. 예를 들어, 이러한 메트릭을 사용하여 프로세스 수를 탐색하거나 클라이언트 또는 서버 정보를 얻을 수 있습니다. -
Network metrics은(는) 네트워크에 대한 정보를 제공합니다. 애플리케이션, 컨테이너 및 서버 간에 설정된 연결에 대한 통찰력을 제공합니다. 예를 들어, 보내거나 받은 바이트에 대한 정보나 HTTP 요청 수, 연결 수 및 대기 시간에 대한 정보를 찾을 수 있습니다. 또한 SQL 또는 MongoDB의 경우 에이전트는 문제점 해결 모드에서 구성될 때 추가 정보를 수집합니다.
또한, Monitoring 에이전트는 Kubernetes 또는 Red Hat OpenShift 클러스터별로 다음 유형의 메트릭을 자동으로 수집합니다
-
State metrics: Kube 상태 메트릭은 Kubernetes 구성요소에서 실행되는 다양한 오브젝트(예: 배치, 노드 및 팟)의 상태에 대해 보고합니다. 기본적으로 수집되는 메트릭의 목록을 보려면 Kubernetes 상태를 참조하십시오. -
Resource usage metrics: 리소스 사용량 메트릭은 클러스터에서 실행 중인 작업자(노드) 및 팟에 대한 CPU 및 메모리의 상태를 보고합니다. 데이터는 네임스페이스, 작업자, 팟, 워크로드 오브젝트(예: 배치, daemonSets 등)에 의해 분석할 수 있습니다.
오케스트레이션되지 않은 환경의 에이전트
기본적으로 이 에이전트는 호스트를 모니터하는 데 사용할 수 있는 코어 인프라 및 네트워크 시계열을 수집합니다.
수집된 메트릭 목록은 오케스트레이션되지 않은 환경에 사용 가능한 메트릭 을 참조하십시오.
오케스트라식 환경의 에이전트
기본적으로 이 에이전트는 오케스트레이션되지 않은 환경의 에이전트와 동일한 메트릭을 수집하고 Kubernetes 상태 및 리소스 사용량 메트릭도 수집합니다.
수집된 메트릭 목록은 오케스트라식 환경에 사용 가능한 메트릭 을 참조하십시오.
Monitoring 에이전트를 사용하여 사용자 정의 메트릭 수집
Monitoring 에이전트에는 Syscall, StatsD, JMX 및 Promscrape를 통해 메트릭을 수집하는 구성요소가 포함됩니다.
-
에이전트는 서버 시스템 호출을 통해 커널에서 직접 정보를 추출합니다. 시스템 호출은 실행 중인 프로세스, 메모리 할당, 네트워크 연결, 파일 시스템에 대한 액세스, 리소스 사용 등에 대한 정보를 제공합니다.
-
에이전트에는 Promscrape로 알려진 경량 Prometheus 서버가 포함되어 있습니다. Prometheus 메트릭을 수집하여 스토리지 및 처리를 위해 Monitoring 인스턴스로 전송하도록 에이전트를 구성할 수 있습니다.
scrape_config 설정을 구성하고 대상, 인스턴스 및 작업을 정의하려면 Prometheus 구문을 사용하여 Monitoring 에이전트를 구성해야 합니다.
- Promscrape는 오픈 소스 Prometheus 서버를 기반으로 합니다.
- 다른 Monitoring 에이전트 버전에는 Prometheus 메트릭 콜렉션에 대한 다양한 레벨의 지원이 포함됩니다. 예를 들어, Monitoring 에이전트 v10.5.0 이상에는 Promscrape v2가 포함되며 Prometheus 기본 서비스 발견을 지원합니다. Monitoring 에이전트에 대한 자세한 정보는 Monitoring 에이전트 릴리스 정보의 내용을 참조하십시오.
- Promscrape 버전에 대한 자세한 정보는 Promscrape V1 에서 V2로 마이그레이션을 참조하십시오.
Prometheus 원격 쓰기를 사용하여 사용자 정의 메트릭 수집
Monitoring 에이전트를 사용할 수 없는 환경에서 메트릭을 수집하고 Monitoring 인스턴스로 전송하도록 Prometheus 원격 쓰기를 구성할 수 있습니다.
다음에서 메트릭을 수집할 수 있습니다.
- 기존 Prometheus 서버입니다.
- Monitoring 에이전트가 스크랩할 만큼 오래 존재하지 않을 수 있는 임시 또는 일괄처리 작업입니다.
- Windows 호스트 및 Monitoring 에이전트를 사용할 수 없는 기타 운영 체제
- Non-x86 기반 아키텍처(일반적으로 IoT 환경 또는 에지 컴퓨팅에서 볼 수 있음)
- NGNIX, 사용자 정의 애플리케이션, RabbitMQ등과 같은 비컨테이너 워크로드.
Monitoring 웹 UI를 통해 Prometheus 원격 쓰기를 사용하여 수집되는 메트릭을 모니터할 수 있습니다. 또한 PromQL을 사용하여 표준 Prometheus 조회 언어를 사용하여 데이터를 조회할 수 있습니다.
자세한 정보는 Prometheus 원격 쓰기를 사용하여 메트릭 수집의 내용을 참조하십시오.
Prometheus 내보내기 프로그램을 사용하여 사용자 정의 메트릭 수집
Prometheus 내보내기 프로그램을 사용하여 기본적으로 Prometheus 형식의 메트릭을 표시하지 않는 호스트, 서비스 또는 앱에서 메트릭을 수집할 수 있습니다. Monitoring 인스턴스를 통해 이러한 메트릭을 모니터할 수 있습니다.
Prometheus 내보내기 프로그램에 대한 다양한 소스가 있습니다.
- 공식 수출업체는 공식 Prometheus GitHub 조직에서 확인할 수 있으며, 라벨이 공식으로 표시되어 있습니다.
- Sysdig는 통합 라이브러리를 큐레이팅하고 유지합니다. 통합 라이브러리는 Kubernetes 플랫폼과 클라우드 네이티브 서비스에 대한 지원되는 Monitoring 통합을 찾을 수 있는 기업 자원 카탈로그입니다.
다음과 같은 다양한 소스에서 메트릭을 수집할 수 있습니다.
- Windows 시스템 또는 VMware ESXi-Host 시스템과 같이 Monitoring 에이전트를 사용할 수 없는 호스트입니다.
- Monitoring 에이전트가 사용 가능한 호스트이지만 IPMI 센서 메트릭 또는 하드웨어 및 커널 릴레이 메트릭과 같은 다른 유형의 메트릭을 수집해야 합니다.
- MySQL 데이터베이스와 같은 서비스
자세한 정보는 Prometheus 내보내기 프로그램을 사용하여 메트릭 수집의 내용을 참조하십시오.
IBM Cloud 서비스에서 플랫폼 메트릭 수집
플랫폼 메트릭은 IBM Cloud의 모니터링 사용 서비스 및 플랫폼에 의해 표시되는 메트릭입니다.
지역당 1개의 IBM Cloud Monitoring 서비스 인스턴스만 플랫폼 메트릭을 수집하도록 구성할 수 있습니다.
서비스 인스턴스의 플랫폼 메트릭을 모니터하려면 모니터하려는 IBM Cloud Monitoring 서비스 인스턴스가 프로비저닝된 지역과 동일한 지역에 IBM Cloud 인스턴스를 프로비저닝하십시오.
자세한 정보는 플랫폼 메트릭에 대한 작업의 내용을 참조하십시오.