Supervisión de un servidor nativo de Linux

Puede supervisar un servidor nativo con IBM Cloud Monitoring mediante la configuración de un agente de supervisión en el servidor. El agente de supervisión utiliza una clave de acceso (señal) para autenticarse con la instancia de IBM Cloud Monitoring. El agente de supervisión actúa como recopilador de datos. Recopila métricas de forma automática. Las métricas se visualizan en una interfaz de usuario web. Puede supervisar metales en IBM Cloud, en local y en otras nubes.

De forma predeterminada, este agente recopila la infraestructura principal y las series temporales de red que puede utilizar para supervisar el host. Para obtener una lista de las métricas recopiladas, consulte Métricas disponibles para entornos no orquestados.

El agente de Monitoring recopila automáticamente los siguientes tipos de métricas del sistema para cada host:

  • System hosts metrics proporciona información sobre las métricas de uso de CPU, memoria y almacenamiento, que puede utilizar para analizar el rendimiento y la utilización de recursos de todos los procesos.

  • File and File System metrics proporciona información sobre los archivos y el sistema de archivos que puede utilizar para analizar las interacciones de archivos que se producen en el sistema. Por ejemplo, puede encontrar información sobre los archivos abiertos, los bytes de entrada y salida, o el porcentaje de uso de un determinado sistema de archivos.

  • Process metrics proporciona información sobre los procesos que se ejecutan en los servidores. Por ejemplo, puede utilizar estas métricas para explorar el número de procesos u obtener información de cliente o servidor.

  • Network metrics proporciona información sobre la red. Ofrecen información sobre las conexiones que se establecen entre las aplicaciones, los contenedores y los servidores. Por ejemplo, puede encontrar información sobre los bytes que se envían o reciben, o el número de solicitudes HTTP, las conexiones y la latencia. Además, para SQL o MongoDB, el agente recopila información adicional cuando se configura en modalidad de resolución de problemas.

Con la interfaz de usuario de Monitoring, puede analizar datos en las pestañas Asesor, Explorar y Panel de control. Los datos se supervisan mediante vistas de métricas y paneles de control.

Tenga en cuenta la siguiente información al supervisar los datos:

  • En la pestaña Explorador, puede supervisar métricas individuales.

  • En la pestaña Asesor, puede supervisar las métricas a nivel de Red Hat OpenShift o de host.

    Esta pestaña sólo está disponible para usuarios que pertenezcan a un equipo que tenga acceso a supervisar las métricas a nivel de Red Hat OpenShift o de host.

  • En la pestaña Panel de control, puede supervisar paneles de control predefinidos o personalizados y obtener un información especializada sobre datos de red, datos de aplicación, topología, servicios, hosts y contenedores. Un panel muestra una métrica o un grupo de métricas en un panel de control.

Para cada vista de métrica y para cada panel de control, puede definir el ámbito de los datos, cómo agregar los datos y qué filtros de tiempo y de grupo se deben aplicar a los datos. Para obtener más información, consulte Gestión de paneles.

Puede configurar un panel de control como el punto de entrada predeterminado para un equipo y, de esta forma, unificar la experiencia de un equipo y permitir que los usuarios centren su atención inmediata en la información más relevante para ellos.

Para obtener más información, consulte Visualización de métricas.

Antes de empezar

  1. Lea la información acerca de IBM Cloud Monitoring.

  2. Instale la CLI de IBM Cloud. Para obtener más información, consulte Instalación de la CLI de IBM Cloud.

  3. Suministre una instancia de IBM Cloud Monitoring desde el catálogo.

  4. Suministre un servidor nativo.

    Para completar los pasos de este tema, asegúrese de tener acceso a Internet desde el servidor nativo. Se necesita para configurar el agente de supervisión.

  5. Configurar una conexión VPN entre el terminal y el servidor nativo

    El acceso de red privada virtual (VPN) permite a los usuarios gestionar todos los servidores de forma remota y segura sobre la red privada de IBM Cloud®. Una conexión VPN entre su ubicación y la red privada permite la gestión fuera de banda y el rescate de servidor a través de un túnel VPN cifrado. Los túneles VPN se pueden iniciar en cualquier centro de datos o PoP de IBM Cloud, lo que le permita ofrecer redundancia geográfica.

    Siga los pasos siguientes para configurar una conexión VPN entre el terminal y el servidor nativo:

    1. Habilite el acceso VPN en cada cuenta que necesite acceso VPN.

    2. Dependiendo de su sistema operativo, descargue los archivos más recientes de MotionPro de 32 o 64 bits desde el sitio de descarga de clientes y herramientas de Array Networks. Más información.

    3. Configure un cliente VPN SSL autónomo y abra una conexión:

    Por ejemplo, si utiliza el cliente MotionPro Plus para MacOS, para añadir un perfil pulse Añadir.

    En la sección Basic, especifique un Title. Especifique una Gateway; por ejemplo, para un metal nativo en Dallas 10, escriba vpn.dal10.softlayer.com. Especifique el nombre de usuario de VPN. Compruebe que el Port esté establecido en 443. A continuación, pulse Aceptar.

    Para abrir una conexión segura, pulse Iniciar sesión.

  6. Establezca conexión con un servidor nativo mediante SSH

    Es posible que necesite una VPN para acceder al sistema, en función de la configuración de seguridad y de la configuración de ssh en el host nativo.

    Debe ejecutar ssh sobre el host utilizando sus credenciales o las credenciales raíz que están disponibles en la consola de IBM Cloud.

    Necesitará permisos de root para poder instalar el agente de supervisión.

    Por ejemplo, puede seguir estos pasos para obtener la información nativa que necesita para ejecutar ssh en el servidor:

    1. Inicie sesión en su cuenta de IBM Cloud.

    2. Pulse el icono Menú Icono Menú > Infraestructura clásica > Lista de dispositivos.

    3. Identifique el servidor nativo que desea supervisar. Copie la IP pública.

    4. Pulse el nombre de dispositivo del servidor nativo.

    5. Seleccione Contraseñas. Copie la contraseña correspondiente al usuario root.

      A continuación, desde un terminal, ejecute el mandato siguiente:

      ssh <USER_ID>@<IP_ADDRESS>
      

      Donde:

      <USER_ID> es el ID de usuario que se utiliza para iniciar una sesión en el servidor nativo. Por ejemplo, utilice root.

      <IP_ADDRESS> es la dirección IP pública del servidor nativo.

      Por ejemplo: ssh root@45.123.122.12

Configurar un agente de supervisión para recopilar métricas del servidor nativo

Debe instalar un agente de supervisión para recopilar y reenviar métricas de un servidor nativo a una instancia de IBM Cloud Monitoring.

Siga estos pasos desde la línea de mandatos para instalar un agente de supervisión:

  1. Obtenga la clave de acceso. Para obtener más información, consulte Obtención de la clave de acceso mediante la IU de IBM Cloud.

  2. Obtenga el URL de ingestión. Para obtener más información, consulte Puntos finales de recopilador.

  3. Despliegue el agente de supervisión. Ejecute el mandato siguiente:

    curl -sL https://ibm.biz/install-sysdig-agent | sudo bash -s -- --access_key ACCESS_KEY --collector COLLECTOR_ENDPOINT --collector_port 6443 --secure true --tags TAG_DATA --additional_conf 'sysdig_capture_enabled: false'
    

    Donde

    • ACCESS_KEY es la clave de ingestión para la instancia.

    • COLLECTOR_ENDPOINT es el URL de ingestión para la región en la que está disponible la instancia de supervisión.

    • TAG_DATA son etiquetas separadas por comas con el formato NOMBRE_ETIQUETA_VALOR:ETIQUETA. Puede asociar una o varias etiquetas al agente de supervisión. Por ejemplo, role:serviceX,location:us-south. Más adelante podrá utilizar estas etiquetas para identificar las métricas del entorno en el que se ejecuta el agente.

    • El distintivo SECURE debe establecerse en true para utilizar una conexión SSL/TLS segura para enviar métricas al recopilador.

    • Establezca sysdig_capture_enabled en false para inhabilitar la característica de captura. De forma predeterminada, está establecido en true. Para obtener más información, consulte Cómo trabajar con capturas.

    Si cURL no está disponible, debe instalarlo. Por ejemplo, para un servidor nativo Ubuntu, ejecute el siguiente mandato: sudo apt-get update. A continuación, ejecute el mandato install: sudo apt-get install curl.

    Por ejemplo, consulte el siguiente mandato de ejemplo para instalar un agente de supervisión que reenvíe métricas a una instancia de supervisión en EE. UU. sur (Dallas):

    curl -sL https://ibm.biz/install-sysdig-agent | sudo bash -s -- -a xxxxxxxxxxxxx -c ingest.us-south.monitoring.cloud.ibm.com --collector_port 6443 --secure true -ac "sysdig_capture_enabled: false" --tags sourceType:baremetal,location:dallas
    
  4. Configure el agente para entornos no orquestados.

    Abra el archivo dragent.yaml que se encuentra en /opt/draios/etc/.

    Añade el siguiente parámetro de configuración:

    feature:
      mode: monitor_light
    

    Reinicie el agente. Ejecute el mandato siguiente:

    service dragent restart
    

Inicie la interfaz de usuario de supervisión para verificar que está obteniendo datos para supervisar el servidor nativo

Siga los pasos siguientes para iniciar la interfaz de usuario web:

  1. Inicie sesión en su cuenta de IBM Cloud.

    Cuando inicia una sesión con su ID de usuario y su contraseña, se abre la consola de IBM Cloud.

  2. Pulse el icono Menú Icono Menú > Observabilidad.

  3. Seleccione Supervisión.

    Se muestra la lista de instancias que están disponibles en IBM Cloud.

  4. Seleccione su instancia. A continuación, pulse Abrir panel de control.

Es posible que tarde un rato en ver la entrada del servidor nativo mientras el agente de supervisión recopila y procesa la información.

Sólo puede supervisar una instancia por navegador. Puede tener varios separadores para la misma instancia.

Supervise el servidor nativo

En la pestaña Asesor, puede supervisar y resolver problemas de estado, riesgo y capacidad de los hosts y los clústeres de Kubernetes.

Pestaña Asesor
Pestaña Asesor

  • Los datos se renuevan cada 10 minutos.
  • Las métricas se priorizan por el recuento de sucesos y la gravedad.
  • Para obtener más información, consulte Advisor.

En la sección Asesor, elija supervisar por host. Consulte los paneles de instrumentos predefinidos que puede utilizar para supervisar el estado de los recursos.

Cuando elige supervisar por host, puede elegir cualquiera de los paneles de control siguientes:

  • Uso de recursos de host
  • Uso y rendimiento del sistema de archivos
  • Uso de memoria
  • Red
  • Estado y salud del agente Sysdig

[Opcional] Configure el Prometheus IPMI Exporter para supervisar las métricas del sensor

Además del conjunto de métricas que recopila automáticamente el agente de supervisión, puede que desee recopilar otras métricas, como por ejemplo las métricas del sensor. Puede utilizar Prometheus IPMI Exporter para recopilar las métricas del sensor de dispositivos IPMI (Intelligent Platform Management Interface) del servidor nativo.

  • Prometheus IPMI Exporter da soporte a dispositivos IPMI locales y a dispositivos remotos a los que se puede acceder mediante Remote Management Control Protocol (RMCP).
  • Si utiliza RMCP para acceder a los dispositivos remotos, puede utilizar un exportador de IPMI para supervisar varios dispositivos IPMI. Puede identificar cada dispositivo pasando el nombre de host de destino como parámetro.
  • El exportador de IPMI se basa en las herramientas de la suite de FreeIPMI.

Puede recopilar las métricas siguientes cuando configure el exportador de IPMI en un servidor nativo:

  • Métricas de administración de IPMI

    La métrica ipmi_up {collector="<NAME>"} notifica a 1 cuándo se recopilan satisfactoriamente los datos de un host remoto. Muestra 0 para la recopilación de datos en un host local.

    La métrica ipmi_scrape_duration_seconds muestra el intervalo de tiempo que tarda el recopilador en recuperar los datos.

  • Métricas del registro de sucesos del sistema (SEL) IPMI

    La métrica ipmi_sel_entries_count muestra el número de entradas del registro de sucesos del sistema.

    La métrica ipmi_sel_free_space_bytes muestra el número de bytes libres para las nuevas entradas de registro de sucesos del sistema.

  • Datos del sensor de IPMI

    El exportador de IPMI recopila 2 métricas por tipo de sensor: estado y valor. El valor 0 indica un estado normal. El valor 1 indica un estado de aviso. El valor 2 indica un estado crítico. El valor NaN indica que no hay información disponible. Por ejemplo, estas son las métricas de distintos sensores:

    Métricas del sensor de temperatura: ipmi_temperature_celsius, ipmi_temperature_state

    Métricas del sensor de velocidad del ventilador: ipmi_fan_speed_rpm, ipmi_fan_speed_state

    Métricas del sensor de voltaje: ipmi_voltage_state, ipmi_voltage_volts

  • Estado de alimentación del chasis de IPMI de la máquina

    La métrica ipmi_chassis_power_state indica el estado actual del chasis de la máquina. Si tiene el valor 1, está encendido. Si tiene el valor 0, está apagado.

  • Datos de DCMI

    La métrica ipmi_dcmi_power_consumption_current_watts indica el consumo de alimentación de la máquina en vatios.

  • Detalles de BMC

    La métrica ipmi_bmc_info incluye información sobre la revisión de firmware y sobre el fabricante en etiquetas y tiene el valor 1.

Para obtener más información, consulte Prometheus IPMI Exporter.

Siga los pasos siguientes para configurar Prometheus IPMI Exporter:

Instalar Prometheus IPMI Exporter

Complete los pasossiguientes:

  1. Desde un terminal local, descargue el exportador IPMI de Prometheus.

  2. En el servidor nativo, desde la sesión shh, cree el directorio /usr/monitor. Ejecute los mandatos siguientes:

    cd /usr
    
    mkdir monitor
    
  3. Copie el archivo en el servidor nativo. En el directorio en el que está disponible el archivo, ejecute el mandato siguiente:

    scp ipmi_exporter-v1.2.0.linux-amd64.tar.gz  root@<IP_ADDRESS>:/usr/monitor/
    

    Donde <IP_ADDRESS> es la dirección IP pública del servidor nativo.

    Si el mandato falla, compruebe que la conexión VPN sigue abierta.

  4. En el servidor nativo, desde la sesión shh, descomprima el archivo. Ejecute los mandatos siguientes:

    cd /usr/monitor/
    
    tar -xvf ipmi_exporter-v1.2.0.linux-amd64.tar.gz
    
  5. En el servidor nativo, desde la sesión shh, instale la suite FreeIPMI. Ejecute los mandatos siguientes:

    sudo apt-get update
    
    sudo apt-get install freeipmi
    
  6. En el servidor nativo, desde la sesión shh, compruebe el archivo ipmi_local.yml. Si lo desea, puede actualizar el archivo para excluir los sensores que no desee supervisar.

    Vaya al directorio en el que ha extraído el exportador de IPMI:

    cd ipmi_exporter-v1.2.0.linux-amd64/
    

    Compruebe el archivo de configuración. Ejecute el mandato: more ipmi_local.yml Debería ver un archivo con un contenido similar al siguiente.

    # Configuration file for ipmi_exporter
    
    # This is an example config for scraping the local host.
    # In most cases, this should work without using a config file at all.
    modules:
            default:
                    # Available collectors are bmc, ipmi, chassis, dcmi, and sel
                    collectors:
                    - bmc
                    - ipmi
                    - dcmi
                    - chassis
                    - sel
                    # Got any sensors you don't care about? Add them here.
                    exclude_sensor_ids:
                    # - 2
    
  7. En el servidor nativo, desde la sesión shh, ejecute el exportador de IPMI.

    ./ipmi_exporter --config.file=ipmi_local.yml &
    
  8. Verifique que el exportador de IPMI se está ejecutando. Ejecute el mandato:

    ps -aux | grep ipmi
    

    Debería ver que el exportador de IPMI se está ejecutando.

Instalar el exportador de Prometheus

El agente de supervisión recopila de forma automática métricas sobre los exportadores de Prometheus. Por lo tanto, para recopilar métricas desde su exportador de IPMI, también debe configurar el exportador de Prometheus.

Siga los pasos siguientes para ejecutar el exportador de Prometheus:

  1. Desde un terminal local , descargue el exportador Prometheus.

  2. En el servidor nativo, desde la sesión shh, vaya al directorio /usr/monitor/. Ejecute el mandato siguiente:

    cd /usr/monitor/
    
  3. Copie el archivo en el servidor nativo. En el directorio en el que está disponible el archivo, ejecute el mandato siguiente:

    scp prometheus-2.18.1.linux-amd64.tar.gz root@<IP_ADDRESS>:/usr/monitor/
    

    Donde <IP_ADDRESS> es la dirección IP pública del servidor nativo.

    Si el mandato falla, compruebe que la conexión VPN sigue abierta.

  4. En el servidor nativo, desde la sesión shh, descomprima el archivo. Ejecute los mandatos siguientes:

    cd /usr/monitor/
    
    tar -xvf prometheus-2.18.1.linux-amd64.tar.gz
    
  5. Modifique el archivo prometheus.yml para incluir información sobre scrape_configuration para el exportador de IPMI.

    Vaya al directorio de Prometheus:

    cd prometheus-2.18.1.linux-amd64/
    

    Edite el archivo prometheus.yml y añada la sección scrape_configs:

    # my global config
    global:
      scrape_interval:     15s # Set the scrape interval to every 15 seconds. Default is every 1 minute.
      evaluation_interval: 15s # Evaluate rules every 15 seconds. The default is every 1 minute.
      # scrape_timeout is set to the global default (10s).
    
    # Alertmanager configuration
    alerting:
      alertmanagers:
      - static_configs:
        - targets:
          # - alertmanager:9093
    
    # Load rules once and periodically evaluate them according to the global 'evaluation_interval'.
    rule_files:
      # - "first_rules.yml"
      # - "second_rules.yml"
    
    # A scrape configuration containing exactly one endpoint to scrape:
    # Here it's Prometheus itself.
    scrape_configs:
      # The job name is added as a label `job=<job_name>` to any timeseries scraped from this config.
      - job_name: ipmi
    
        metrics_path: '/metrics'
        scheme: http
    
        static_configs:
        - targets: ['localhost:9290']
          labels:
            instance: baremetal01
            region: us-south
    
  6. Ejecute el exportador de Prometheus:

    ./prometheus &
    

Configurar valores de red

Si desea recopilar métricas desde servidores remotos, siga estos pasos:

  1. Habilite el cortafuegos para permitir el acceso a ipmi_exporter.

  2. [Opcional] Actualice las reglas de VPC

    Si utiliza Puntos finales privados, añada una regla de entrada al grupo de seguridad para el puerto 9290 con source type = Security Group y elija el grupo de seguridad correspondiente al servidor nativo.

Actualizar el agente de supervisión que se está ejecutando en el servidor nativo

Complete los pasossiguientes:

  1. En el servidor nativo, desde la sesión shh, vaya al directorio /opt/draios/etc/. Ejecute el mandato siguiente:

    cd /opt/draios/etc/
    
  2. Actualice el archivo /opt/draios/etc/dragent.yaml.

    Añada la siguiente sección al archivo dragent.yaml:

    prometheus:
     enabled: true
     interval: 30
     log_errors: true
     max_metrics: 3000
     max_metrics_per_process: 3000
     max_tags_per_metric: 20
     process_filter:
       - include:
           port: 9090
           conf:
             port: 9090
             path: "/metrics"
       - include:
           port: 9290
           conf:
             port: 9290
             path: "/metrics"
    
  3. Reinicie el agente de supervisión. Ejecute el mandato siguiente:

    service dragent restart
    

Verifique que pueda ver las métricas de prometheus ipmi

Complete los pasossiguientes:

  1. Pulse el icono Menú Icono Menú > Observabilidad.

  2. Seleccione Supervisión.

  3. Identifique la instancia de supervisión que ha creado. A continuación, pulse Abrir panel de control.

  4. En la vista Explore, seleccione Hosts y contenedores. Luego seleccione el servidor nativo que desea supervisar.

    Vista Hosts y contenedores
    Vista Hosts y Contenedores

  5. Abra la opción para seleccionar más paneles de control y métricas. A continuación, especifique ipmi en la barra de búsqueda. Se muestra la lista de métricas de IPMI.

    Métricas de IPMI
    Métricas de IPMI

Configurar un panel de control para analizar el estado de IPMI del servidor nativo

Para crear un panel de control para supervisar las métricas de IPMI, siga estos pasos:

  1. Seleccione la métrica ipmi_up.

    métricas de ipmi_up
    métricas de ipmi_up

  2. Seleccione el icono de 3 Puntos. A continuación, seleccione Copiar en el panel de control.

    Copiar panel de control
    Copiar panel de control

  3. Especifique el nombre Supervisión de IPMI [nativo]. Luego pulse Copiar y abrir.

    Copiar y abrir un panel de control
    Copiar y abrir un panel de control

    Se abre el panel de control.

    Panel de instrumentos personalizado IPMI
    Panel de instrumentos personalizado IPMI

  4. Añada más métricas de IPMI al panel de control personalizado de Supervisión IPMI [nativo]. Repita los pasos para cada una de las métricas de IPMI que desea supervisar.

  5. Utilice las funciones de arrastrar y soltar y redimensione los paneles para obtener el diseño de panel de control que desee. Guarde el diseño.

Próximos pasos