Fonctions
IBM® Cloud Logs est un service d'observabilité dans IBM Cloud conçu pour aider les organisations à surveiller, dépanner, analyser et alerter sur la performance de leurs applications et de leur infrastructure en temps réel et à long terme. En collectant et en analysant les logs des applications cloud-natives, des serveurs, des bases de données et d'autres systèmes informatiques, IBM Cloud Logs fournit des informations exploitables sur le comportement du système, aidant les équipes SRE et Dev à identifier et à résoudre rapidement les problèmes. Avec IBM Cloud Logs, vous pouvez surveiller les données opérationnelles générées dans IBM Cloud, sur site et par d'autres fournisseurs de services en nuage. Vous pouvez également contrôler les données de sécurité générées sur IBM Cloud.
Au fur et à mesure que les charges de travail génèrent une quantité croissante de données d'observabilité, la pression augmente sur les outils de collecte pour traiter toutes les données. Les données deviennent coûteuses à gérer et rendent plus difficile l'obtention d'informations exploitables. Il est plus difficile d'avoir une gestion des opérations et des performances rapide, efficace et rentable.
IBM Cloud Logs est conçu pour aider les utilisateurs à prendre le contrôle de leurs données d'observabilité et à accélérer les analyses afin de réduire le temps d'indisponibilité des applications.
IBM Cloud Logs prend en charge l'intégration avec des environnements de charge de travail courants sur IBM Cloud, sur site et dans d'autres nuages, y compris VPC, IBM Cloud Kubernetes Service, et Red Hat OpenShift on IBM Cloud. L'intégration avec des environnements non orchestrés, tels que Linux et Windows, est également possible.
Avec IBM Cloud Logs, vous pouvez envoyer des données de journal de la plateforme IBM Cloud, des événements de suivi d'activité IBM Cloud et des données de journal opérationnel dans le service, ce qui vous donne une certaine flexibilité dans la manière dont vous traitez vos données. Les données des journaux et des événements peuvent être envoyées à des instances IBM Cloud Logs distinctes ou combinées en une seule instance afin d'élargir les perspectives d'observation.
IBM Cloud Logs traite les données entrantes et applique des algorithmes d'apprentissage automatique, y compris l'agrégation des journaux et la détection des anomalies. Ce traitement vous aide à vous concentrer sur la cause première des problèmes.
IBM Cloud Logs offre les fonctionnalités suivantes :
- Collecte de données en vue d'un stockage et d'une analyse centralisés
- Optimiser la valeur et contrôler votre budget d'observabilité
- Respecter les réglementations en matière de conformité et de sécurité
- Prévoir les comportements anormaux pour détecter rapidement les situations anormales
- Générer des métriques dérivées des journaux pour améliorer l'observabilité
- Restructuration des données à des fins d'analyse et de dépannage
- Enrichir les données télémétriques avec des informations contextuelles pour une meilleure analyse
- Archivage des journaux pour un stockage à long terme
- Interroger les données afin d'obtenir des informations pour le dépannage et l'analyse
- Améliorer la visibilité opérationnelle afin d'obtenir des informations pour une meilleure analyse
- Notifier les problèmes pour sensibiliser et agir rapidement
- Contrôle de la gestion des incidents
- Intégration avec d'autres applications
Explorons ces fonctionnalités.
Collecte de données en vue d'un stockage et d'une analyse centralisés
Sur IBM Cloud Logs, vous pouvez collecter des données télémétriques générées sur IBM Cloud, sur site et par d'autres fournisseurs de services en nuage.
IBM Cloud Logs s'intègre aux cadres et bibliothèques de journalisation les plus courants, ce qui vous permet de transférer facilement vos données vers IBM Cloud Logs en vue d'un stockage et d'une analyse centralisés.
Optimisation de la valeur et contrôle de votre budget d'observabilité
Toutes les données n'ont pas la même valeur. IBM Cloud Logs vous aide à optimiser la valeur des données que vous conservez en utilisant l'optimiseur TCO.
Lorsque vous passez en revue vos besoins d'observabilité et votre budget, vous pouvez choisir parmi trois niveaux de traitement des journaux et des événements:
-
Stockage et recherche: Les données qui sont conservées principalement pour des raisons de conformité peuvent être stockées et recherchées si nécessaire à un coût moindre par Go.
-
Analyser et alerter: les données de journal et d'événement avec une valeur d'analyse et d'alerte sont traitées à un coût intermédiaire / Go. Le niveau intermédiaire inclut l'ajout de la définition des métriques à partir des journaux, ce qui permet de visualiser les tendances et de préparer la gestion rapide des incidents futurs.
-
Informations de priorité: sélectionnez et configurez les données les plus critiques et les plus importantes pour vos opérations pour les résultats de requête de priorité. Les données de ce niveau sont conservées dans le stockage à chaud.
Dans l'optimiseur TCO, vous configurez des règles qui définissent le pipeline de données qui traite les données après l'ingestion. La hiérarchisation des données avant leur stockage ou leur indexation réduit les coûts de surveillance tout en améliorant la visibilité du système.
Pour plus d'informations, voir Contrôle des coûts, TCO Optimizer et Utilisation des données.
Respecter les réglementations en matière de conformité et de sécurité
La sécurité et la conformité des données sont une priorité pour IBM Cloud Logs.
IBM Cloud Logs offre un cryptage au repos et en transit, des contrôles d'accès et adhère aux pratiques de sécurité standard de l'industrie.
IBM Cloud Logs aide les entreprises à respecter les normes, les exigences de conformité et les réglementations, telles que GDPR et HIPAA, en fournissant des fonctionnalités telles que l'anonymisation des données et les journaux d'audit.
Prévoir les comportements anormaux pour détecter rapidement les situations anormales
Sur IBM Cloud Logs, vous pouvez détecter un comportement anormal en configurant des alertes de détection d'anomalies qui utilisent des algorithmes d'intelligence artificielle pour analyser les journaux entrants et prédire leur comportement attendu pendant 24 heures.
Par exemple, vous pourriez vouloir détecter des tendances à la hausse des erreurs liées à de mauvaises réponses de l'API qui provoquent un pic dans vos journaux et indiquent qu'il se passe quelque chose d'inhabituel. Découvrez quand le temps de réponse d'une transaction dépasse sa durée habituelle, ce qui vous permet d'identifier les goulets d'étranglement en matière de performances et d'y remédier. Ou encore, détecter un pic inattendu de journaux dans votre environnement dû au trafic sortant d'un hôte qui dépasse ses niveaux habituels et peut indiquer qu'une faille de sécurité potentielle est en train de se produire.
Générer des métriques dérivées des journaux pour améliorer l'observabilité
Dans IBM Cloud Logs, vous pouvez améliorer l'observabilité afin d'identifier les problèmes de performance, de contrôler la fiabilité du système ou de résoudre les problèmes en utilisant la fonction Event2metrics.
Par exemple, vous pouvez utiliser une mesure basée sur les journaux pour surveiller le temps de chargement d'une page, la durée d'un processus ou compter le nombre d'entrées de journaux contenant un code d'erreur spécifique.
Au fur et à mesure que les données sont ingérées, les données métriques sont dérivées de vos journaux et converties en mesures Prometheus. Vous pouvez utiliser des tableaux de bord pour visualiser vos mesures. Des alertes peuvent être configurées pour signaler un comportement inattendu.
L'utilisation de métriques générées à partir de données de journal est un excellent moyen d'examiner rapidement de grandes quantités de données lorsque vous recherchez des sources de données différentes.
Pour plus d'informations, voir Configuration de la collecte des métriques à partir des journaux.
Restructuration des données à des fins d'analyse et de dépannage
Vous pouvez restructurer et analyser les données du journal pour faciliter le traitement et augmenter la valeur de vos données en utilisant des règles d'analyse.
Les outils d'analyse IBM Cloud Logs vous aident à évaluer si les données sont essentielles ou redondantes. La restructuration des données peut vous aider à regrouper des informations dissemblables que les équipes doivent trouver rapidement pour traiter les incidents.
IBM Cloud Logs est conçu pour convertir les données de journal afin de récapituler ce qui se passe.
Pour plus d'informations, voir Règles d'analyse.
Enrichir les données télémétriques avec des informations contextuelles pour une meilleure analyse
Sur le site IBM Cloud Logs, vous pouvez enrichir vos données logs avec plus de contexte. Vous pouvez ajouter automatiquement des zones à vos journaux JSON en fonction de correspondances spécifiques dans vos données de journal en utilisant votre propre source de données personnalisée prédéfinie. Ainsi, vous pouvez améliorer vos données de journal avec des informations métier, d'opérations ou de sécurité qui ne sont pas disponibles lors de l'exécution. Les données télémétriques améliorées sont plus significatives et exploitables pour un dépannage efficace, une analyse des causes profondes et une optimisation des performances.
Pour plus d'informations, voir Enrichir les données.
Archivage des journaux pour un stockage à long terme
Sur IBM Cloud Logs, vous pouvez configurer un seau de données et un seau de mesures sur IBM Cloud Object Storage pour le stockage à long terme et la recherche de vos journaux et de vos mesures. Il n'est pas nécessaire de réindexer les journaux de l'archive pour explorer et interroger les données archivées. Vous pouvez utiliser les mêmes requêtes et tableaux de bord que pour le contrôle initial des données.
Dans l'optimiseur TCO, vous configurez des règles qui définissent le pipeline de données qui traite les données après l'ingestion. Pour les données traitées par les pipelines Analyser et alerter ou Stockage et recherche, les données ne sont envoyées qu'au seau. Toutes les données que vous choisissez de stocker pour la recherche dans tous les pipelines de données TCO sont stockées dans les buckets de données et de métriques.
Les données sont stockées après l'application des politiques d'enrichissement et des règles d'analyse. Les données stockées à long terme comprennent les informations contextuelles que vous choisissez d'ajouter et toute restructuration supplémentaire des données du journal qui est appliquée pour améliorer votre surveillance, votre analyse et votre dépannage.
Pour plus d'informations, voir Configuration des godets pour le stockage et la recherche à long terme.
Interroger les données afin d'obtenir des informations pour le dépannage et l'analyse
Avec IBM Cloud Logs, vous pouvez rechercher et interroger facilement toutes les données conservées par IBM Cloud Logs.
Les données sont stockées dans IBM Cloud Object Storage dans un format compatible avec la recherche. Lorsque des résultats de recherche rapide sont nécessaires, les données peuvent également être stockées dans un stockage à chaud pour obtenir des informations de priorité sur les données. Les résultats de requête pour le stockage à chaud et les compartiments peuvent être affichés dans les mêmes tableaux de bord et vues.
IBM Cloud Logs offre plusieurs outils pour interroger efficacement les données:
- Recherche booléenne simple.
- Expressions régulières ( RegEx queries) pour faire correspondre des modèles dans votre journal.
- Requêtes basées sur Apache Lucene pour l'interrogation des valeurs clés.
- Requêtes basées sur le langage IBM Cloud Logs DataPrime. Dataprime est une syntaxe d'interrogation permettant de décrire les transformations et les agrégations d'événements. Vous pouvez utiliser DataPrime pour explorer les données, effectuer des transformations de schéma en lecture, grouper et agréger des champs, extraire des données, et bien plus encore.
- Prometheus Query Language ( PromQL ) pour sélectionner et agréger des données de séries temporelles dérivées de vos journaux.
Une aide assistée est disponible pour créer des requêtes pour l'analyse complexe.
Pour plus d'informations, voir Interroger les données.
Améliorer la visibilité opérationnelle afin d'obtenir des informations pour une meilleure analyse
Sur IBM Cloud Logs, vous pouvez améliorer la visibilité opérationnelle en configurant des tableaux de bord afin d'obtenir des informations permettant d'améliorer l'analyse, le dépannage et la prise de décision concernant les environnements et les applications de votre organisation.
Vous pouvez créer un nombre illimité de tableaux de bord personnalisés, adaptés à vos besoins spécifiques en matière d'observabilité, ou tirer parti de tableaux de bord prédéfinis pour vous aider à analyser et à visualiser les données d'enregistrement.
Les tableaux de bord, associés à l'analyse de l'apprentissage automatique sur IBM Cloud Logs, permettent aux SRE d'identifier rapidement le début d'un incident avant qu'il ne devienne un problème important.
Pour plus d'informations, voir Tableaux de bord.
Des alertes et des tableaux de bord préconfigurés sont disponibles sous forme d'extensions pour les environnements d'application courants et peuvent être adaptés aux besoins spécifiques de votre environnement. Pour plus d'informations, voir Extensions.
Notifier les problèmes afin de sensibiliser et d'agir rapidement
Vous pouvez configurer des alertes pour détecter et traiter les problèmes avant que les utilisateurs ne les remarquent, en vous avertissant de manière proactive.
Des règles d'alerte sophistiquées peuvent être configurées pour réduire le temps de triage. En voici quelques exemples :
-
Notification lorsqu'une combinaison d'événements d'alerte se produit dans un ensemble défini de critères.
-
Réception d'alertes lorsque de nouvelles erreurs ou de nouveaux types de journaux sont détectés, ou lorsque des valeurs anormales se produisent sur des données établies.
Pour plus d'informations, voir Alertes.
Contrôle de la gestion des incidents
IBM Cloud Logs permet de contrôler la gestion des incidents d'alerte. Ce contrôle permet de gérer le fonctionnement des charges de travail et des environnements complets avec des fenêtres de maintenance qui peuvent être gérées dans l'outil. Lorsque des incidents complexes se produisent et déclenchent plusieurs alarmes, les utilisateurs peuvent voir la situation rapidement dans IBM Cloud Logs. La gestion des alertes configurée dans IBM Cloud Logs peut supprimer les alertes inutiles aux autres solutions de gestion des alertes.
Pour plus d'informations, voir Gestion des alertes déclenchées sur IBM Cloud Logs.
Intégration à d'autres applications
IBM Cloud Logs est conçu pour s'intégrer aux outils de gestion des applications et des systèmes les plus courants et s'intègre dans la plupart des chaînes d'outils. Le partage de données avec d'autres outils opérationnels est intégré par conception:
-
Intégration aux outils de gestion des alertes à l'aide de valeurs de webhook dans les messages d'alerte afin que les informations soient incluses dans l'alerte. Ces informations peuvent être utilisées pour identifier rapidement la source qui a déclenché l'alerte.
-
Partagez les données d'alerte avec le service IBM Cloud Event Notifications pour une visibilité et un contrôle complets de la gestion des alertes IBM Cloud.
-
Partagez des données d'alerte avec PagerDuty et d'autres outils de gestion des alertes spécialisés.
-
S'intègre à d'autres outils d'observabilité, SIEM et d'analyse de données. IBM Cloud Logs peut envoyer des données à IBM® Event Streams for IBM Cloud®, une implémentation de service Kafka, où les données peuvent être partagées avec une grande variété d'outils et d'applications.
Pour plus d'informations sur l'intégration à l'aide de IBM Cloud Event Notifications, voir Travailler avec des alertes. Pour plus d'informations sur la diffusion en continu à l'aide de IBM® Event Streams for IBM Cloud®, voir Flux de données