Prenez contact avec nous
 Durée 14 heures

Plan du cours

Introduction à l’AIOps

  • Qu’est-ce que l’AIOps et pourquoi est-ce important
  • Supervision traditionnelle par rapport à l’observabilité pilotée par l’AIOps
  • Architecture de l’AIOps et composants clés

Collecte et normalisation des données opérationnelles

  • Types de données d’observabilité : mesures, journaux et traces
  • Ingestion de données à partir de multiples sources (serveurs, conteneurs, cloud)
  • Utilisation d’agents et d’exportateurs (Prometheus, Beats, Fluentd)

Corrélation des données et détection d’anomalies

  • Corrélation des séries chronologiques et méthodes statistiques
  • Utilisation de modèles d’IA pour la détection d’anomalies
  • Détection des incidents au sein des systèmes distribués

Alertes et réduction du bruit

  • Conception de règles et de seuils d’alerte intelligents
  • Suppression, déduplication et regroupement des alertes
  • Intégration avec Alertmanager, Slack, PagerDuty ou Opsgenie

Analyse des causes racines et visualisation

  • Utilisation des tableaux de bord pour visualiser les mesures et détecter les tendances
  • Exploration des événements et des chronologies pour l’analyse des causes racines (RCR)
  • Suivi des problèmes à travers les couches à l’aide d’outils de traçage distribué

Automatisation et remédiation

  • Déclenchement de scripts ou de flux de travail automatisés à partir d’incidents
  • Intégration avec les systèmes ITSM (ServiceNow, Jira)
  • Cas d’usage : auto-réparation, dimensionnement dynamique, redirigement du trafic

Plateformes AIOps open source et commerciales

  • Aperçu des outils : Prometheus, Grafana, ELK, Moogsoft, Dynatrace
  • Critères d’évaluation pour la sélection d’une plateforme AIOps
  • Démonstration et manipulation d’une pile sélectionnée

Résumé et prochaines étapes

Pré requis

  • Compréhension des concepts d’exploitation TI et de supervision des systèmes.
  • Expérience avec les outils de supervision ou les tableaux de bord.
  • Familiarité avec les formats de base des journaux et des mesures.

Audience

  • Équipes d’exploitation responsables des infrastructures et des applications.
  • Ingénieurs de fiabilité des sites (SRE).
  • Équipes de supervision et d’observabilité TI.

Nombre de participants


Prix par participant

Cours à venir

Catégories Similaires