Merci d'avoir envoyé votre demande ! Un membre de notre équipe vous contactera sous peu.
Merci d'avoir envoyé votre réservation ! Un membre de notre équipe vous contactera sous peu.
Durée 14 heures
Plan du cours
Introduction à l’AIOps
- Qu’est-ce que l’AIOps et pourquoi est-ce important
- Supervision traditionnelle par rapport à l’observabilité pilotée par l’AIOps
- Architecture de l’AIOps et composants clés
Collecte et normalisation des données opérationnelles
- Types de données d’observabilité : mesures, journaux et traces
- Ingestion de données à partir de multiples sources (serveurs, conteneurs, cloud)
- Utilisation d’agents et d’exportateurs (Prometheus, Beats, Fluentd)
Corrélation des données et détection d’anomalies
- Corrélation des séries chronologiques et méthodes statistiques
- Utilisation de modèles d’IA pour la détection d’anomalies
- Détection des incidents au sein des systèmes distribués
Alertes et réduction du bruit
- Conception de règles et de seuils d’alerte intelligents
- Suppression, déduplication et regroupement des alertes
- Intégration avec Alertmanager, Slack, PagerDuty ou Opsgenie
Analyse des causes racines et visualisation
- Utilisation des tableaux de bord pour visualiser les mesures et détecter les tendances
- Exploration des événements et des chronologies pour l’analyse des causes racines (RCR)
- Suivi des problèmes à travers les couches à l’aide d’outils de traçage distribué
Automatisation et remédiation
- Déclenchement de scripts ou de flux de travail automatisés à partir d’incidents
- Intégration avec les systèmes ITSM (ServiceNow, Jira)
- Cas d’usage : auto-réparation, dimensionnement dynamique, redirigement du trafic
Plateformes AIOps open source et commerciales
- Aperçu des outils : Prometheus, Grafana, ELK, Moogsoft, Dynatrace
- Critères d’évaluation pour la sélection d’une plateforme AIOps
- Démonstration et manipulation d’une pile sélectionnée
Résumé et prochaines étapes
Pré requis
- Compréhension des concepts d’exploitation TI et de supervision des systèmes.
- Expérience avec les outils de supervision ou les tableaux de bord.
- Familiarité avec les formats de base des journaux et des mesures.
Audience
- Équipes d’exploitation responsables des infrastructures et des applications.
- Ingénieurs de fiabilité des sites (SRE).
- Équipes de supervision et d’observabilité TI.