Prenez contact avec nous

Plan du cours

Introduction à Apache Spark

  • Le rôle de Spark dans le traitement des mégadonnées (big data)
  • Architecture de Spark et ses composants

Installation d'Apache Spark

  • Exigences matérielles et logicielles
  • Procédures d'installation pour les modes autonome et en cluster
  • Meilleures pratiques de configuration pour les administrateurs systèmes

Administration des clusters Spark

  • Outils et techniques de gestion de cluster
  • Surveillance des applications Spark et des ressources du cluster
  • Configurations de sécurité et gestion des utilisateurs

Optimisation des performances

  • Allocation des ressources et ordonnancement
  • Réglage de Spark pour des performances optimales
  • Identification et résolution des goulets d'étranglement courants

Dépannage et résolution de problèmes

  • Défis courants dans l'administration de Spark
  • Outils et techniques de diagnostic pour le dépannage
  • Approche étape par étape pour résoudre les problèmes courants
  • Meilleures pratiques pour maintenir un environnement Spark sain

Thèmes avancés d'administration

  • Intégration avec d'autres outils de mégadonnées (big data)
  • Garantie de la haute disponibilité et de la reprise après sinistre
  • Upgrade et mise à l'échelle des clusters Spark

Pré requis

  • Connaissances de base en configuration et en gestion de réseaux
  • Familiarité avec le système d'exploitation Linux et l'interface en ligne de commande
  • Intérêt pour l'apprentissage des systèmes de calcul distribués et de la gestion des mégadonnées (big data)

Public cible

  • Administrateurs systèmes
 35 Heures

Nombre de participants


Prix par participant

Nos clients témoignent (3)

Cours à venir

Catégories Similaires