Prenez contact avec nous

Plan du cours

Introduction à l'architecture des GPU Biren

  • Aperçu de Biren et cas d'utilisation
  • Disposition matérielle : cœurs, mémoire, clusters de calcul
  • Comparaison avec les GPU NVIDIA et AMD

Configuration de l'environnement de programmation Biren

  • Installation du SDK et du runtime Biren
  • Comprendre la chaîne d'outils et le modèle du compilateur
  • Structure de projet de base et processus de compilation

Programmation GPU avec la pile Biren

  • Modèles de fil et de bloc
  • Gestion de la mémoire et transferts de données
  • Développement de noyaux et motifs de lancement

Portage de CUDA vers Biren

  • Techniques de traduction pour le code CUDA
  • Mappages et adaptations courants des API
  • Laboratoires de conversion de code et pratique

Débogage et profilage

  • Utilisation du débogueur et du profilage de Biren
  • Identification des goulets d'étranglement
  • Motifs d'accès à la mémoire et optimisation

Techniques d'optimisation

  • Planification des fil et pipeline d'instructions
  • Déroulement des boucles et utilisation de la mémoire partagée
  • Ajustement avancé des noyaux pour le débit

Étude de cas et exemples d'application

  • Entraînement d'un modèle avec des accélérateurs Biren
  • Portage et profilage d'un modèle de vision ou de NLP
  • Comparaison des performances par rapport à CUDA/NVIDIA

Résumé et prochaines étapes

Pré requis

  • Une compréhension de l'architecture des GPU et du traitement parallèle
  • Une expérience avec CUDA, OpenCL ou des environnements de programmation GPU similaires
  • Une familiarité avec les cadres d'entraînement profond tels que PyTorch ou TensorFlow

Public cible

  • Développeurs HPC
  • Ingénieurs en infrastructure IA
  • Spécialistes de l'optimisation des performances
 21 Heures

Nombre de participants


Prix par participant

Nos clients témoignent (2)

Cours à venir

Catégories Similaires