Merci d'avoir envoyé votre demande ! Un membre de notre équipe vous contactera sous peu.
Merci d'avoir envoyé votre réservation ! Un membre de notre équipe vous contactera sous peu.
Plan du cours
1. Introduction à Stable Diffusion avancé
- Objectifs du cours et parcours d'apprentissage
- Revue des modèles de diffusion
- Aperçu de l'architecture de Stable Diffusion
- Modèles de diffusion latente (LDM)
- Évolution des modèles Stable Diffusion (SD 1.x, SDXL et architectures plus récentes)
- Cas d'utilisation et applications en entreprise
2. Fondamentaux de l'apprentissage profond pour les modèles de diffusion
- Fondements du processus de diffusion
- Diffusion avant et arrière
- Prédiction du bruit
- Architecture U-Net de débruitage
- Autoencodeurs variationnels (VAE)
- Encodeur textuel CLIP
- Mécanismes d'attention croisée
3. Compréhension de l'architecture Stable Diffusion
- Composants du pipeline
- Processus d'encodage textuel
- Représentation dans l'espace latent
- Algorithmes de planification
- Méthodes d'échantillonnage
- Flux de travail de décodage des images
4. Ingénierie avancée des invites (prompts)
- Structure et syntaxe des invites
- Invites positives et négatives
- Mise en poids des invites
- Mise en évidence des tokens
- Interpolation des invites
- Stratégies d'optimisation des invites
- Génération d'images reproductibles
5. Techniques avancées de génération d'images
- Génératiion image-vers-image
- Inpainting (remplissage partiel)
- Outpainting (extension d'image)
- Génération haute résolution
- Affinement multistade
- Génération d'images par lots
- Randomisation contrôlée à l'aide de graines (seeds)
6. Génération d'images conditionnelle
- Architecture ControlNet
- Génération guidée par la posture
- Génération guidée par la profondeur
- Conditionnement par détection de contours
- Guidage par segmentation
- Conditionnement par image de référence
- Pipelines multi-ControlNet
7. LoRA, DreamBooth et affinement des modèles
- Concepts d'apprentissage par transfert
- Fondements de LoRA
- Entraînement DreamBooth
- Inversion textuelle
- Embeddings personnalisés
- Ensembles de données pour l'affinement
- Évaluation des modèles personnalisés
8. Entraînement avancé des modèles
- Préparation des ensembles de données
- Augmentation des données
- Génération de légendes (captions)
- Pipelines d'entraînement
- Entraînement distribué
- Entraînement en précision mixte
- Gestion des points de contrôle (checkpoints)
9. Optimisation des hyperparamètres
- Sélection du taux d'apprentissage
- Optimisation de la taille des lots
- Sélection du planificateur (scheduler)
- Optimisation de l'échelle CFG
- Nombre d'étapes d'échantillonnage
- Techniques de régularisation
- Métriques d'évaluation des modèles
10. Optimisation des performances
- Optimisation du GPU
- Optimisation CUDA
- Attention à faible coût mémoire
- Optimisation avec xFormers
- Techniques de quantification
- Inférence FP16 et BF16
- Mise en lots efficace
11. Mise à l'échelle des charges de travail Stable Diffusion
- Entraînement multi-GPU
- Inférence distribuée
- Gestion des ensembles de données à grande échelle
- Déploiement GPU dans le cloud
- Stratégies de service des modèles
- Étalonnage des performances (benchmarking)
12. Intégration de Stable Diffusion avec des frameworks d'apprentissage profond
- Hugging Face Diffusers
- Intégration PyTorch
- Interopérabilité TensorFlow
- ONNX Runtime
- Optimisation TensorRT
- Bibliothèque Accelerate
- Personnalisation des pipelines
13. Construction de pipelines de production
- Développement d'API
- Services d'inférence par lots
- Automatisation des flux de travail
- Génération basée sur des files d'attente
- Versionnement des modèles
- Stratégies de déploiement en production
14. Amélioration de la qualité des images
- Techniques de mise à l'échelle (upscaling)
- Super-résolution
- Réstitution des visages
- Réduction des artéfacts
- Flux d'affinement des images
- Pipelines de post-traitement
15. Intelligence artificielle responsable et sécurité des modèles
- Biais dans les modèles génératifs
- Génération éthique d'images
- Considérations relatives aux droits d'auteur
- Déclaration du contenu généré par l'IA
- Filtres de sécurité
- Modération des invites (prompts)
- Pratiques de déploiement responsable
16. Dépannage et débogage
- Diagnostic des échecs de génération
- Résolution des erreurs CUDA
- Gestion des problèmes de mémoire
- Amélioration de la cohérence des images
- Débogage des pipelines personnalisés
- Dépannage des performances
17. Surveillance et évaluation des modèles
- Mesure de la qualité de génération
- Étalonnage des modèles (benchmarking)
- Comparaison des points de contrôle (checkpoints)
- Journalisation des expériences
- Suivi des expériences
- Reproductibilité des modèles
18. Applications avancées
- Visualisation de la conception de produits
- Génération de contenu marketing
- Conception de personnages
- Visualisation architecturale
- Recherche en imagerie médicale
- Visualisation scientifique
- Flux de travail créatifs d'IA
19. Intégration de Stable Diffusion avec d'autres modèles d'IA
- Grands modèles de langage (LLM)
- Modèles vision-langage (VLM)
- Légendage d'images (captioning)
- Génération augmentée par récupération (RAG) pour les systèmes multimodaux
- Flux de travail des agents IA
- Orchestration multi-modèles
20. Meilleures pratiques pour le déploiement en entreprise
- Planification de l'infrastructure
- Gestion des ressources GPU
- Considérations de sécurité
- Gouvernance des modèles
- CI/CD pour les modèles IA
- Maintenance et mises à jour
21. Atelier pratique et résumé
- Construction d'un pipeline complet de génération d'images
- Affinement d'un modèle Stable Diffusion personnalisé
- Création d'un flux de travail de génération automatisé
- Exercices d'optimisation des performances
- Évaluation et comparaison des modèles
- Revue des concepts clés
- Questions et réponses
- Prochaines étapes et ressources d'apprentissage supplémentaires
Pré requis
- Bonne compréhension des concepts et architectures de l'apprentissage profond
- Connaissance de Stable Diffusion et de la génération d'images à partir de texte
- Expérience avec PyTorch et la programmation en Python
Audience cible
- Data scientists et ingénieurs en apprentissage automatique
- Chercheurs en apprentissage profond
- Experts en vision par ordinateur.
21 Heures