Prenez contact avec nous

Plan du cours

Fondamentaux multimodales Hunyuan et configuration du laboratoire

  • Compréhension des capacités multimodales de Hunyuan pour les cas d'utilisation image, 3D et vidéo.
  • Identification de scénarios business pratiques pour les équipes créatives, produits et éditoriales.
  • Préparation de l'environnement de laboratoire, des exemples d'actifs et de l'accès aux modèles.
  • Réalisation des premières tâches de génération et évaluation des outputs.

Conception des prompts et patterns de workflow

  • Structuration des prompts pour obtenir des résultats multimodaux cohérents.
  • Travail avec des prompts textuels, des images de référence et des paramètres d'entrée basiques.
  • Sélection des workflows adaptés à la génération d'images, de vidéos ou de contenu 3D.
  • Irration des prompts en fonction de la qualité des outputs et de l'intention business.

Laboratoires de génération et d'évaluation d'images

  • Création d'images marketing, produits et concepts à partir de prompts.
  • Affinement du style visuel, de la composition et de la cohérence du contenu.
  • Évaluation des outputs quant à leur utilité, leur qualité et leur adéquation avec l'image de marque.
  • Organisation des sorties d'images pour l'approbation et leur utilisation ultérieure.

Laboratoires de génération vidéo

  • Création de courtes vidéos à partir de prompts et d'entrées préparées.
  • Contrôle du style, de l'intention des scènes et de la variabilité des outputs.
  • Évaluation des vidéos quant à leur clarté, leur continuité et leur utilité pratique.
  • Préparation des sorties vidéo pour les démonstrations ou les workflows éditoriaux.

Laboratoires de création d'actifs 3D

  • Génération d'actifs 3D basiques à partir d'entrées textuelles ou visuelles.
  • Vérification de la géométrie, de la qualité des textures et de l'utilité des actifs.
  • Exportation des actifs pour la visualisation, le prototypage ou les pipelines éditoriaux.
  • Comparaison entre l'utilisation de la génération 3D et celle des workflows image ou vidéo.

Intégration, gouvernance et prochaines étapes

  • Déploiement des actifs générés via des applications simples, des services ou des APIs.
  • Connexion des sorties multimodales aux workflows produits, éditoriaux et d'approbation.
  • Mise en œuvre de contrôles pratiques pour la qualité, la sécurité de l'image de marque, les droits d'auteur et une utilisation responsable.
  • Planification de cas pilotes et des prochaines étapes pour l'adoption interne.

Pré requis

  • Compréhension de base des concepts relatifs à l'IA et à l'IA générative.
  • Expérience dans l'utilisation d'applications web, d'API ou d'outils de développement courants.
  • Notions de base en Python ou en scriptage.

Audience visée

  • Développeurs créant des fonctionnalités produits alimentées par l'IA.
  • Chefs de produit techniques et architectes de solutions.
  • Équipes innovation, médias et digital travaillant avec des contenus image, vidéo ou 3D.
 14 Heures

Nombre de participants


Prix par participant

Cours à venir

Catégories Similaires