LOG#32026.07.24 à 14:465 min de lecture

Expérimentation Comfyui

Afin de générer des images sans dépendre du cloud, il est aujourd’hui possible d’utiliser des outils open source directement en local. Parmi eux, ComfyUI se distingue par sa puissance et sa flexibilité.

TL;DR

  • Installation en local en 2h
  • Nécessite un GPU NVIDIA
  • Interface avancée mais très puissante
  • Génération d’images sans limite ni coût par requête [Mais ça utilise électricité]

Pourquoi générer des images en local ?

Les services cloud comme Midjourney ou DALL·E sont simples d’accès, mais ils présentent plusieurs limites :

  • Coût par utilisation
  • Dépendance à une connexion internet
  • Données envoyées à des services externes
  • Moins de contrôle sur les modèles

Je veux utiliser au moment ou j'en ai besoin.

En local, je garde un contrôle total : pas de limite, pas de latence réseau, et une confidentialité complète. [Mais c'est très technique]

Qu’est-ce que ComfyUI ?

ComfyUI est une interface de génération d’images basée sur un système de nœuds (node-based). Cela ressemble visuellement à un graphe.

Contrairement aux interfaces classiques, je construis un pipeline visuel : chaque bloc représente une étape (chargement du modèle, prompt, génération, enlever le fond, etc.).

Cela me rend plus technique au départ, mais aussi beaucoup plus flexible et puissant.

Mon environnement

Voici la configuration, construite en 2023, utilisée pour cet article :

  • OS : Windows 10 avec WSL2 (Ubuntu)
  • GPU : RTX 4060 Ti (16 Go VRAM)
  • RAM : 32 Go
  • Stockage : disque dédié (D:\AI_Data)

Cette configuration me permet de générer des images rapidement avec des modèles récents. Par exemple : Créer des sprites pour les intégrer dans des compositions plus complexe.

Installation de ComfyUI

J’ai installé ComfyUI en quelques étapes :

  1. Télécharger la version portable NVIDIA de ComfyUI
  2. Extraire l’archive avec 7-Zip
  3. Ajouter ComfyUI-Manager (extensions) [Jusqu'ici, espace disque occupé ~4 Go]
  4. Télécharger un modèle (ex : FLUX.1 Schnell) [⏳ ~17 Go]
  5. Lancer le fichier run_nvidia_gpu.bat [Attendre ...]

Une fois lancé, l’interface est accessible via :
http://127.0.0.1:8188

Ajouter des extensions

ComfyUI-Manager est un outil essentiel qui me permet d'installer facilement des extensions.

Une fois installé, un bouton “Manager” apparaît dans l’interface, facilitant la gestion des modules supplémentaires.

Télécharger un modèle

Un modèle est le “cerveau” qui génère les images.

Dans cet exemple, j’ai utilisé FLUX.1 Schnell (FP8) :

  • Rapide
  • Bonne qualité
  • Optimisé pour la VRAM

Le fichier est volumineux (~17 Go), le téléchargement peut prendre du temps, mais ça en vaut la peine !

Premier lancement

Au premier démarrage :

  • J’ai lancé le fichier .bat
  • J’ai ouvert mon navigateur sur localhost
  • J’ai vérifié que l’interface se chargeait correctement
  • J’ai assuré que le bouton “Manager” est bien présent

Je suis maintenant prêt à générer mes premières images.

Premiers résultats

Une fois configuré, je peux créer mes premiers workflows et générer des images en quelques secondes.

Exemple : en anglais en cas de doute !

  • Prompt : “A surreal meme-style image: A small vintage Apple Macintosh SE/30 (beige, iconic design) floating in big stormy digital waters Text overlay on the screen Apple Macintosh: "500: STABILITY FAILURE", with a red lifebuoy attached to it. A little black cat sitting on the computer with red eyes. In the background, a Rounded ticking time bomb (black, old-school, with a fuse) labeled 'DEPENDENCIES'. The scene is chaotic but humorous, with pixelated waves made of cloudy letters. Bright, saturated colors, 90s internet meme aesthetic, bold outlines, and a 'DOOM' vibe. Everything is perfectly centered on the stage.”
  • Temps de génération : quelques minutes avec GPU
  • Résultat : après plusieurs itérations, j'obtiens une image générée localement, et je la valide.

Conclusion

ComfyUI est un outil extrêmement puissant pour la génération d’images en local.

Il demande un peu plus de prise en main que d’autres interfaces, mais offre en échange un contrôle total et des possibilités avancées.

Si je souhaite aller plus loin dans la génération d’images avec l’IA, c’est une excellente base. À garder sous la main !!!

Illumination

Et pourquoi pas faire appel à l’IA pour générer les workflows au format JSON ?

Parce que ComfyUI, c’est du code visuel,... en JSON. Chaque noeud, chaque paramètre, chaque flux est codé dans un fichier textuel avant même d’apparaître sur l’interface.

Un LLM, si je lui donne les bonnes informations pourrait créer le fichier Workflows au format JSON.

Exemple de prompt :

  • Prend en entrée ma photo de portrait (format IMAGE)
  • Intègre un nœud FaceSwap, avec le modèle RealESRGAN_x4plus_anime6B
  • Utilise les dépendances nécessaires : VAE, checkpoint SDXL ou FLUX.1 Schnell
  • Ajoute des effets de néon en sortie (via nœuds Neon Glow ou Style Transfer)
  • Fournit les liens directs pour télécharger tous les modèles sur Hugging Face / CivitAI — et surtout, inclut une instruction pour copier ces fichiers dans le dossier models\checkpoints sous WSL