Expérimentation Comfyui
Afin de générer des images sans dépendre du cloud, il est aujourd’hui possible d’utiliser des outils open source directement en local. Parmi eux, ComfyUI se distingue par sa puissance et sa flexibilité.
TL;DR
- Installation en local en 2h
- Nécessite un GPU NVIDIA
- Interface avancée mais très puissante
- Génération d’images sans limite ni coût par requête [Mais ça utilise électricité]
Pourquoi générer des images en local ?
Les services cloud comme Midjourney ou DALL·E sont simples d’accès, mais ils présentent plusieurs limites :
- Coût par utilisation
- Dépendance à une connexion internet
- Données envoyées à des services externes
- Moins de contrôle sur les modèles
Je veux utiliser au moment ou j'en ai besoin.
En local, je garde un contrôle total : pas de limite, pas de latence réseau, et une confidentialité complète. [Mais c'est très technique]
Qu’est-ce que ComfyUI ?
ComfyUI est une interface de génération d’images basée sur un système de nœuds (node-based). Cela ressemble visuellement à un graphe.
Contrairement aux interfaces classiques, je construis un pipeline visuel : chaque bloc représente une étape (chargement du modèle, prompt, génération, enlever le fond, etc.).
Cela me rend plus technique au départ, mais aussi beaucoup plus flexible et puissant.
Mon environnement
Voici la configuration, construite en 2023, utilisée pour cet article :
- OS : Windows 10 avec WSL2 (Ubuntu)
- GPU : RTX 4060 Ti (16 Go VRAM)
- RAM : 32 Go
- Stockage : disque dédié (D:\AI_Data)
Cette configuration me permet de générer des images rapidement avec des modèles récents. Par exemple : Créer des sprites pour les intégrer dans des compositions plus complexe.
Installation de ComfyUI
J’ai installé ComfyUI en quelques étapes :
- Télécharger la version portable NVIDIA de ComfyUI
- Extraire l’archive avec 7-Zip
- Ajouter ComfyUI-Manager (extensions) [Jusqu'ici, espace disque occupé ~4 Go]
- Télécharger un modèle (ex : FLUX.1 Schnell) [⏳ ~17 Go]
- Lancer le fichier
run_nvidia_gpu.bat[Attendre ...]
Une fois lancé, l’interface est accessible via :
http://127.0.0.1:8188
Ajouter des extensions
ComfyUI-Manager est un outil essentiel qui me permet d'installer facilement des extensions.
Une fois installé, un bouton “Manager” apparaît dans l’interface, facilitant la gestion des modules supplémentaires.
Télécharger un modèle
Un modèle est le “cerveau” qui génère les images.
Dans cet exemple, j’ai utilisé FLUX.1 Schnell (FP8) :
- Rapide
- Bonne qualité
- Optimisé pour la VRAM
Le fichier est volumineux (~17 Go), le téléchargement peut prendre du temps, mais ça en vaut la peine !
Premier lancement
Au premier démarrage :
- J’ai lancé le fichier
.bat - J’ai ouvert mon navigateur sur localhost
- J’ai vérifié que l’interface se chargeait correctement
- J’ai assuré que le bouton “Manager” est bien présent
Je suis maintenant prêt à générer mes premières images.
Premiers résultats
Une fois configuré, je peux créer mes premiers workflows et générer des images en quelques secondes.
Exemple : en anglais en cas de doute !
- Prompt : “A surreal meme-style image: A small vintage Apple Macintosh SE/30 (beige, iconic design) floating in big stormy digital waters Text overlay on the screen Apple Macintosh: "500: STABILITY FAILURE", with a red lifebuoy attached to it. A little black cat sitting on the computer with red eyes. In the background, a Rounded ticking time bomb (black, old-school, with a fuse) labeled 'DEPENDENCIES'. The scene is chaotic but humorous, with pixelated waves made of cloudy letters. Bright, saturated colors, 90s internet meme aesthetic, bold outlines, and a 'DOOM' vibe. Everything is perfectly centered on the stage.”
- Temps de génération : quelques minutes avec GPU
- Résultat : après plusieurs itérations, j'obtiens une image générée localement, et je la valide.
Conclusion
ComfyUI est un outil extrêmement puissant pour la génération d’images en local.
Il demande un peu plus de prise en main que d’autres interfaces, mais offre en échange un contrôle total et des possibilités avancées.
Si je souhaite aller plus loin dans la génération d’images avec l’IA, c’est une excellente base. À garder sous la main !!!
Illumination
Et pourquoi pas faire appel à l’IA pour générer les workflows au format JSON ?
Parce que ComfyUI, c’est du code visuel,... en JSON. Chaque noeud, chaque paramètre, chaque flux est codé dans un fichier textuel avant même d’apparaître sur l’interface.
Un LLM, si je lui donne les bonnes informations pourrait créer le fichier Workflows au format JSON.
Exemple de prompt :
- Prend en entrée ma photo de portrait (format
IMAGE) - Intègre un nœud FaceSwap, avec le modèle
RealESRGAN_x4plus_anime6B - Utilise les dépendances nécessaires : VAE, checkpoint SDXL ou FLUX.1 Schnell
- Ajoute des effets de néon en sortie (via nœuds Neon Glow ou Style Transfer)
- Fournit les liens directs pour télécharger tous les modèles sur Hugging Face / CivitAI — et surtout, inclut une instruction pour copier ces fichiers dans le dossier
models\checkpointssous WSL