ComfyUI? Wat is dat? Dikke kans dat je dat denkt, maar ook dat dat de komende jaren vrij snel gaat veranderen. ComfyUI is een gratis, opensource, geavanceerde tool gericht op het configureren van AI modellen. Het is nodebased, wat betekent dat het een grafische interface is om stukken pythoncode (de 'nodes') te verbinden. Het lijkt voor de leek een complex programma, omdat het dat ook kan worden als je veel controle wil over AI generatie. Maar... wie verder kijkt ziet dat de basis simpel is en eigenlijk iedereen binnen een kwartier zijn eigen afbeelding kan produceren. Het programma is dus een goed voorbeeld van easy to learn, hard to master.
Even een teaser om je te laten schrikken, zo ziet het eruit

Dat lijkt een stuk enger dan het is, dus ik neem je even mee!
Een groffe tabel met een tip om makkelijk en snel te starten met minimale gpu:
Zoals je ziet staat er steeds een Q4 of (NV)FP4 en een nummer B nummer in de modelnaam. Beide betekenen iets anders.
B = hoeveel miljard parameters (getrainde verbindingen) een model heeft. Hoe hoger, hoe beter. 3B, 4B en 7B zijn vrij gangbare kleine modellen die goed lokaal te draaien zijn. De meest complexe modellen die op consumentenhardware draaien zijn zo'n 27B-35B groot. Voor de beeldvorming; een bekend opensourcemodel als Deepseek V3 heeft 385B.
Q / (nv)fp = Naast het aantal parameters is elk model ook in verschillende kwantisaties. Een basis model is FP16 of BF16, maar door deze te kwantiseren tot Q8 of lager is met behoud van vaak meer dan 90% van de kwaliteit het model met minder vram te gebruiken. Soms doen de makers dat zelf, maar ook veel vrijwilligers plaatsen op sites als HuggingFace kleinere zelf gebouwde versies van opensource modellen. Q4 of fp4 is vaak relatief best goed, maar wel flink kleiner dan het basis FP16 model en de keus waarvoor je gaat. Ook zijn er nog voor nvidia (nvfp) en apple (mlx) geoptimaliseerde modellen.
De mix van parameters en kwantisatie bepaalt hoe groot het model is in gigabytes en dat is belangrijk bij het kiezen van het model. Heb je een 12GB videokaart, dan wil je een model dat in ieder geval niet groter is dan 12GB (met wat marge is 10 vaak al de grens). Ga je er overheen, dan gaat je pc delen van de AI klus in comfyUI offloaden naar het ramgeheugen en ga je al snel 20x langzamer genereren.
Vuistregel; begin met een (nv)fp/q4 model met zoveel mogelijk miljoen parameters dat voor 75% in je vram past. Bijv: Flux Klein 4B nvfp4 is 4 gb groot en past dus keurig in een gpu van 8 gb, is voor vrijwel elke instap grafische kaart een mooi model om mee te starten.
Een goede, maar zéér uitgebreide handleiding vind je op het kanaal van Pixorama. Handleidingen zijn gedetailleerd, maar daardoor wordt alles zeer goed behandeld. Alles wat je maar wil doen (video, afbeelding, muziek etc): van alles staan goede tutorials op het kanaal en ook wordt het zelf verder optimaliseren gedetailleerd uitgelegd. De basiscursus duurt 'maar' 5 uur:Voor nu even genoeg, ik zal het binnenkort meer gaan uitwerken en waar nodig actualiseren; ik zou zeggen: probeer Comfy eens uit! Alvast veel plezier en stel gerust vragen of help elkaar hier verder
Even een teaser om je te laten schrikken, zo ziet het eruit

Dat lijkt een stuk enger dan het is, dus ik neem je even mee!
Wat zijn de mogelijkheden?
ComfyUI is begonnen als tool om met een grafische schil lokale AI modellen te kunnen configureren. De bekende Copilot/ChatGPT/Gemini chatbot die je in de cloud gebruikt is feitelijk een alles-in-één model, ofwel multimodaal model. Je kan er tekst, plaatjes, filmpjes en geluid mee produceren (hoewel met name die laatste 2 energie-intensief zijn). Zeker in de begintijd was dit voor lokale modellen te complex en ontstonden unimodale modellen voor de meest simpele output: taal. Tools die hiervoor geschikt zijn vind je in dit topic. Met de komst van meer krachtige hardware en doorontwikkeling van AI modellen, ontstonden daarna unimodale modellen voor complexere output als video, en dit is waar ComfyUI zich op richt. De mogelijkheden zijn onder andere:- afbeeldingen genereren
- video's genereren
- muziek genereren
- 3D modellen
- spraak genereren
Benodigdheden voor lokaal genereren met ComfyUI
Wat je aan hardware nodig hebt is afhankelijk van de complexiteit van de taak. Dat loopt van relatief goed te doen en lage hardware-eisen (afbeeldingen) via spraak genereren (iets lastiger) en muziek of 3D modellen genereren (wordt al intensiever) naar zeer complex met forse hardware-investeringen (video).Een groffe tabel met een tip om makkelijk en snel te starten met minimale gpu:
| Taak | Minimale Vram GPU | Interessant model om mee te starten |
|---|---|---|
| Afbeeldingen | 8 GB VRAM | Flux 2 Klein 4B distilled of SDXL-light 4B Q4 |
| Video's | 16 GB VRAM | LTX 2.3 nvfp4; Wan 2.2 14B GGUF BF4 |
| Muziek | 4 GB VRAM | ACE-Step 1.5; Q4 |
| 3D modellen | 10 GB VRAM | Hunyuan3D 2.1; W4 |
| Spraak | 6 GB VRAM | VibeVoice-1.5B Q4 |
B = hoeveel miljard parameters (getrainde verbindingen) een model heeft. Hoe hoger, hoe beter. 3B, 4B en 7B zijn vrij gangbare kleine modellen die goed lokaal te draaien zijn. De meest complexe modellen die op consumentenhardware draaien zijn zo'n 27B-35B groot. Voor de beeldvorming; een bekend opensourcemodel als Deepseek V3 heeft 385B.
Q / (nv)fp = Naast het aantal parameters is elk model ook in verschillende kwantisaties. Een basis model is FP16 of BF16, maar door deze te kwantiseren tot Q8 of lager is met behoud van vaak meer dan 90% van de kwaliteit het model met minder vram te gebruiken. Soms doen de makers dat zelf, maar ook veel vrijwilligers plaatsen op sites als HuggingFace kleinere zelf gebouwde versies van opensource modellen. Q4 of fp4 is vaak relatief best goed, maar wel flink kleiner dan het basis FP16 model en de keus waarvoor je gaat. Ook zijn er nog voor nvidia (nvfp) en apple (mlx) geoptimaliseerde modellen.
De mix van parameters en kwantisatie bepaalt hoe groot het model is in gigabytes en dat is belangrijk bij het kiezen van het model. Heb je een 12GB videokaart, dan wil je een model dat in ieder geval niet groter is dan 12GB (met wat marge is 10 vaak al de grens). Ga je er overheen, dan gaat je pc delen van de AI klus in comfyUI offloaden naar het ramgeheugen en ga je al snel 20x langzamer genereren.
Vuistregel; begin met een (nv)fp/q4 model met zoveel mogelijk miljoen parameters dat voor 75% in je vram past. Bijv: Flux Klein 4B nvfp4 is 4 gb groot en past dus keurig in een gpu van 8 gb, is voor vrijwel elke instap grafische kaart een mooi model om mee te starten.
Een makkelijke start
Oei! Dat klinkt complex hierboven! Ja dat klopt, maar is handig voor wie iets meer wil snappen. Gelukkig is heel simpel starten ook weer écht overzichtelijk- Download comfyUI als Desktop variant vanaf www.comfy.org (de officiële site). Pas op dat er veel nepwebsites rondom de comfyUI naam op google te vinden zijn.
- Via Youtube kom je echt heel ver met de tutorials. Ik raad aan om hier te beginnen:
Een goede, maar zéér uitgebreide handleiding vind je op het kanaal van Pixorama. Handleidingen zijn gedetailleerd, maar daardoor wordt alles zeer goed behandeld. Alles wat je maar wil doen (video, afbeelding, muziek etc): van alles staan goede tutorials op het kanaal en ook wordt het zelf verder optimaliseren gedetailleerd uitgelegd. De basiscursus duurt 'maar' 5 uur:Voor nu even genoeg, ik zal het binnenkort meer gaan uitwerken en waar nodig actualiseren; ik zou zeggen: probeer Comfy eens uit! Alvast veel plezier en stel gerust vragen of help elkaar hier verder
[ Voor 15% gewijzigd door DeNachtwacht op 28-06-2026 18:16 ]
/f/image/lQHxSG3MdJdzJV95t72hnB7q.png?f=fotoalbum_small)
/f/image/5S2jwtKFcJi4X3eOb5wOnUP3.png?f=fotoalbum_small)
/f/image/Ty3qxMw4heIxT7kyrwLTY5mg.png?f=fotoalbum_large)