Reviews

Stable Diffusion review: open source beeldgeneratie voor iedereen

Stable Diffusion review: open source beeldgeneratie voor iedereen

Wat is Stable Diffusion?

Stable Diffusion is een open source AI-model dat beelden genereert op basis van tekstprompts. Het model is ontwikkeld door Stability AI en voor het eerst uitgebracht in augustus 2022. Sindsdien is het uitgegroeid tot het meest gebruikte open source beeldgeneratiemodel ter wereld.

Het grote verschil met tools als Midjourney of OpenAI's beeldgeneratie: je draait Stable Diffusion op je eigen computer. Geen abonnement, geen wachtrij, geen censuur. Jij bepaalt alles.

Stable Diffusion is de Linux van AI beeldgeneratie, maximale vrijheid, maar je moet bereid zijn om te leren.

In 2026 is er een kanttekening bij die vergelijking: het open source landschap is drukker dan ooit. Naast FLUX (van Black Forest Labs, opgericht door de oorspronkelijke Stable Diffusion-architecten) is sinds eind 2025 ook Qwen-Image van Alibaba serieus meegekomen. SD, FLUX en Qwen-Image vullen elkaar inmiddels aan en veel gevorderde gebruikers werken met meerdere van deze modellen naast elkaar. Hieronder behandelen we het Stable Diffusion ecosysteem inclusief de positie van FLUX en Qwen-Image.

Wat is er veranderd sinds mei 2026?

Sinds de vorige update van dit artikel is er relatief weinig veranderd aan Stable Diffusion zelf, maar des te meer aan de omgeving eromheen. Dat is het belangrijkst om te weten voor wie dit artikel voor het laatst in het voorjaar las.

Geen nieuw officieel SD-model. Volgens de officiele nieuwspagina van Stability AI (stability.ai/news-updates, gecontroleerd op 6 september 2026) bestaan de 2026-aankondigingen uit Tech Coalition-lidmaatschap (11 februari), Brand Studio (8 april), Stable Audio 3.0 (20 mei) en een Series B-financiering (25 augustus). Er staat geen nieuw beeldmodel tussen. De laatste echte modelgeneratie voor beeldgeneratie blijft SD 3.5, uitgebracht in oktober 2024.

Wel snellere en zuinigere versies van SD 3.5. In augustus 2026 bracht Stability AI, in samenwerking met NVIDIA, TensorRT-geoptimaliseerde varianten van SD 3.5 uit: tot 2,3 keer snellere generatie op SD 3.5 Large en 1,7 keer snellere generatie op SD 3.5 Medium, met 40 procent minder VRAM-gebruik. Parallel daaraan verschenen AMD NPU-geoptimaliseerde varianten van SDXL en SD 3.5 Medium op Hugging Face, als resultaat van een samenwerking tussen Stability AI en AMD. Voor gebruikers met een krappere GPU is dat concreet nieuws: SD 3.5 Large is met deze optimalisaties bruikbaarder geworden op kaarten waarvoor het model eerder net te zwaar was.

Stability AI verlegt een deel van de aandacht naar audio en enterprise-producten. Op 8 april 2026 lanceerde het bedrijf Brand Studio, een productieplatform gericht op merken en bureaus met een centrale bibliotheek voor merkassets en geautomatiseerde productieplannen. Op 20 mei 2026 volgde Stable Audio 3.0, een familie open-weight audiomodellen (van 459 miljoen tot 2,7 miljard parameters) die muziek van meer dan zes minuten kan genereren. Beide zijn geen beeldmodellen, maar ze laten zien waar een deel van de ontwikkelcapaciteit van Stability AI in 2026 naartoe is gegaan. Eind augustus 2026 sloot het bedrijf bovendien een Series B-financiering af van in totaal 232 miljoen dollar, met onder meer Electronic Arts, Sony Music Group, Universal Music Group en Warner Music Group als investeerders.

FLUX, FLUX 3 en Qwen-Image zetten allemaal een stap verder. Black Forest Labs bracht eind november 2025 FLUX.2 uit, met een multi-referentiesysteem (tot 10 referentiebeelden tegelijk), sterkere tekstweergave en betere lay-outs dan de eerste FLUX-generatie. In januari 2026 volgde FLUX.2 [klein], een compact model van 4 miljard parameters onder de vrije Apache 2.0 licentie, dat inmiddels native door ComfyUI wordt ondersteund. Op 23 juli 2026 kondigde Black Forest Labs vervolgens FLUX 3 aan: een multimodaal fundamenteel model dat, in de eigen woorden van het bedrijf, "gezamenlijk getraind is over beeld, video en audio". Op 4 augustus 2026 volgde een preview van de videofunctie: tot 20 seconden video op 1920x1088 (16:9) en 24 fps, met native audio, meertalige dialoog met synchroon geluid, keyframe-sturing en meerdere scenes en camerastandpunten binnen een generatie (gecontroleerd op 6 september 2026 via docs.bfl.ml/release-notes). Er is bij deze aankondigingen geen open-weight release of licentie voor FLUX 3 bekendgemaakt, dus voorlopig raakt dit vooral API-gedreven productieworkflows, niet direct het lokale Stable Diffusion-ecosysteem. Alibaba's Qwen-Image, voor het eerst uitgebracht eind december 2025 (20 miljard parameters, Apache 2.0), kreeg op 10 februari 2026 een opvolger: Qwen-Image 2.0, een compacter model van 7 miljard parameters met native 2K-resolutie en, volgens de blind beoordeelde AI Arena-ranglijst, de sterkste tekst-naar-beeld- en beeldbewerkingsresultaten van dat moment.

De interface-verhoudingen zijn definitiever geworden. AUTOMATIC1111 lag in 2025 al stil en blijft in 2026 in onderhoudsmodus, met v1.10.1 (februari 2025) nog altijd als laatste echte release. De oorspronkelijke Forge-repository is sinds 2025 inactief, al bestaat er een actief onderhouden fork (Forge Neo) die de vertrouwde tab-indeling combineert met snelheidswinst. ComfyUI is intussen het duidelijke zwaartepunt van actieve ontwikkeling, met tientallen releases per jaar en native ondersteuning voor zowel FLUX.2 als Qwen-Image naast Stable Diffusion.

Versies: van SD 1.5 tot SD 3.5 Large

Stable Diffusion heeft meerdere generaties doorgemaakt. Elk model heeft zijn eigen sterke punten. Let op: de SD 3.0 API's zijn sinds april 2025 deprecated en worden automatisch omgeleid naar SD 3.5, en er is in september 2026 nog altijd geen opvolger van SD 3.5 officieel uitgebracht.

SD 1.5

Het originele model dat de revolutie startte. Genereert beelden van 512x512 pixels. De kwaliteit is naar 2026-standaarden beperkt, maar het ecosysteem is gigantisch. Er bestaan duizenden fine-tuned varianten en LoRA-modellen voor SD 1.5.

Voordelen: draait op vrijwel elke GPU (4 GB VRAM voldoende), enorm modelaanbod Nadelen: lage resolutie, moeite met handen en tekst

SDXL (Stable Diffusion XL)

De sprong naar 1024x1024 pixels. SDXL levert aanzienlijk betere beelden dan SD 1.5, met scherpere details en betere compositie. Het model heeft 6,6 miljard parameters (versus 860 miljoen bij SD 1.5).

Voordelen: hoge kwaliteit, betere anatomie, de rijkste community-modelbibliotheek Nadelen: vereist minimaal 8 GB VRAM, langzamere generatie

In 2026 is SDXL nog altijd het werkpaard voor de meeste gevorderde gebruikers, met name dankzij het enorme ecosysteem aan fine-tunes, LoRAs en ControlNet-modellen. SD 3.5 levert betere basiskwaliteit, maar SDXL heeft diepere community-specialisatie. Sinds medio 2026 draait SDXL dankzij AMD NPU-optimalisaties ook merkbaar soepeler op geschikte AMD-hardware.

SD 3.5: nog altijd het nieuwste officiële model

Stability AI bracht SD 3.0 uit in 2024 met een nieuwe MMDiT-architectuur (Multi-Modal Diffusion Transformer). SD 3.5 Large (8 miljard parameters) is het huidige vlaggenschip en blijft dat ook in september 2026. SD 3.0 is sinds april 2025 deprecated; alle API-calls worden automatisch doorgestuurd naar SD 3.5.

SD 3.5 is beschikbaar in drie varianten:

  • SD 3.5 Large (8B parameters): hoogste kwaliteit, beste prompt-opvolging
  • SD 3.5 Large Turbo (8B, 4-stap): snel met goede kwaliteit
  • SD 3.5 Medium (2,5B parameters): goede balans tussen kwaliteit en snelheid, compact genoeg voor lagere VRAM

Voordelen: superieure tekstweergave in beelden, betere prompt-opvolging, sterke fotorealisme, sinds augustus 2026 ook TensorRT-versies met tot 2,3 keer snellere generatie en 40 procent minder VRAM-gebruik Nadelen: vereist meer VRAM dan SDXL zonder deze optimalisaties, community-adoptie groeit maar SDXL blijft populairder voor specialisaties

Stability AI biedt ook Stable Image Ultra als hun commercieel topmodel via de API, gericht op professioneel en enterprise-gebruik. Via de API kost een beeld met Stable Image Ultra 8 credits ($0,08), Stable Image Core 3 credits ($0,03), SD 3.5 Large 6,5 credits ($0,065), SD 3.5 Large Turbo 4 credits ($0,04) en SD 3.5 Medium 3,5 credits ($0,035), waarbij 1 credit gelijk staat aan $0,01 (gecontroleerd op 6 september 2026 op basis van de officiele creditstructuur van Stability AI).

Model Resolutie Parameters Min. VRAM Sterkste punt
SD 1.5 512x512 860M 4 GB Enorm ecosysteem
SDXL 1024x1024 6,6B 8 GB Beste community-LoRAs en fine-tunes
SD 3.5 Medium 1024x1024 2,5B 6 GB Compact, goede tekstweergave
SD 3.5 Large 1024x1024 8B 12 GB (8 GB met TensorRT-optimalisatie) Hoogste officiële kwaliteit
Stable Image Ultra Variabel N/A (cloud) N/A Commercieel topmodel (API), $0,08 per beeld

FLUX, FLUX 3 en Qwen-Image: de open source concurrentie die het landschap verandert

In augustus 2024 lanceerde Black Forest Labs (opgericht door drie kernonderzoekers van Stability AI, waaronder Robin Rombach, de oorspronkelijke SD-architect) FLUX.1. Het model presteerde onmiddellijk beter dan SDXL op de meeste benchmarks. Eind november 2025 volgde de tweede generatie, FLUX.2, met vier varianten:

  • FLUX.2 [Pro]: het snelste, meest gepolijste model via de API, zo'n $0,03 per megapixel gecombineerde in- en uitvoer
  • FLUX.2 [Flex]: instelbare snelheid/kwaliteit-afweging
  • FLUX.2 [Dev]: open-weight model van 32 miljard parameters, commerciële licentie vereist voor betaald gebruik
  • FLUX.2 [klein]: sinds januari 2026 beschikbaar, een compact model van 4 miljard parameters onder de vrije Apache 2.0 licentie, inmiddels native ondersteund in ComfyUI

FLUX.2 excelleert op:

  • Fotorealisme en anatomische accuraatheid
  • Prompt-opvolging op lange, gedetailleerde beschrijvingen
  • Multi-referentie: tot 10 referentiebeelden tegelijk voor consistente personages, producten of merkstijlen
  • Tekst-in-beeld rendering, gestructureerde lay-outs en UI-achtige elementen (beter dan de eerste FLUX-generatie en beter dan SD, maar nog altijd achter Qwen-Image op puur tekstwerk)

Op 23 juli 2026 kondigde Black Forest Labs FLUX 3 aan: geen opvolger van SD, maar een multimodaal fundamenteel model dat beeld, video en audio in een architectuur combineert. Op 4 augustus 2026 kwam de videofunctie als preview beschikbaar: video's tot 20 seconden op 1920x1088 (16:9, 24 fps) met native audio, meertalige dialoog, keyframe-sturing en meerdere scenes en camerastandpunten binnen een generatie. Er is bij deze aankondigingen geen open-weight release of licentie bekendgemaakt, dus FLUX 3 is voorlopig vooral relevant voor wie via de API werkt en niet voor de lokale Stable Diffusion-workflow (gecontroleerd op 6 september 2026 via docs.bfl.ml/release-notes).

Sinds eind december 2025 is er ook een derde serieuze speler op het beeldvlak: Qwen-Image van Alibaba, een 20 miljard parameter model onder de vrije Apache 2.0 licentie, dus zonder de omzetdrempel die bij Stability AI's Community License hoort. Op 10 februari 2026 volgde Qwen-Image 2.0, een compacter model van 7 miljard parameters met native 2K-resolutie (2048x2048) dat generatie en bewerking in een model combineert. Qwen-Image is bijzonder sterk in tekstweergave, met name in het Chinees, maar ook in het Engels, inclusief lange instructies voor infographics en presentatieslides.

Stable Diffusion blijft sterker op:

  • Het ecosysteem van community LoRAs en fine-tunes (duizenden beschikbaar op Civitai)
  • ControlNet en inpainting tooling (nog altijd volwassener dan bij FLUX of Qwen-Image)
  • Goedkoopste optie voor lokaal draaien, met dank aan de nieuwe TensorRT- en AMD-geoptimaliseerde versies

De conclusie voor 2026: FLUX.2 is een betere basiskwaliteits-engine met sterke multi-referentie- en tekstfuncties, Qwen-Image is de sterkste optie voor tekst-in-beeld en heeft de meest vrije licentie, en SD heeft het rijkere aanpassingsecosysteem. Veel professionele gebruikers combineren twee of drie van deze modellen afhankelijk van de workflow.

Lokaal draaien vs. cloud

Je hebt twee opties: Stable Diffusion op je eigen machine installeren of een cloud-service gebruiken.

Lokaal draaien

Dit is waar Stable Diffusion echt schittert. Na de initiële setup genereer je onbeperkt beelden zonder kosten. Je hebt volledige controle over modellen, instellingen en privacy.

Wat heb je nodig?

  • GPU: NVIDIA RTX 3060 (12 GB) of hoger. De RTX 4070 Ti is de sweetspot in 2026, en dankzij de TensorRT-optimalisaties van augustus 2026 komt ook een kaart met minder VRAM al een heel eind met SD 3.5 Large.
  • RAM: 16 GB minimum, 32 GB aanbevolen
  • Opslag: 20-100 GB voor modellen (elk model is 2-7 GB)
  • OS: Windows 10/11 of Linux. macOS werkt via MPS maar is trager.

AMD-kaarten werken via DirectML of ROCm, en sinds medio 2026 zijn er ook AMD NPU-geoptimaliseerde varianten van SDXL en SD 3.5 Medium beschikbaar, maar NVIDIA blijft de beste ervaring bieden dankzij CUDA-optimalisaties en de bredere TensorRT-ondersteuning.

Wil je aan de slag? Bekijk onze stap-voor-stap installatiegids.

Cloud-services

Geen geschikte GPU? Dan zijn er cloud-opties:

  • RunDiffusion: dedicated VM's met voorgeïnstalleerde interfaces, vanaf $0,50/uur
  • Google Colab: gratis tier met beperkte GPU-tijd, betaald vanaf $10/mnd
  • Vast.ai: huur losse GPU's vanaf $0,15/uur
  • ThinkDiffusion: vergelijkbaar met RunDiffusion, automatische setup

Cloud is ideaal om te experimenteren zonder grote investering. Voor dagelijks gebruik is een eigen GPU op termijn goedkoper.

Interfaces: hoe bedien je Stable Diffusion?

Stable Diffusion is een model, geen app. Je hebt een interface (UI) nodig om het te gebruiken. De verhoudingen tussen de drie grote spelers zijn in 2026 duidelijker uitgekristalliseerd dan een jaar eerder.

Automatic1111 (AUTOMATIC1111 Web UI)

De Stable Diffusion interface in ComfyUI met nodes en instellingen

De langst bestaande en meest gebruikte interface, maar de ontwikkeling ligt sinds begin 2025 vrijwel stil. De laatste echte release is v1.10.1 (februari 2025). Voor wie vandaag voor het eerst begint, is dit inmiddels vooral een legacy-keuze: het werkt nog prima voor SD 1.5 en SDXL, maar ondersteunt FLUX en Qwen-Image niet zonder community-aanpassingen.

Pluspunten: intuïtief voor beginners, enorme extensiebibliotheek, uitgebreide documentatie Minpunten: kan traag worden met veel extensies, minder geschikt voor complexe workflows, geen actieve doorontwikkeling meer

ComfyUI

De node-based interface die in 2025-2026 enorm aan populariteit heeft gewonnen en in 2026 het duidelijke zwaartepunt van actieve ontwikkeling is geworden. Je bouwt workflows door nodes aan elkaar te koppelen, vergelijkbaar met Blender's shader editor. ComfyUI ondersteunt inmiddels native workflows voor FLUX.2 (inclusief het vrij te gebruiken FLUX.2 [klein]) en voor Qwen-Image 2.0, naast SD.

Pluspunten: maximale flexibiliteit, beter geheugenbeheer, reproduceerbare workflows, native ondersteuning voor de nieuwste modellen naast SD Minpunten: steilere leercurve, minder beginner-friendly

Nieuw met ComfyUI? Begin met onze ComfyUI beginnersgids.

Forge (SD.Next / Forge UI)

Een fork van Automatic1111, geoptimaliseerd voor snelheid en geheugengebruik. De oorspronkelijke Forge-repository is sinds 2025 inactief, maar een actief onderhouden fork (bekend als Forge Neo) zet de ontwikkeling voort en draait SDXL-modellen soepeler op kaarten met minder VRAM, met een snelheidswinst van 10 tot 30 procent ten opzichte van Automatic1111.

Pluspunten: sneller dan A1111, betere VRAM-optimalisatie, compatibel met A1111-extensies Minpunten: kleinere community, en let op welke fork je installeert nu het oorspronkelijke project stilligt

Welke interface kies je?

Criteria Automatic1111 ComfyUI Forge (Neo)
Beginnersvriendelijk ★★★★☆ ★★☆☆☆ ★★★★☆
Flexibiliteit ★★★☆☆ ★★★★★ ★★★☆☆
Snelheid ★★★☆☆ ★★★★☆ ★★★★★
Extensies ★★★★★ ★★★★☆ ★★★★☆
Actieve ontwikkeling (2026) ★☆☆☆☆ ★★★★★ ★★★☆☆
Ondersteunt FLUX/Qwen-Image Nee (zonder hacks) Ja, native Beperkt

LoRA en fine-tuning: het geheime wapen

Een van de krachtigste features van Stable Diffusion is de mogelijkheid om modellen aan te passen. LoRA's (Low-Rank Adaptation) zijn kleine bestanden (10-200 MB) die je bovenop een basismodel laadt om een specifieke stijl, persoon of concept toe te voegen.

Wat kun je met LoRA's?

  • Stijlen: anime, fotorealisme, aquarel, pixel art, er is voor elke stijl een LoRA
  • Concepten: specifieke objecten, kleding, architectuurstijlen
  • Consistente personages: genereer hetzelfde personage in verschillende poses en settings

Op Civitai.com vind je meer dan 200.000 community-modellen en LoRAs. Het is de grootste marktplaats voor Stable Diffusion content. De officiële modellen zijn beschikbaar op Hugging Face onder het Stability AI-profiel, inclusief modelkaarten met technische specificaties en licentie-informatie. Dat profiel laat ook zien dat het bedrijf in 2026 vooral energie stak in AMD- en audio-geoptimaliseerde varianten, niet in een compleet nieuwe beeldgeneratie.

Zelf trainen

Met tools als Kohya_ss kun je je eigen LoRA trainen. Je hebt 15-30 referentiebeelden nodig en een paar uur trainingstijd op een 12 GB GPU. Bedrijven gebruiken dit om productfoto's te genereren of een consistente huisstijl te creëren. Voor merken die dat liever als kant-en-klare dienst afnemen, positioneert Stability AI sinds april 2026 ook Brand Studio, een apart enterprise-product met een centrale merkbibliotheek en geautomatiseerde productieplannen, dat los staat van de LoRA-workflow die hieronder beschreven wordt.

Meer weten? Lees onze gids over LoRA-modellen voor Stable Diffusion.

Beeldkwaliteit in de praktijk

Hoe goed zijn de resultaten? Dat hangt sterk af van je setup. Een kaal basismodel met standaardinstellingen levert matige beelden op. Maar met het juiste model, de juiste sampler en een goed geschreven prompt haal je professionele kwaliteit.

Voorbeeld van een beeld gegenereerd met Stable Diffusion en een community-model

Tips voor betere resultaten

  1. Gebruik community-modellen: checkpoints als RealVisXL, DreamShaper of Juggernaut leveren veel betere resultaten dan het standaard SDXL-model
  2. Negative prompts: beschrijf wat je niet wilt zien (blurry, bad anatomy, watermark)
  3. CFG scale: 5-8 voor de meeste modellen, hoger maakt het beeld "harder"
  4. Sampling steps: 20-30 is voldoende, meer helpt zelden
  5. Upscaling: genereer op basisresolutie en schaal daarna op met een upscaler als 4x-UltraSharp

Vergelijking met andere tools

In een directe vergelijking met Midjourney levert Stable Diffusion met standaardinstellingen minder indrukwekkende resultaten. Maar met een geoptimaliseerde setup (goed checkpoint, LoRA's, ControlNet) kun je vergelijkbare of zelfs betere resultaten behalen voor specifieke niches.

Bekijk onze uitgebreide Midjourney vs Stable Diffusion vergelijking voor meer details.

Vergeleken met Leonardo AI vereist Stable Diffusion meer technische kennis, maar biedt het onbeperkte generaties en meer controle. Tegenover OpenAI's beeldgeneratie wint Stable Diffusion op flexibiliteit; GPT Image 2 is makkelijker, sneller en beter in tekst-in-beeld, al is het verschil op dat laatste punt kleiner geworden sinds FLUX.2 en Qwen-Image 2.0 hun tekstweergave verbeterden.

ControlNet en geavanceerde features

ControlNet is een extensie die Stable Diffusion naar een ander niveau tilt. Hiermee stuur je de compositie van je beeld via referentiebeelden.

Wat kan ControlNet?

  • Pose-detectie: upload een foto en genereer een beeld met dezelfde lichaamshouding
  • Edge detection (Canny): behoud de contouren van een referentiebeeld
  • Depth maps: gebruik de diepte-informatie van een foto als basis
  • Scribble: maak een ruwe schets en laat SD er een gedetailleerd beeld van maken
  • IP-Adapter: gebruik een referentiebeeld als stijlgids

ControlNet maakt Stable Diffusion bruikbaar voor professionele workflows waarbij je precieze controle nodig hebt over compositie en pose. Dit is het terrein waar SD in 2026 nog duidelijk beter is dan FLUX en Qwen-Image: de ControlNet-tooling voor die modellen is minder volwassen, al haalt FLUX.2 met zijn multi-referentiesysteem (tot 10 referentiebeelden) een deel van dat gat op een andere manier in.

Andere handige extensies

  • ADetailer: automatische face/hand fix na generatie
  • Regional Prompter: verschillende prompts voor verschillende delen van het beeld
  • AnimateDiff: genereer korte animaties en video's
  • Segment Anything: selecteer objecten in beelden voor gerichte bewerking

Community en ondersteuning

De Stable Diffusion community is een van de actiefste open source communities ter wereld. Je vindt hulp en inspiratie op:

  • Reddit (r/StableDiffusion): 1,5 miljoen+ leden, dagelijks nieuwe tips en modellen
  • Civitai: modelbibliotheek met previews, reviews en downloadstatistieken
  • GitHub: issues en discussies bij elk project
  • Discord: servers voor Automatic1111, ComfyUI en Stability AI
  • YouTube: duizenden tutorials, van beginner tot expert

De community deelt niet alleen modellen, maar ook complete workflows, prompts en best practices. Dat maakt de instapdrempel lager dan je zou verwachten. Let wel op een bijeffect van de stilstand bij Automatic1111 en de oorspronkelijke Forge-repository: nieuwe workflows, tutorials en LoRA-releases verschijnen in 2026 vrijwel allemaal met ComfyUI als uitgangspunt.

Voordelen en nadelen

Voordelen

  • Volledig gratis, geen abonnement, geen tokenlimiet
  • Privacy, alles draait lokaal, geen data naar externe servers
  • Onbeperkte controle, elk aspect van het generatieproces is aanpasbaar
  • Geen censuur, jij bepaalt de content filters (of het ontbreken ervan)
  • Enorm ecosysteem, duizenden modellen, extensies en tools
  • Commercieel gebruik, geen licentiekosten voor SD 1.5 en SDXL, en voor SD 3.5 ook niet zolang je onder de 1 miljoen dollar jaaromzet blijft
  • Offline beschikbaar, geen internetverbinding nodig na setup
  • ControlNet-tooling, rijper dan bij FLUX of Qwen-Image
  • Sneller en zuiniger geworden, dankzij de TensorRT- en AMD-optimalisaties van 2026

Nadelen

  • Technische drempel, installatie en configuratie vergen technische kennis
  • Hardware vereist, een geschikte GPU kost 300-800 euro
  • Leercurve, de juiste instellingen vinden kost tijd en experimenten
  • Standaardkwaliteit, zonder optimalisatie zijn resultaten middelmatig
  • Geen support, je bent afhankelijk van de community bij problemen
  • Updates bijhouden, modellen en interfaces worden snel vernieuwd, en de belangrijkste twee klassieke interfaces (Automatic1111, oorspronkelijke Forge) liggen inmiddels stil
  • Concurrentie van FLUX en Qwen-Image, op pure basiskwaliteit, tekstweergave en fotorealisme presteren beide inmiddels beter dan SD
  • Geen SD 3.5-opvolger, wie op een grote kwaliteitssprong wachtte, moet die van FLUX.2, FLUX 3 of Qwen-Image 2.0 halen, niet van Stability AI zelf

Wat documenteert Stability AI zelf als beperking?

Buiten de marketing om is het de moeite waard om te weten wat Stability AI zelf, via de licentievoorwaarden en modelkaarten, als grens aanmerkt:

  • De omzetdrempel van 1 miljoen dollar geldt ongeacht de bron van die omzet. Ook een bedrijf dat SD 3.5 slechts zijdelings gebruikt (bijvoorbeeld voor interne visuals) moet bij overschrijding een Enterprise-licentie afsluiten (gecontroleerd op 6 september 2026 via stability.ai/license).
  • Enterprise-prijzen zijn niet openbaar. Je moet rechtstreeks contact opnemen met Stability AI voor een offerte; er staat geen publieke prijslijst.
  • De TensorRT- en AMD-optimalisaties zijn losse downloads, geen automatische update van je bestaande SD 3.5-installatie. Je moet de geoptimaliseerde modelbestanden apart ophalen van Hugging Face.
  • Geen garantie op doorontwikkeling van de klassieke interfaces. Stability AI onderhoudt zelf geen enkele UI; Automatic1111 en de oorspronkelijke Forge-repository worden door de gemeenschap onderhouden, en die is voor beide sinds 2025 grotendeels afgehaakt.

Prijzen: wat kost het echt?

Stable Diffusion zelf is gratis. Maar je hebt hardware nodig, of je betaalt per beeld via de officiële API.

Optie Eenmalig Maandelijks Beelden/maand
Eigen GPU (RTX 3060 12GB) 300-350 euro 10-15 euro (stroom) Onbeperkt
Eigen GPU (RTX 4070 Ti) 700-800 euro 15-20 euro (stroom) Onbeperkt
RunDiffusion (cloud) nvt 15-50 euro ~500-2000
Google Colab Pro nvt 10 euro ~200-500
Vast.ai nvt 5-30 euro ~300-1500
Stability AI API (Stable Image Core) nvt $0,03 per beeld Naar gebruik
Stability AI API (SD 3.5 Large) nvt $0,065 per beeld Naar gebruik
Stability AI API (Stable Image Ultra) nvt $0,08 per beeld Naar gebruik

Alle API-prijzen zijn gecontroleerd op 6 september 2026 op basis van de officiele creditstructuur van Stability AI (1 credit = $0,01). Na 6-12 maanden is een eigen GPU goedkoper dan elke cloud-service of API-abonnement bij regelmatig gebruik. En je hebt een betere gaming PC als bonus.

Kostenberekening voor drie gebruikersprofielen

Om de keuze concreter te maken, drie realistische profielen met hun geschatte maandkosten:

Profiel 1: de hobbyist (circa 200 beelden per maand, incidenteel). Met een eigen RTX 3060 (12 GB) kost dit vrijwel niets extra's bovenop de stroomkosten van 10-15 euro per maand, na een eenmalige investering van 300-350 euro. Via de Stability AI API met Stable Image Core (200 x $0,03) betaal je ongeveer $6 per maand, zonder hardware-investering. Voor incidenteel gebruik is de API dus goedkoper dan eigen hardware, tot je structureel meer dan zo'n 1.000 beelden per maand genereert.

Profiel 2: de freelance ontwerper (circa 2.000 beelden per maand, kwaliteit belangrijk). Eigen hardware (RTX 4070 Ti, 700-800 euro eenmalig, 15-20 euro stroom per maand) is hier voordeliger dan de API: 2.000 beelden via SD 3.5 Large op de API zou $130 per maand kosten, dus de eigen GPU is binnen 4 tot 6 maanden terugverdiend. Let bovendien op de omzetdrempel van de Community License als deze beelden voor betaalde opdrachten zijn: zolang de jaaromzet van de freelancer onder 1 miljoen dollar blijft, is dit gratis toegestaan.

Profiel 3: het kleine bureau (circa 8.000 beelden per maand, meerdere medewerkers). Bij dit volume is een lokale GPU-server met een of meerdere RTX 4070 Ti's of vergelijkbare kaarten vrijwel altijd goedkoper dan cloud of API: 8.000 beelden via SD 3.5 Large op de API zou al snel $520 per maand kosten, tegenover misschien 30-40 euro stroom per maand voor eigen hardware. Bij dit soort volumes is het ook zinvol om te controleren of de jaaromzet van het bureau de drempel van 1 miljoen dollar nadert, want dan is op enig moment een Enterprise-licentie van Stability AI nodig in plaats van de gratis Community License.

Voor wie is Stable Diffusion geschikt?

Ideaal voor:

  • Techneuten die graag sleutelen en experimenteren
  • Kunstenaars die maximale creatieve controle willen
  • Ontwikkelaars die AI beeldgeneratie in hun product willen integreren
  • Bedrijven die privacy-gevoelige beelden genereren (bijv. medisch, intern)
  • Hobbyisten die onbeperkt willen genereren zonder maandelijkse kosten
  • ControlNet-gebruikers die precieze compositionele controle nodig hebben

Minder geschikt voor:

  • Beginners zonder technische achtergrond, kijk dan eerst naar Leonardo AI of OpenAI's beeldgeneratie
  • Gebruikers zonder GPU, cloud-opties bestaan maar zijn minder handig
  • Wie snel resultaat wil, de setup en leercurve kosten tijd
  • Wie vooral tekst-in-beeld nodig heeft, kijk dan eerst naar Qwen-Image 2.0 of FLUX.2

Vergelijking met alternatieven

Feature Stable Diffusion Midjourney v8.1 GPT Image 2 Leonardo AI FLUX.2 Pro Qwen-Image 2.0
Prijs Gratis $10-120/mnd $20/mnd Gratis-$48/mnd ~$0,03/MP Gratis (self-hosted)
Lokaal draaien Ja Nee Nee Nee Deels (Dev/klein) Ja
Licentie Community/Enterprise Propriëtair Propriëtair Propriëtair Deels Apache 2.0 Apache 2.0
Beeldkwaliteit ★★★-★★★★★ ★★★★★ ★★★★★ ★★★★☆ ★★★★★ ★★★★☆
Gebruiksgemak ★★☆☆☆ ★★★★☆ ★★★★★ ★★★★☆ ★★★☆☆ ★★★☆☆
Aanpasbaarheid ★★★★★ ★☆☆☆☆ ★☆☆☆☆ ★★★☆☆ ★★★★☆ ★★★☆☆
Privacy ★★★★★ ★★☆☆☆ ★★☆☆☆ ★★☆☆☆ ★★★★☆ ★★★★★
ControlNet ★★★★★ ★★★☆☆ ★★☆☆☆ ★☆☆☆☆
Tekst-in-beeld ★★★☆☆ ★★★★☆ ★★★★★ ★★★☆☆ ★★★★☆ ★★★★★

Wil je een eerlijke vergelijking? Lees onze Midjourney vs Stable Diffusion vergelijking. Of bekijk Flux AI, de open source concurrent van Black Forest Labs.

Bronnen

Stable Diffusion is in 2026 nog altijd de kern van open source beeldgeneratie, ook al is er geen nieuwe modelgeneratie gekomen sinds SD 3.5 uit 2024. Het biedt ongeëvenaarde controle via LoRAs, ControlNet en fine-tuning, en is dankzij de TensorRT- en AMD-optimalisaties van 2026 sneller en zuiniger geworden op bestaande hardware. FLUX.2 biedt intussen betere basiskwaliteit, multi-referentiefuncties en tekstweergave, en Qwen-Image 2.0 is de sterkste optie voor wie vooral leesbare tekst in beelden nodig heeft, met de meest vrije licentie van de drie. Voor gevorderde gebruikers zijn de drie ecosystemen inmiddels complementair, niet concurrerend.

De community is actiever dan ooit, al is die activiteit sterk verschoven naar ComfyUI nu Automatic1111 en de oorspronkelijke Forge-repository grotendeels stilliggen. Met SDXL als werkpaard voor community-specialisaties, SD 3.5 Large als het nog altijd ongewijzigde officiële vlaggenschip en een eindeloos ecosysteem aan modellen en extensies is er voor elke use case een oplossing, al is het verstandig om voor tekst-in-beeld ook FLUX.2 of Qwen-Image 2.0 te overwegen.

Begin je met AI beeldgeneratie en heb je een geschikte GPU? Start met SDXL via ComfyUI of Forge Neo. Wil je de beste basiskwaliteit? Probeer ook FLUX.2 via ComfyUI, en voor tekst-in-beeld Qwen-Image 2.0. Heb je geen GPU? Start dan met Leonardo AI en schakel later over als je meer controle wilt.

Stable Diffusion is niet de makkelijkste tool. Maar als je de tijd neemt om het te leren, krijg je een beeldgenerator die je volledig naar je hand zet, zonder maandelijkse kosten, zonder beperkingen, zonder compromissen, en met een licentie die pas kosten met zich meebrengt boven een jaaromzet van 1 miljoen dollar.

Veelgestelde vragen

Welke videokaart heb ik nodig voor Stable Diffusion?

Minimaal een NVIDIA GPU met 6 GB VRAM (bijv. RTX 3060). Voor SDXL is 8 GB VRAM aanbevolen, voor SD 3.5 Large is 12 GB VRAM ideaal. Sinds augustus 2026 heeft Stability AI TensorRT-geoptimaliseerde SD 3.5 modellen uitgebracht die tot 40 procent minder VRAM nodig hebben, waardoor SD 3.5 Large ook op kaarten met minder geheugen bruikbaar wordt. AMD-kaarten werken ook, maar de ondersteuning is beperkter.

Is Stable Diffusion echt helemaal gratis?

Ja. De modellen zijn open source en gratis te downloaden. Je betaalt alleen voor je eigen hardware of een cloud-GPU als je geen geschikte videokaart hebt.

Wat is het verschil tussen ComfyUI en Automatic1111?

Automatic1111 heeft een traditionele interface met knoppen en sliders, makkelijk voor beginners, maar de ontwikkeling ligt sinds begin 2025 vrijwel stil (laatste release v1.10.1). ComfyUI werkt met nodes die je aan elkaar koppelt, wat flexibeler is maar een steilere leercurve heeft, en is in 2026 de actiefst onderhouden interface met native ondersteuning voor nieuwe modellen zoals FLUX.2 en Qwen-Image.

Kan ik Stable Diffusion commercieel gebruiken?

SD 1.5 en SDXL vallen onder de CreativeML Open RAIL-M licentie, die commercieel gebruik toestaat. SD 3.5 valt onder de Stability AI Community License: gratis voor onderzoek en commercieel gebruik zolang je jaaromzet onder 1 miljoen dollar blijft (gecontroleerd op 6 september 2026 via stability.ai/license). Kom je daarboven, dan is een Enterprise-licentie met maatwerkprijzen nodig, ongeacht uit welke bron die omzet komt.

Is FLUX een vervanging voor Stable Diffusion?

FLUX (van Black Forest Labs) is in 2026 op veel benchmarks beter dan SD op basiskwaliteit en fotorealisme, en sinds de release van FLUX.2 eind 2025 ook sterker in tekstweergave en lay-outs. Op 23 juli 2026 kondigde Black Forest Labs bovendien FLUX 3 aan, een multimodaal model dat beeld, video en audio in een architectuur combineert. Stable Diffusion heeft echter een veel rijker ecosysteem van LoRAs, fine-tunes en ControlNet-integraties. De meeste gevorderde gebruikers combineren beide, en sinds begin 2026 mengt ook Qwen-Image van Alibaba zich in dat veld.

Hoe verhoudt Stable Diffusion zich tot Midjourney?

Midjourney levert 'out of the box' mooiere resultaten. Stable Diffusion biedt meer controle, is gratis en draait lokaal. Met de juiste modellen en instellingen kun je vergelijkbare kwaliteit halen.

Wat is FLUX 3 en verandert dat iets voor Stable Diffusion-gebruikers?

FLUX 3 is een nieuw fundamenteel model van Black Forest Labs, aangekondigd op 23 juli 2026, dat beeld, video en audio in een gezamenlijk getraind model combineert. Op 4 augustus 2026 volgde een preview van de videofunctie: video's tot 20 seconden op 1920x1088 (16:9) en 24 fps, inclusief native audio en meertalige dialoog, met keyframe-sturing en meerdere camerastandpunten binnen een generatie (gecontroleerd op 6 september 2026 via docs.bfl.ml/release-notes). Er is bij aankondiging geen open-weight release of licentie voor FLUX 3 bekendgemaakt, dus dit raakt vooralsnog vooral de API-gedreven workflows en niet het lokale Stable Diffusion-ecosysteem.

Wat heeft Qwen-Image te bieden ten opzichte van Stable Diffusion?

Qwen-Image is een open source beeldmodel van Alibaba onder de permissieve Apache 2.0 licentie, dus zonder de omzetdrempel van de Stability AI Community License. De eerste versie (20 miljard parameters) verscheen eind december 2025, gevolgd door Qwen-Image 2.0 (7 miljard parameters) op 10 februari 2026, met native 2K resolutie en zeer sterke tekstweergave, vooral in het Chinees en Engels. Voor Nederlandse of algemene tekst in beelden blijft de praktijkervaring wisselend, maar het model wordt inmiddels via native nodes in ComfyUI ondersteund naast SD en FLUX.