Stable Diffusion lokal: Installation und Modelle
Stable Diffusion ist eine Familie von Bildmodellen mit offenen Gewichten, keine Anwendung: Die Modelle werden in einer lokalen Benutzeroberfläche ausgeführt. Beginnen Sie mit SDXL (6,94 GB große Datei, 8 GB VRAM für einen komfortablen Betrieb) in Fooocus, in ComfyUI Desktop oder auf dem Mac in Draw Things. SD 1.5 eignet sich für kleine Grafikkarten; SD 3.5, angekündigt am 22. Oktober 2024, für Karten mit 12 GB und mehr. Neuere Modellfamilien wie Flux oder Z-Image werden vor allem über ComfyUI genutzt.
Stability AI hat am 22. August 2022 die öffentliche Veröffentlichung von Stable Diffusion angekündigt: ein Modell, das auf Ihrem eigenen Computer aus Text ein Bild erzeugt, ohne Konto oder Mengenbegrenzung. Mit Stand vom 28. September 2026 umfasst der Name drei Modellgenerationen, vier oder fünf mögliche Benutzeroberflächen und unterschiedliche Lizenzen. Dieser Leitfaden hilft Ihnen, eine Version und eine Benutzeroberfläche auszuwählen, alles unter Windows, macOS oder Linux zu installieren und zu verstehen, was Sie mit den Bildern tun dürfen.
#Was ist Stable Diffusion?
Stable Diffusion ist ein latentes Diffusionsmodell. Es beginnt mit einem Bild aus reinem Rauschen und entfernt dieses schrittweise, gesteuert durch Ihren Text, bis ein stimmiges Bild entsteht. Die Berechnung erfolgt in einem komprimierten, sogenannten latenten Raum. Das erklärt, warum eine handelsübliche Grafikkarte ausreicht, während die ersten Diffusionsmodelle ein Rechenzentrum benötigten.
Berühmt wurde Stable Diffusion nicht durch seine reine Qualität, sondern durch seine Offenheit. Bei der Veröffentlichung im Jahr 2022 wählte Stability AI die Lizenz CreativeML OpenRAIL-M, die das Unternehmen als „permissiv“ beschreibt und die sowohl kommerzielle als auch nichtkommerzielle Nutzungen erlaubt: Die Modellgewichte lassen sich herunterladen, verändern und erneut trainieren. Es gibt Tausende spezialisierter Varianten. Stable Diffusion ist keine Anwendung: Es ist eine Modelldatei, die Sie in einer Benutzeroberfläche Ihrer Wahl ausführen.
Der Name birgt eine begriffliche Falle. Das Referenz-Repository von SD 1.5 auf Hugging Face präsentiert sich heute als Spiegel des alten, inzwischen veralteten RunwayML-Repositorys und steht in keiner Verbindung zu diesem Unternehmen. Und seit 2024 stammen die meistdiskutierten offenen Bildmodelle aus anderen Laboren: Flux, Qwen Image oder Z-Image. Sie laufen in denselben Benutzeroberflächen, tragen aber nicht den Namen Stable Diffusion.
#Die Versionen und welche Sie wählen sollten
KI-Bilder und -Videos lokal erstellen, ohne Begrenzung: ComfyUI, Flux, Z-Image und Wan 2.2 auf Ihrer GPU oder Ihrem Mac – mit Workflows zum direkten Laden und Informationen zum rechtlichen Rahmen.
- Lebenslanger Online-Zugang
- PDF + Dateien
- Erstattung binnen 30 Tagen
| Version | Erscheinungsdatum | Hauptdatei | Native Auflösung | Großzügig bemessener VRAM | Zusammenfassung |
|---|---|---|---|---|---|
| SD 1.5 | 2022 | 4,27 GB (v1-5-pruned-emaonly) | 512 × 512 | 4 bis 6 GB | Leichtgewichtig, riesige Bibliothek mit Varianten und LoRAs. Details und die Darstellung von Händen sind noch verbesserungswürdig. |
| SDXL 1.0 | Juli 2023 | 6,94 GB (sd_xl_base_1.0) | 1024 × 1024 | 8 GB: Stability AI gibt an, dass der Betrieb auf Karten mit 8 GB ordnungsgemäß funktioniert | Der richtige Ausgangspunkt: deutlich höhere Qualität, ausgereiftes Ökosystem. |
| SD 3.5 | 22. Oktober 2024 | Medium: 2,5 Milliarden Parameter; Large: 8,1 Milliarden; Large Turbo: Version in 4 Schritten | Medium: 0,25 bis 2 Megapixel; Large: 1 Megapixel | Medium: 9,9 GB ohne Textencoder (Stability AI). Large: mehr als 16 GB bei 16 Bit (unsere Berechnung) | Bessere Befolgung des Prompts. Andere Lizenz, siehe unten. |
Zwei Details helfen, Fehler beim Kauf oder Herunterladen zu vermeiden. Erstens gibt es SD 1.5 in zwei Dateien: v1-5-pruned-emaonly.safetensors (4,27 GB), die laut Modellbeschreibung weniger VRAM benötigt und für die Inferenz geeignet ist, und v1-5-pruned.safetensors (7,7 GB), die für erneutes Training vorgesehen ist. Zum Generieren von Bildern nehmen Sie die erste Datei. Zweitens lässt sich SD 3.5 Large mit seinen 8,1 Milliarden Parametern nicht anhand der Angaben zur Medium-Version beurteilen: Rechnen Sie nicht damit, dass es auf einer Grafikkarte mit 8 GB läuft.
Wenn Sie mit einer Grafikkarte mit 8 GB einsteigen, beginnen Sie mit SDXL: Es bietet das beste Verhältnis zwischen Qualität, Geschwindigkeit und verfügbarer Dokumentation. Mit 12 bis 16 GB sollten Sie sich auch die neueren Modelle in ComfyUI ansehen: Laut dessen README werden Flux.1, Flux.2, Qwen Image und Z-Image nativ unterstützt.
#Die notwendige Hardware
| Ihr Hardware-Setup | Was gut funktioniert |
|---|---|
| NVIDIA-Grafikkarte mit 4 bis 6 GB (GTX 1660, RTX 2060, RTX 3050) | SD 1.5. Fooocus, das mit SDXL arbeitet, gibt 4 GB VRAM und 8 GB RAM als Mindestanforderungen an und nutzt dabei den virtuellen Speicher von Windows: langsam, aber möglich. |
| NVIDIA-Grafikkarte mit 8 GB (RTX 3060 Ti, RTX 4060, RTX 5060) | SDXL läuft problemlos; von Stability AI genannter Schwellenwert |
| NVIDIA-Grafikkarte mit 12 bis 16 GB (RTX 3060 12 GB, RTX 4070, RTX 5070 Ti) | SDXL mit LoRA und Upscaling, SD 3.5 Medium, Z-Image Turbo (16 GB laut Modellbeschreibung), Flux in FP8 |
| Neuere AMD-Karte (RX 7000, RX 9000) | Gut unter Linux mit ROCm; unter Windows ist die offizielle ROCm-Unterstützung in ComfyUI Desktop seit Januar 2026 verfügbar |
| Mac mit Apple Silicon | Jeder M-Chip: Der vereinheitlichte Speicher dient als VRAM. Langsamer als eine NVIDIA-Grafikkarte einer vergleichbaren Leistungsklasse. |
| Keine Grafikkarte | Technisch möglich, aber deutlich langsamer: nur für Tests verwenden |
Planen Sie auch den Speicherplatz auf den Laufwerken ein. Eine einzige SDXL-Datei ist 6,94 GB groß, und Sammlungen von LoRAs und Varianten wachsen schnell. Fooocus empfiehlt, auf jedem Laufwerk mindestens 40 GB frei zu halten, wenn der Fehler „RuntimeError: CPUAllocator“ auftritt.
#Welche Benutzeroberfläche installieren
| Benutzeroberfläche | Für wen | Stärken | Grenzen |
|---|---|---|---|
| Fooocus | Anfänger | Ein Textfeld, eine Schaltfläche, durchdachte Standardeinstellungen; weniger als drei Klicks vom Download bis zum ersten Bild, laut dem zugehörigen README | Nur SDXL: Das Projekt erhält eingeschränkten Langzeitsupport, ausschließlich Fehlerbehebungen. |
| Forge (Repository von lllyasviel) | Benutzer der Oberfläche mit Registerkarten | Die Benutzeroberfläche von AUTOMATIC1111, mit geringerem Speicherbedarf und Unterstützung für Flux | Seit Juni 2025 keine Commits mehr auf dem Hauptbranch; die Weiterentwicklung erfolgt über Forks wie Forge Neo |
| AUTOMATIC1111 | Diejenigen, die alte Anleitungen befolgen | Die etablierte Benutzeroberfläche mit der umfangreichsten Dokumentation | Letzte Version im Februar 2025 veröffentlicht, Flux wird nicht unterstützt |
| ComfyUI | Fortgeschrittene und neugierige Benutzer | Native Unterstützung aktueller Modelle, reproduzierbare Workflows, sehr aktives Projekt | Lernkurve |
| Draw Things | Mac, iPhone, iPad | Native Anwendung, kostenlose Edition mit lokalen Berechnungen ohne Internetverbindung, LoRA-Training auf dem Gerät | Nur im Apple-Ökosystem; kostenpflichtige Cloud-Angebote sind optional verfügbar und sollten vermieden werden, wenn Sie zu 100 % lokal bleiben möchten |
- Fooocus: installieren und Ihr erstes Bild generieren
- ComfyUI: Installation und erste Schritte
- AUTOMATIC1111: Stable Diffusion WebUI installieren
- Überblick: Lokale Bildgenerierung
#Der kürzeste Weg je nach Betriebssystem
- 01Windows mit einer NVIDIA-KarteAm schnellsten geht es mit Fooocus. Laden Sie das Archiv von der offiziellen GitHub-Seite herunter, entpacken Sie es und führen Sie run.bat aus. Beim ersten Start werden die Modelle nach Fooocus\models\checkpoints heruntergeladen. Wenn Sie ein Tool möchten, das mit neuen Modellen Schritt hält, installieren Sie stattdessen ComfyUI Desktop, das im README von ComfyUI neuen Nutzern empfohlen wird.
- 02RTX-50-Karte: Prüfen Sie PyTorchDie All-in-one-Archive von Forge nennen CUDA 12.1 und PyTorch 2.3.1 als empfohlene Versionen. Die Karten der RTX-50-Serie benötigen jedoch eine aktuelle PyTorch-Version: Ein Mitwirkender an AUTOMATIC1111 nennt PyTorch 2.7.0 als erste offizielle Version, die diese Karten unterstützt. Auf einer RTX 50 sollten Sie ComfyUI bevorzugen, dessen Dokumentation CUDA 13.0 für neuere NVIDIA-Karten verlangt.
- 03Mac mit Apple SiliconInstallieren Sie Draw Things über den App Store: Die kostenlose Version führt die Berechnungen lokal und offline aus, ohne Befehlszeile. Aktivieren Sie die Cloud-Optionen nicht, wenn Sie möchten, dass nichts den Mac verlässt. ComfyUI Desktop ist ebenfalls für macOS auf Apple Silicon verfügbar.
- 04Linux oder AMD-KarteManuelle Installation von ComfyUI: Klonen des Repositorys, Python-Umgebung, PyTorch in der CUDA- oder ROCm-Version je nach Grafikkarte. Die ausführliche Anleitung finden Sie in unserem ComfyUI-Leitfaden. Fooocus bietet auch eine Linux-Installation über Anaconda an.
- 05Prüfen, ob die GPU arbeitetWährend einer Generierung muss der Befehl nvidia-smi den belegten VRAM und eine GPU-Auslastung nahe 100 % anzeigen. Wenn die Bilderzeugung mehrere Minuten dauert, läuft die Benutzeroberfläche auf dem Prozessor: Das liegt fast immer an einer ungeeigneten PyTorch-Version.
#Wo Sie die Modelle finden und welche Sie vermeiden sollten
Zwei Quellen dominieren. Hugging Face hostet die offiziellen Modelle der Forschungslabore. Civitai vereint Varianten aus der Community: feinabgestimmte Modelle, LoRAs, Stile. Ein LoRA ist eine kleine Datei, die einem Basismodell einen Stil oder ein Thema hinzufügt, ohne es zu ersetzen. Es muss zur richtigen Modellfamilie gehören: Ein SDXL-LoRA funktioniert nicht mit SD 1.5.
#Einen Prompt schreiben, der funktioniert
- Beschreiben Sie, geben Sie keine Befehle
- Diese Modelle befolgen keine Anweisungen. „Porträt einer älteren Frau, Fensterlicht, 85-mm-Objektiv, geringe Schärfentiefe“ funktioniert; „Mach mir ein schönes Foto“ nicht.
- Schreiben Sie auf Englisch
- Die Modellkarte von SD 1.5 nennt „Language(s): English“ und einen eingefrorenen CLIP-ViT-L/14-Textencoder. Französisch wird verstanden, aber weniger differenziert.
- Thema, dann Rahmen, dann Stil
- Die Reihenfolge zählt: Was zuerst kommt, hat das größte Gewicht.
- Negativer Prompt
- Er listet auf, was Sie nicht sehen möchten. Besonders nützlich bei SD 1.5 und SDXL; prüfen Sie bei einem neueren Modell in der Modellkarte, ob es den negativen Prompt berücksichtigt.
- Behalten Sie den Seed bei
- Gleicher Seed, gleiche Einstellungen, gleiches Bild. Um zwei Prompts zu vergleichen, legen Sie den Seed fest und ändern Sie jeweils nur eine Sache.
#Lizenzen und kommerzielle Nutzung
| Modell | Lizenz | Kommerzieller Gebrauch von Bildern |
|---|---|---|
| SD 1.5 | CreativeML OpenRAIL-M | Erlaubt: Stability AI beschreibt die Lizenz als permissiv für kommerzielle und nichtkommerzielle Nutzungen, mit ethischen Nutzungsbeschränkungen, die in der Lizenz aufgeführt sind |
| SDXL 1.0 | CreativeML OpenRAIL++-M | Zulässig, gleiche Prinzipien |
| SD 3.5 | Stability AI Community License | Kostenlos für nicht kommerzielle Nutzung und für kommerzielle Nutzung bis zu einem Jahresumsatz von 1 Million US-Dollar; bei höheren Umsätzen Stability AI wegen einer Unternehmenslizenz kontaktieren. Sie behalten das Eigentum an den generierten Bildern. |
Die Modelllizenz regelt nicht alles. Das Urheberrecht an einem generierten Bild und die Nutzung des Abbilds einer realen Person unterliegen dem Recht Ihres Landes, nicht der Softwarelizenz. Dieser Leitfaden beschreibt die von ihren Urhebern veröffentlichten Lizenzen und stellt keine Rechtsberatung dar.
- KI-Bild-Kit: Einstellungen für jede Grafikkarte und einsatzbereite Workflows
- Quelle: die Ankündigung von Stable Diffusion 3.5 und deren Lizenz
- Quelle: die Ankündigung der öffentlichen Freigabe von 2022
#FAQ
Ist Stable Diffusion kostenlos?+
Kann Stable Diffusion ohne Grafikkarte verwendet werden?+
Welche Version sollte man wählen: SD 1.5, SDXL oder SD 3.5?+
Bleiben meine Bilder privat?+
Stable Diffusion oder Flux?+
Kann Stable Diffusion auf einem Mac verwendet werden?+
Kann man generierte Bilder verkaufen?+
Haben Sie Feedback, einen Fehler entdeckt oder möchten Sie etwas präzisieren? Geben Sie uns Bescheid – so wird der Guide für alle besser.