Einsteiger 11 Min.Bild

Stable Diffusion lokal: Installation und Modelle

Direkte Antwort

Stable Diffusion ist eine Familie von Bildmodellen mit offenen Gewichten, keine Anwendung: Die Modelle werden in einer lokalen Benutzeroberfläche ausgeführt. Beginnen Sie mit SDXL (6,94 GB große Datei, 8 GB VRAM für einen komfortablen Betrieb) in Fooocus, in ComfyUI Desktop oder auf dem Mac in Draw Things. SD 1.5 eignet sich für kleine Grafikkarten; SD 3.5, angekündigt am 22. Oktober 2024, für Karten mit 12 GB und mehr. Neuere Modellfamilien wie Flux oder Z-Image werden vor allem über ComfyUI genutzt.

Stability AI hat am 22. August 2022 die öffentliche Veröffentlichung von Stable Diffusion angekündigt: ein Modell, das auf Ihrem eigenen Computer aus Text ein Bild erzeugt, ohne Konto oder Mengenbegrenzung. Mit Stand vom 28. September 2026 umfasst der Name drei Modellgenerationen, vier oder fünf mögliche Benutzeroberflächen und unterschiedliche Lizenzen. Dieser Leitfaden hilft Ihnen, eine Version und eine Benutzeroberfläche auszuwählen, alles unter Windows, macOS oder Linux zu installieren und zu verstehen, was Sie mit den Bildern tun dürfen.

Von Mohamed Meguedmi·Aktualisierung 2026-09-29·Unter Windows, macOS und Linux getestet

#Was ist Stable Diffusion?

Stable Diffusion ist ein latentes Diffusionsmodell. Es beginnt mit einem Bild aus reinem Rauschen und entfernt dieses schrittweise, gesteuert durch Ihren Text, bis ein stimmiges Bild entsteht. Die Berechnung erfolgt in einem komprimierten, sogenannten latenten Raum. Das erklärt, warum eine handelsübliche Grafikkarte ausreicht, während die ersten Diffusionsmodelle ein Rechenzentrum benötigten.

Berühmt wurde Stable Diffusion nicht durch seine reine Qualität, sondern durch seine Offenheit. Bei der Veröffentlichung im Jahr 2022 wählte Stability AI die Lizenz CreativeML OpenRAIL-M, die das Unternehmen als „permissiv“ beschreibt und die sowohl kommerzielle als auch nichtkommerzielle Nutzungen erlaubt: Die Modellgewichte lassen sich herunterladen, verändern und erneut trainieren. Es gibt Tausende spezialisierter Varianten. Stable Diffusion ist keine Anwendung: Es ist eine Modelldatei, die Sie in einer Benutzeroberfläche Ihrer Wahl ausführen.

Der Name birgt eine begriffliche Falle. Das Referenz-Repository von SD 1.5 auf Hugging Face präsentiert sich heute als Spiegel des alten, inzwischen veralteten RunwayML-Repositorys und steht in keiner Verbindung zu diesem Unternehmen. Und seit 2024 stammen die meistdiskutierten offenen Bildmodelle aus anderen Laboren: Flux, Qwen Image oder Z-Image. Sie laufen in denselben Benutzeroberflächen, tragen aber nicht den Namen Stable Diffusion.

#Die Versionen und welche Sie wählen sollten

Das KI-Bild-Kit

KI-Bilder und -Videos lokal erstellen, ohne Begrenzung: ComfyUI, Flux, Z-Image und Wan 2.2 auf Ihrer GPU oder Ihrem Mac – mit Workflows zum direkten Laden und Informationen zum rechtlichen Rahmen.

  • Lebenslanger Online-Zugang
  • PDF + Dateien
  • Erstattung binnen 30 Tagen
Die drei Generationen von Stable Diffusion für den lokalen Betrieb, laut Stability AI und den Modellbeschreibungen auf Hugging Face
VersionErscheinungsdatumHauptdateiNative AuflösungGroßzügig bemessener VRAMZusammenfassung
SD 1.520224,27 GB (v1-5-pruned-emaonly)512 × 5124 bis 6 GBLeichtgewichtig, riesige Bibliothek mit Varianten und LoRAs. Details und die Darstellung von Händen sind noch verbesserungswürdig.
SDXL 1.0Juli 20236,94 GB (sd_xl_base_1.0)1024 × 10248 GB: Stability AI gibt an, dass der Betrieb auf Karten mit 8 GB ordnungsgemäß funktioniertDer richtige Ausgangspunkt: deutlich höhere Qualität, ausgereiftes Ökosystem.
SD 3.522. Oktober 2024Medium: 2,5 Milliarden Parameter; Large: 8,1 Milliarden; Large Turbo: Version in 4 SchrittenMedium: 0,25 bis 2 Megapixel; Large: 1 MegapixelMedium: 9,9 GB ohne Textencoder (Stability AI). Large: mehr als 16 GB bei 16 Bit (unsere Berechnung)Bessere Befolgung des Prompts. Andere Lizenz, siehe unten.

Zwei Details helfen, Fehler beim Kauf oder Herunterladen zu vermeiden. Erstens gibt es SD 1.5 in zwei Dateien: v1-5-pruned-emaonly.safetensors (4,27 GB), die laut Modellbeschreibung weniger VRAM benötigt und für die Inferenz geeignet ist, und v1-5-pruned.safetensors (7,7 GB), die für erneutes Training vorgesehen ist. Zum Generieren von Bildern nehmen Sie die erste Datei. Zweitens lässt sich SD 3.5 Large mit seinen 8,1 Milliarden Parametern nicht anhand der Angaben zur Medium-Version beurteilen: Rechnen Sie nicht damit, dass es auf einer Grafikkarte mit 8 GB läuft.

Wenn Sie mit einer Grafikkarte mit 8 GB einsteigen, beginnen Sie mit SDXL: Es bietet das beste Verhältnis zwischen Qualität, Geschwindigkeit und verfügbarer Dokumentation. Mit 12 bis 16 GB sollten Sie sich auch die neueren Modelle in ComfyUI ansehen: Laut dessen README werden Flux.1, Flux.2, Qwen Image und Z-Image nativ unterstützt.

#Die notwendige Hardware

Was je nach Ihrer Grafikkarte funktioniert · Karten aus der QuelLLM-Hardwaredatenbank
Ihr Hardware-SetupWas gut funktioniert
NVIDIA-Grafikkarte mit 4 bis 6 GB (GTX 1660, RTX 2060, RTX 3050)SD 1.5. Fooocus, das mit SDXL arbeitet, gibt 4 GB VRAM und 8 GB RAM als Mindestanforderungen an und nutzt dabei den virtuellen Speicher von Windows: langsam, aber möglich.
NVIDIA-Grafikkarte mit 8 GB (RTX 3060 Ti, RTX 4060, RTX 5060)SDXL läuft problemlos; von Stability AI genannter Schwellenwert
NVIDIA-Grafikkarte mit 12 bis 16 GB (RTX 3060 12 GB, RTX 4070, RTX 5070 Ti)SDXL mit LoRA und Upscaling, SD 3.5 Medium, Z-Image Turbo (16 GB laut Modellbeschreibung), Flux in FP8
Neuere AMD-Karte (RX 7000, RX 9000)Gut unter Linux mit ROCm; unter Windows ist die offizielle ROCm-Unterstützung in ComfyUI Desktop seit Januar 2026 verfügbar
Mac mit Apple SiliconJeder M-Chip: Der vereinheitlichte Speicher dient als VRAM. Langsamer als eine NVIDIA-Grafikkarte einer vergleichbaren Leistungsklasse.
Keine GrafikkarteTechnisch möglich, aber deutlich langsamer: nur für Tests verwenden

Planen Sie auch den Speicherplatz auf den Laufwerken ein. Eine einzige SDXL-Datei ist 6,94 GB groß, und Sammlungen von LoRAs und Varianten wachsen schnell. Fooocus empfiehlt, auf jedem Laufwerk mindestens 40 GB frei zu halten, wenn der Fehler „RuntimeError: CPUAllocator“ auftritt.

#Welche Benutzeroberfläche installieren

Wichtige Benutzeroberflächen, Stand: 28. September 2026
BenutzeroberflächeFür wenStärkenGrenzen
FooocusAnfängerEin Textfeld, eine Schaltfläche, durchdachte Standardeinstellungen; weniger als drei Klicks vom Download bis zum ersten Bild, laut dem zugehörigen READMENur SDXL: Das Projekt erhält eingeschränkten Langzeitsupport, ausschließlich Fehlerbehebungen.
Forge (Repository von lllyasviel)Benutzer der Oberfläche mit RegisterkartenDie Benutzeroberfläche von AUTOMATIC1111, mit geringerem Speicherbedarf und Unterstützung für FluxSeit Juni 2025 keine Commits mehr auf dem Hauptbranch; die Weiterentwicklung erfolgt über Forks wie Forge Neo
AUTOMATIC1111Diejenigen, die alte Anleitungen befolgenDie etablierte Benutzeroberfläche mit der umfangreichsten DokumentationLetzte Version im Februar 2025 veröffentlicht, Flux wird nicht unterstützt
ComfyUIFortgeschrittene und neugierige BenutzerNative Unterstützung aktueller Modelle, reproduzierbare Workflows, sehr aktives ProjektLernkurve
Draw ThingsMac, iPhone, iPadNative Anwendung, kostenlose Edition mit lokalen Berechnungen ohne Internetverbindung, LoRA-Training auf dem GerätNur im Apple-Ökosystem; kostenpflichtige Cloud-Angebote sind optional verfügbar und sollten vermieden werden, wenn Sie zu 100 % lokal bleiben möchten
!
Fooocus: Vorsicht vor falschen Websites
Die README von Fooocus warnt davor, dass bei der Suche nach dem Namen zahlreiche gefälschte Websites auftauchen, und nennt fooocus.com, fooocus.net, fooocus.ai und fooocus.org als Beispiele, die allesamt gefälscht sind. Die einzige offizielle Quelle ist das GitHub-Repository des Projekts. Derselbe Rat gilt für andere Software: Gehen Sie vom Repository aus, nicht von einer Werbeanzeige.

#Der kürzeste Weg je nach Betriebssystem

  1. 01
    Windows mit einer NVIDIA-Karte
    Am schnellsten geht es mit Fooocus. Laden Sie das Archiv von der offiziellen GitHub-Seite herunter, entpacken Sie es und führen Sie run.bat aus. Beim ersten Start werden die Modelle nach Fooocus\models\checkpoints heruntergeladen. Wenn Sie ein Tool möchten, das mit neuen Modellen Schritt hält, installieren Sie stattdessen ComfyUI Desktop, das im README von ComfyUI neuen Nutzern empfohlen wird.
  2. 02
    RTX-50-Karte: Prüfen Sie PyTorch
    Die All-in-one-Archive von Forge nennen CUDA 12.1 und PyTorch 2.3.1 als empfohlene Versionen. Die Karten der RTX-50-Serie benötigen jedoch eine aktuelle PyTorch-Version: Ein Mitwirkender an AUTOMATIC1111 nennt PyTorch 2.7.0 als erste offizielle Version, die diese Karten unterstützt. Auf einer RTX 50 sollten Sie ComfyUI bevorzugen, dessen Dokumentation CUDA 13.0 für neuere NVIDIA-Karten verlangt.
  3. 03
    Mac mit Apple Silicon
    Installieren Sie Draw Things über den App Store: Die kostenlose Version führt die Berechnungen lokal und offline aus, ohne Befehlszeile. Aktivieren Sie die Cloud-Optionen nicht, wenn Sie möchten, dass nichts den Mac verlässt. ComfyUI Desktop ist ebenfalls für macOS auf Apple Silicon verfügbar.
  4. 04
    Linux oder AMD-Karte
    Manuelle Installation von ComfyUI: Klonen des Repositorys, Python-Umgebung, PyTorch in der CUDA- oder ROCm-Version je nach Grafikkarte. Die ausführliche Anleitung finden Sie in unserem ComfyUI-Leitfaden. Fooocus bietet auch eine Linux-Installation über Anaconda an.
  5. 05
    Prüfen, ob die GPU arbeitet
    Während einer Generierung muss der Befehl nvidia-smi den belegten VRAM und eine GPU-Auslastung nahe 100 % anzeigen. Wenn die Bilderzeugung mehrere Minuten dauert, läuft die Benutzeroberfläche auf dem Prozessor: Das liegt fast immer an einer ungeeigneten PyTorch-Version.

#Wo Sie die Modelle finden und welche Sie vermeiden sollten

Zwei Quellen dominieren. Hugging Face hostet die offiziellen Modelle der Forschungslabore. Civitai vereint Varianten aus der Community: feinabgestimmte Modelle, LoRAs, Stile. Ein LoRA ist eine kleine Datei, die einem Basismodell einen Stil oder ein Thema hinzufügt, ohne es zu ersetzen. Es muss zur richtigen Modellfamilie gehören: Ein SDXL-LoRA funktioniert nicht mit SD 1.5.

!
Drei Vorsichtsmaßnahmen
Laden Sie nur .safetensors-Dateien herunter: Laut dem Repository des Formats werden Tensoren darin „safely (as opposed to pickle)“ gespeichert, während das ältere Format .ckpt beim Öffnen Code ausführen kann. Lesen Sie anschließend die Beschreibung jedes Community-Modells, denn viele sind mit Inhalten trainiert worden, deren kommerzielle Nutzung verboten oder rechtlich unklar ist. Wählen Sie schließlich die richtige Datei: Bei SD 1.5 dient die Variante „emaonly“ zum Generieren, die andere zum erneuten Trainieren.

#Einen Prompt schreiben, der funktioniert

Beschreiben Sie, geben Sie keine Befehle
Diese Modelle befolgen keine Anweisungen. „Porträt einer älteren Frau, Fensterlicht, 85-mm-Objektiv, geringe Schärfentiefe“ funktioniert; „Mach mir ein schönes Foto“ nicht.
Schreiben Sie auf Englisch
Die Modellkarte von SD 1.5 nennt „Language(s): English“ und einen eingefrorenen CLIP-ViT-L/14-Textencoder. Französisch wird verstanden, aber weniger differenziert.
Thema, dann Rahmen, dann Stil
Die Reihenfolge zählt: Was zuerst kommt, hat das größte Gewicht.
Negativer Prompt
Er listet auf, was Sie nicht sehen möchten. Besonders nützlich bei SD 1.5 und SDXL; prüfen Sie bei einem neueren Modell in der Modellkarte, ob es den negativen Prompt berücksichtigt.
Behalten Sie den Seed bei
Gleicher Seed, gleiche Einstellungen, gleiches Bild. Um zwei Prompts zu vergleichen, legen Sie den Seed fest und ändern Sie jeweils nur eine Sache.

#Lizenzen und kommerzielle Nutzung

Lizenzen der drei Generationen laut den Veröffentlichungen von Stability AI und den Modellkarten auf Hugging Face
ModellLizenzKommerzieller Gebrauch von Bildern
SD 1.5CreativeML OpenRAIL-MErlaubt: Stability AI beschreibt die Lizenz als permissiv für kommerzielle und nichtkommerzielle Nutzungen, mit ethischen Nutzungsbeschränkungen, die in der Lizenz aufgeführt sind
SDXL 1.0CreativeML OpenRAIL++-MZulässig, gleiche Prinzipien
SD 3.5Stability AI Community LicenseKostenlos für nicht kommerzielle Nutzung und für kommerzielle Nutzung bis zu einem Jahresumsatz von 1 Million US-Dollar; bei höheren Umsätzen Stability AI wegen einer Unternehmenslizenz kontaktieren. Sie behalten das Eigentum an den generierten Bildern.

Die Modelllizenz regelt nicht alles. Das Urheberrecht an einem generierten Bild und die Nutzung des Abbilds einer realen Person unterliegen dem Recht Ihres Landes, nicht der Softwarelizenz. Dieser Leitfaden beschreibt die von ihren Urhebern veröffentlichten Lizenzen und stellt keine Rechtsberatung dar.

#FAQ

FAQ
Ist Stable Diffusion kostenlos?+
Ja. Die Modelle können kostenlos heruntergeladen werden, und die Benutzeroberflächen, mit denen sie ausgeführt werden, sind Open Source. Beim lokalen Betrieb zahlen Sie weder ein Abonnement noch Credits, sondern nur für Ihre Hardware und den Strom. Eine Ausnahme bei der Lizenzierung: SD 3.5 ist für die kommerzielle Nutzung bis zu einem Jahresumsatz von 1 Million US-Dollar kostenlos; darüber hinaus ist eine Unternehmenslizenz erforderlich. Es gibt kostenpflichtige Online-Dienste, sie sind aber nicht notwendig.
Kann Stable Diffusion ohne Grafikkarte verwendet werden?+
Technisch ja, aber die Generierung wird deutlich langsamer. Für den praktischen Einsatz sollten Sie für SDXL eine NVIDIA-Karte mit 8 GB Speicher einplanen – den von Stability AI genannten Schwellenwert für einen ordnungsgemäßen Betrieb – oder einen Mac mit Apple Silicon. Fooocus kommt unter Windows bereits mit 4 GB VRAM und 8 GB RAM aus, allerdings auf Kosten der Geschwindigkeit. Ohne GPU sollten Sie den Versuch auf wenige Testbilder beschränken.
Welche Version sollte man wählen: SD 1.5, SDXL oder SD 3.5?+
SDXL für einen ersten Versuch: 8 GB VRAM reichen aus und das Ökosystem ist ausgereift. SD 1.5, wenn Ihre Karte 4 bis 6 GB hat, für weniger anspruchsvolle Bilder. SD 3.5 Medium benötigt laut Stability AI 9,9 GB VRAM ohne die Textencoder: Verwenden Sie es nur mit Karten ab 12 GB oder wenn es auf die genaue Einhaltung des Prompts ankommt.
Bleiben meine Bilder privat?+
Ja, wenn Sie alles lokal ausführen: Der Prompt und das Bild verlassen Ihren Rechner nicht. Draw Things gibt an, in seiner kostenlosen Version offline zu funktionieren, und laut der README von ComfyUI lädt dessen Kern nichts ohne Aufforderung herunter. Daten können nur durch Online-Optionen, die Sie aktivieren, oder durch eine bösartige Erweiterung nach außen gelangen: Installieren Sie aus offiziellen Repositories.
Stable Diffusion oder Flux?+
Stable Diffusion bleibt leichter und ist besser dokumentiert: SDXL passt in 8 GB. Flux.1 dev ist bei voller Präzision 23,8 GB groß, der FP8-Checkpoint von Comfy-Org 17,2 GB. Damit richtet sich Flux eher an Karten mit 12 bis 16 GB oder mehr. Wählen Sie Flux für die genaue Umsetzung des Prompts, wenn Ihre Karte dafür ausreicht, andernfalls SDXL mit dem größten LoRA-Ökosystem.
Kann Stable Diffusion auf einem Mac verwendet werden?+
Ja, auf Apple-Silicon-Chips. Draw Things ist eine Anwendung, deren kostenlose Edition offline auf Mac, iPhone und iPad rechnet. ComfyUI Desktop gibt es ebenfalls für macOS, und das Wiki von AUTOMATIC1111 dokumentiert eine Mac-Installation, bei der das Training weiterhin sehr langsam ist. NVIDIA-Karten bleiben in einer vergleichbaren Leistungsklasse schneller, aber ein Mac reicht zum Lernen aus.
Kann man generierte Bilder verkaufen?+
Oft ja, aber es hängt vom Modell ab. SD 1.5 und SDXL erlauben unter OpenRAIL-Lizenzen die kommerzielle Nutzung mit Nutzungseinschränkungen. SD 3.5 ist bei einem Jahresumsatz von weniger als 1 Million US-Dollar kostenlos. Lesen Sie auch die Beschreibungen der zusätzlich verwendeten Community-Modelle und -LoRAs und bedenken Sie, dass sich das Urheberrecht an einem generierten Bild nach dem Recht Ihres Landes richtet.
Hat Ihnen dieser Guide geholfen?

Haben Sie Feedback, einen Fehler entdeckt oder möchten Sie etwas präzisieren? Geben Sie uns Bescheid – so wird der Guide für alle besser.