RTX 4090 vs RTX 4080 Super: Welche GPU für lokale KI?
Vergleich mit Fokus auf Lokales LLM : Wir betrachten, worauf es beim Betrieb von Modellen wirklich ankommt – vor allem auf den VRAM, dann auf die Generation und den Preis. Am Ende folgt eine Kaufempfehlung.
Aktualisiert am 05.10.2026
Vergleich auf einen Blick
| Kriterium | RTX 4090 | RTX 4080 Super |
|---|---|---|
| Speicher | 24 GB VRAM | 16 GB VRAM |
| Marke | NVIDIA | NVIDIA |
| Kompatible Modelle (Q4) | 176 Modelle im Katalog | 141 Modelle im Katalog |
| Größtes Modell (Q4) | Salamandra 40B Instruct (40B) | Qwen 3.8 27B Obliterated (28B) |
Welche Grafikkarte wählen, um ein LLM auszuführen?
Goldene Regel: bei gleichem Budget: Wählen Sie immer die GPU mit dem meisten VRAM. Wenn ein Modell nicht vollständig in den VRAM passt, sinkt seine Geschwindigkeit drastisch (CPU-Offload). Der VRAM bestimmt die Größe des Modells; die Rechenleistung bestimmt vor allem die Geschwindigkeit.
Wo kaufen (aktuelle Preise und Verfügbarkeit)
Kaufalternative: GMKtec EVO-X2 64 GB / 1 TB (Ryzen AI Max+ 395). Ein Mini-PC ist ein vollständiges System, keine Ersatzkarte; prüfen Sie Speicher und Softwarekompatibilität.
Kaufalternative: RTX 5080 16 GB.
Affiliate-Links — QuelLLM kann bei Käufen eine Provision erhalten, ohne dass dies für Sie zusätzliche Kosten verursacht. Dies beeinflusst diesen Vergleich (der unabhängig erstellt wurde) nicht. Als Amazon-Partner erzielt QuelLLM Einnahmen aus qualifizierten Käufen.
Häufige Fragen
RTX 4090 oder RTX 4080 Super, um ein LLM lokal auszuführen?
Für den lokalen Einsatz ist die VRAM hat Vorrang. Die RTX 4090 (24 GB) kann größere Modelle ausführen als die RTX 4080 Super (16 GB).
Was ist das größte Modell, das auf der RTX 4090 laufen kann?
Bis zu Salamandra 40B Instruct (40B) in Q4-Quantisierung, mit ihren 24 GB.
Sollte man gebraucht kaufen?
Bei LLMs schlägt eine gebrauchte GPU mit mehr VRAM oft eine fabrikneue Karte einer neueren Generation mit weniger VRAM. Prüfen Sie den Zustand und die Garantie.