Startseite›Katalog›RTX 3090 vs. RTX 4090

RTX 3090 vs RTX 4090: Welche GPU für lokale KI?

Vergleich mit Fokus auf Lokales LLM : Wir betrachten, worauf es beim Betrieb von Modellen wirklich ankommt – vor allem auf den VRAM, dann auf die Generation und den Preis. Am Ende folgt eine Kaufempfehlung.

Aktualisiert am 09/10/2026

Vergleich auf einen Blick

KriteriumRTX 3090RTX 4090
Speicher24 GB VRAM24 GB VRAM
MarkeNVIDIANVIDIA
Kompatible Modelle (Q4)178 Modelle aus dem Katalog178 Modelle aus dem Katalog
Größtes Modell (Q4)Salamandra 40B Instruct (40B)Salamandra 40B Instruct (40B)

Welche Grafikkarte wählen, um ein LLM auszuführen?

Bei gleicher VRAM-Kapazität (24 GB) entscheiden Sie anhand des Preises und der Generation: Die neuere Karte bietet eine bessere Energieeffizienz und längeren Softwaresupport.

Goldene Regel: bei gleichem Budget: Wählen Sie immer die GPU mit dem meisten VRAM. Wenn ein Modell nicht vollständig in den VRAM passt, sinkt seine Geschwindigkeit drastisch (CPU-Offload). Der VRAM bestimmt die Größe des Modells; die Rechenleistung bestimmt vor allem die Geschwindigkeit.

Wo kaufen (aktuelle Preise und Verfügbarkeit)

RTX 3090
AmazonPreis ansehen →

Kaufalternative: GMKtec EVO-X2 64 GB / 1 TB (Ryzen AI Max+ 395). Ein Mini-PC ist ein vollständiges System, keine Ersatzkarte; prüfen Sie Speicher und Softwarekompatibilität.

RTX 4090
AmazonPreis ansehen →

Kaufalternative: GMKtec EVO-X2 64 GB / 1 TB (Ryzen AI Max+ 395). Ein Mini-PC ist ein vollständiges System, keine Ersatzkarte; prüfen Sie Speicher und Softwarekompatibilität.

Affiliate-Links — WelchesLLM kann an Käufen eine Provision erhalten, ohne zusätzliche Kosten für Sie; dies beeinflusst diesen unabhängig erstellten Vergleich nicht. Als Amazon-Partner verdient WelchesLLM an qualifizierten Käufen.

Häufige Fragen

RTX 3090 oder RTX 4090, um einen LLM lokal auszuführen?

Für den lokalen Einsatz ist die VRAM hat Vorrang. Die RTX 3090 (24 GB) kann größere Modelle ausführen als die RTX 4090 (24 GB).

Was ist das größte Modell, das auf einer RTX 3090 laufen kann?

Bis zu Salamandra 40B Instruct (40B) in Q4-Quantisierung, mit ihren 24 GB.

Sollte man gebraucht kaufen?

Bei LLMs schlägt eine gebrauchte GPU mit mehr VRAM oft eine fabrikneue Karte einer neueren Generation mit weniger VRAM. Prüfen Sie den Zustand und die Garantie.

Weiterführende Informationen