Zurück zu allen Angeboten

NVIDIA RTX 4090 D

24 GB VRAM425 W TDP1 Anbieter3 Angebote1 Regionen

Die NVIDIA RTX 4090 D ist eine Consumer- GPU, basiert auf der Ada Lovelace-Architektur und verfügt über 24 GB Speicher mit 1.008 GB/s Speicherbandbreite und einer TDP von 425 W. Sie liefert 73,5 TFLOPS FP32-Rechenleistung. Derzeit bei 1 Anbieter verfügbar, ab 0,58 €/GPU/Stunde, mit einem Marktmedian von 0,58 €/GPU/Stunde über 3 Konfigurationen.

Günstigster
0,585 €/Std.
Vast.ai
Median
0,585 €/Std.
über 3 Angebote
Teuerster
0,585 €/Std.
Vast.ai
90-Tage-Trend
0.0%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

Speicher
24 GB
GDDR6X
Welche LLMs passen? ↓
TDP
425 W
Speicherbandbreite
1.008 GB/s
Architektur
Ada Lovelace
FP32-Leistung
73,5 TFLOPS
Marke
NVIDIA
Serie
GeForce RTX
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 2 Stunden

1 Angebot von 1 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Vast.ai logoVast.aiEmpfehlungslinkIm TrendGünstigster
×132126 GB
Tanzania
0,585 €
+143.6% 30T
Ab0,58 €
Starten

LLMs, die auf die NVIDIA RTX 4090 D passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 24 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
Zu groß
155 GB
Zu groß
90 GB
4× · 5,7 GB frei
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
4× · 18 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
4× · 9,7 GB frei
47 GB
Passt knapp auf 2×
28 GB
2× · 20 GB frei
oder 1× · 4 % übrig
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
4× · 17 GB frei
43 GB
2× · 4,8 GB frei
25 GB
2× · 23 GB frei
oder 1× · 14 % übrig
Gemma 4 31B
Google
31,3 Mrd.
75 GB
4× · 21 GB frei
41 GB
2× · 6,7 GB frei
24 GB
2× · 24 GB frei
oder 1× · 19 % übrig
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
4× · 21 GB frei
41 GB
2× · 6,8 GB frei
24 GB
Passt knapp auf 1×
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
4× · 29 GB frei
37 GB
2× · 11 GB frei
21 GB
1× · 2,7 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
4× · 38 GB frei
32 GB
2× · 16 GB frei
18 GB
1× · 5,6 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
1× · 7,5 GB frei
Gemma 3 12B
Google
12,2 Mrd.
29 GB
2× · 19 GB frei
16 GB
1× · 7,9 GB frei
9,4 GB
1× · 15 GB frei
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
1× · 2,9 GB frei
12 GB
1× · 12 GB frei
6,8 GB
1× · 17 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
1× · 4,3 GB frei
11 GB
1× · 13 GB frei
6,3 GB
1× · 18 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die RTX 4090 D pro Stunde?
Die RTX 4090 D beginnt bei 0,58 € pro GPU-Stunde, mit einem Median von 0,58 € über 3 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die RTX 4090 D an?
1 Anbieter führen derzeit die RTX 4090 D: Vast.ai. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die RTX 4090 D?
Die RTX 4090 D verfügt über 24 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der RTX 4090 D betreiben?
Mit 24 GB VRAM kann eine einzelne RTX 4090 D Modelle wie GLM-4.7 Flash, Qwen3.6 27B, Mistral Small 3.2 24B, gpt-oss-20b bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren RTX 4090 D betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere RTX 4090 D passen, sind Laguna-S 2.1 auf 4 GPUs mit 4 Bit, gpt-oss-120b auf 4 GPUs mit 4 Bit, Qwen3.6 35B-A3B auf 2 GPUs mit 8 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die RTX 4090 D am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die RTX 4090 D erfassen, liegt bei 0,58 € pro GPU-Stunde bei Vast.ai. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.