Zurück zu allen Angeboten

NVIDIA L4

24 GB VRAM121 FP16 TFLOPS72 W TDP7 Anbieter23 Angebote7 Regionen

Die NVIDIA L4 ist eine Enterprise- GPU, basiert auf der Ada Lovelace-Architektur und verfügt über 24 GB Speicher mit 300 GB/s Speicherbandbreite und einer TDP von 72 W. Sie liefert 30,3 TFLOPS FP32-Rechenleistung und 121 TFLOPS FP16-Tensor-Leistung. Derzeit bei 7 Anbieter verfügbar, ab 0,15 €/GPU/Stunde, mit einem Marktmedian von 0,86 €/GPU/Stunde über 23 Konfigurationen.

Günstigster
0,146 €/Std.
Vast.ai
Median
0,857 €/Std.
über 23 Angebote
Teuerster
0,902 €/Std.
Runcrate
90-Tage-Trend
+92.2%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
121 TFLOPS
peak
TDP
72 W
Speicherbandbreite
300 GB/s
Architektur
Ada Lovelace
FP32-Leistung
30,3 TFLOPS
Marke
NVIDIA
Serie
L4
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 3 Stunden

7 Angebote von 7 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Runpod logoRunpodBeworben
Bis zu429 €GuthabenAffiliate-Werbung — wir erhalten möglicherweise eine Provision.
×1655 GB
RomaniaIceland
0,421 €0,42 €Starten
Vast.ai logoVast.aiEmpfehlungslinkIm TrendGünstigster
×232125 GB
NetherlandsSwitzerlandUnited States
Ab0,146 €
-15.0% 30T
Ab0,29 €
Starten
×148252 GB
United States
0,283 €
0.0% 30T
0,28 €
Starten
Runpod logoRunpodEmpfehlungslinkIm Trend
Bis zu429 €Guthaben
×1655 GB
RomaniaIceland
0,421 €
0.0% 30T
0,42 €
Starten
×1848 GB
FrancePoland
0,788 €
+1.5% 30T
Ab0,79 €
Starten
×432192 GB--
Ab0,857 €
+0.1% 30T
Ab3,43 €
Starten
Sesterce Cloud logoSesterce CloudEmpfehlungslink
×1848 GB
PolandFrance
0,897 €
0.0% 30T
Ab0,90 €
Starten
×1848 GB
PolandFrance
0,902 €
0.0% 30T
Ab0,90 €
Starten

LLMs, die auf die NVIDIA L4 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 24 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
DeepSeek V4 Flash
DeepSeek
284 Mrd.
Nicht veröffentlicht
Nicht veröffentlicht
192 GB
Passt knapp auf 8×
Solar Open2 250B
Upstage
250 Mrd.
15 Mrd. aktiv
Nicht veröffentlicht
330 GB
Zu groß
192 GB
Knapp auf 8× · 19 % übrig
Qwen3 235B-A22B
Alibaba
235 Mrd.
22 Mrd. aktiv
Nicht veröffentlicht
310 GB
Zu groß
181 GB
8× · 11 GB frei
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
Zu groß
155 GB
8× · 37 GB frei
90 GB
4× · 5,7 GB frei
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
4× · 18 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
4× · 9,7 GB frei
47 GB
Passt knapp auf 2×
28 GB
2× · 20 GB frei
oder 1× · 4 % übrig
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
4× · 17 GB frei
43 GB
2× · 4,8 GB frei
25 GB
2× · 23 GB frei
oder 1× · 14 % übrig
Gemma 4 31B
Google
31,3 Mrd.
75 GB
4× · 21 GB frei
41 GB
2× · 6,7 GB frei
24 GB
2× · 24 GB frei
oder 1× · 19 % übrig
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
4× · 21 GB frei
41 GB
2× · 6,8 GB frei
24 GB
Passt knapp auf 1×
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
4× · 29 GB frei
37 GB
2× · 11 GB frei
21 GB
1× · 2,7 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
4× · 38 GB frei
32 GB
2× · 16 GB frei
18 GB
1× · 5,6 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
1× · 7,5 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die L4 pro Stunde?
Die L4 beginnt bei 0,15 € pro GPU-Stunde, mit einem Median von 0,86 € über 23 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die L4 an?
8 Anbieter führen derzeit die L4: Omega Gradient, Sesterce Cloud, Scaleway, Runcrate, AceCloud, Vast.ai und 2 weitere. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die L4?
Die L4 verfügt über 24 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der L4 betreiben?
Mit 24 GB VRAM kann eine einzelne L4 Modelle wie GLM-4.7 Flash, Qwen3.6 27B, Mistral Small 3.2 24B, gpt-oss-20b bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren L4 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere L4 passen, sind DeepSeek V4 Flash auf 8 GPUs mit 4 Bit, Qwen3 235B-A22B auf 8 GPUs mit 4 Bit, Laguna-S 2.1 auf 4 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die L4 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die L4 erfassen, liegt bei 0,15 € pro GPU-Stunde bei Vast.ai. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.