Zurück zu allen Angeboten

NVIDIA T4

16 GB VRAM65 FP16 TFLOPS70 W TDP3 Anbieter8 Angebote2 Regionen

Die NVIDIA T4 ist eine Enterprise- GPU, basiert auf der Turing-Architektur und verfügt über 16 GB Speicher mit 300 GB/s Speicherbandbreite und einer TDP von 70 W. Sie liefert 8,1 TFLOPS FP32-Rechenleistung und 65 TFLOPS FP16-Tensor-Leistung. Derzeit bei 3 Anbieter verfügbar, ab 0,11 €/GPU/Stunde, mit einem Marktmedian von 0,16 €/GPU/Stunde über 8 Konfigurationen.

Günstigster
0,112 €/Std.
Omega Gradient
Median
0,163 €/Std.
über 8 Angebote
Teuerster
10,305 €/Std.
Vast.ai
90-Tage-Trend
-5.0%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
65 TFLOPS
peak
TDP
70 W
Speicherbandbreite
300 GB/s
Architektur
Turing
FP32-Leistung
8,1 TFLOPS
Marke
NVIDIA
Serie
T4
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 1 Stunde

3 Angebote von 3 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Vast.ai logoVast.aiBeworben
Affiliate-Werbung — wir erhalten möglicherweise eine Provision.
×248126 GB
China
0,146 €0,29 €Starten
Omega Gradient logoOmega GradientGünstigster
×272252 GB
United States
0,112 €
0,22 €
Starten
Vast.ai logoVast.aiEmpfehlungslinkIm Trend
×248126 GB
ChinaUnited States
Ab0,146 €
+20.0% 30T
Ab0,29 €
Starten
×128 GB--
0,172 €
Ab0,17 €
Starten

LLMs, die auf die NVIDIA T4 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 16 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
Zu groß
47 GB
4× · 17 GB frei
28 GB
2× · 4,4 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
Zu groß
43 GB
4× · 21 GB frei
25 GB
2× · 6,8 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
Knapp auf 4× · 2 % übrig
41 GB
4× · 23 GB frei
24 GB
2× · 8 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
Knapp auf 4× · 2 % übrig
41 GB
4× · 23 GB frei
24 GB
2× · 8 GB frei
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
Knapp auf 4× · 15 % übrig
37 GB
4× · 27 GB frei
oder 2× · 4 % übrig
21 GB
2× · 11 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
4× · 6,4 GB frei
32 GB
Passt knapp auf 2×
18 GB
2× · 14 GB frei
oder 1× · 4 % übrig
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
2× · 15 GB frei
oder 1× · 16 % übrig
Gemma 3 12B
Google
12,2 Mrd.
29 GB
2× · 2,8 GB frei
16 GB
2× · 16 GB frei
oder 1× · 19 % übrig
9,4 GB
1× · 6,6 GB frei
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
2× · 11 GB frei
12 GB
1× · 4,4 GB frei
6,8 GB
1× · 9,2 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
2× · 12 GB frei
11 GB
1× · 5,2 GB frei
6,3 GB
1× · 9,7 GB frei
Llama 3.1 8B Instruct
Meta
8 Mrd.
19 GB
2× · 13 GB frei
11 GB
1× · 5,4 GB frei
6,2 GB
1× · 9,8 GB frei
Mistral 7B Instruct v0.3
Mistral AI
7,2 Mrd.
17 GB
2× · 15 GB frei
oder 1× · 10 % übrig
9,6 GB
1× · 6,4 GB frei
5,6 GB
1× · 10 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die T4 pro Stunde?
Die T4 beginnt bei 0,11 € pro GPU-Stunde, mit einem Median von 0,16 € über 8 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die T4 an?
3 Anbieter führen derzeit die T4: Omega Gradient, Vast.ai, Theta EdgeCloud. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die T4?
Die T4 verfügt über 16 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der T4 betreiben?
Mit 16 GB VRAM kann eine einzelne T4 Modelle wie Gemma 3 12B, Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren T4 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere T4 passen, sind Qwen3.6 35B-A3B auf 2 GPUs mit 4 Bit, Qwen3 32B auf 2 GPUs mit 4 Bit, Gemma 4 31B auf 2 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die T4 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die T4 erfassen, liegt bei 0,11 € pro GPU-Stunde bei Omega Gradient. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.