Retour à toutes les offres

NVIDIA T4

16 GB VRAM65 FP16 TFLOPS70 W TDP4 fournisseurs9 offres4 régions

Carte de classe entreprise, le GPU NVIDIA T4 repose sur l'architecture Turing et dispose de 16 GB de mémoire, avec une bande passante mémoire de 300 GB/s et un TDP de 70 W. Il offre 8,1 TFLOPS de performances FP32 et 65 TFLOPS de performances tensorielles FP16. Actuellement disponible chez 4 fournisseurs à partir de 0,10 €/GPU/heure, avec une médiane du marché de 0,18 €/GPU/heure sur 9 configurations.

Le moins cher
0,096 €/h
Akash Network
Médiane
0,175 €/h
sur 9 offres
Le plus cher
0,193 €/h
Vast.ai
Tendance sur 90 jours
0,0 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Performances FP16
65 TFLOPS
crête
TDP
70 W
Bande passante mémoire
300 GB/s
Architecture
Turing
Performances FP32
8,1 TFLOPS
Marque
NVIDIA
Série
T4
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

4 offres chez 4 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
Vast.aiPromu
Promotion affiliée — nous pouvons percevoir une commission.
×21963 GB
Tchéquie
0,132 €0,26 €Lancer
Akash NetworkLe moins cher
Jusqu'à88 €de crédit
×1——
États-UnisPortugal
0,096 €
0,0 % 30 j
0,10 €
Lancer
Vast.aiLien affiliéTendance
×21963 GB
TchéquieSuède
À partir de0,132 €
+23,5 % 30 j
À partir de0,26 €
Lancer
×456504 GB--
0,136 €
+19,2 % 30 j
0,54 €
Lancer
×128 GB--
0,175 €
À partir de0,18 €
Lancer

LLM qui tiennent sur le GPU NVIDIA T4

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 16 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
Laguna-S 2.1
Poolside
118B
8B actifs
282 GB
Trop grand
155 GB
Trop grand
90 GB
Juste sur 5× · 6 % de marge
gpt-oss-120b
OpenAI
117B
5,1B actifs
—
Non publié
—
Non publié
78 GB
5× · 1,7 GB libres
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
Juste sur 5× · 11 % de marge
47 GB
4× · 17 GB libres
28 GB
2× · 4,4 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
5× · 1,4 GB libres
43 GB
4× · 21 GB libres
25 GB
2× · 6,8 GB libres
Gemma 4 31B
Google
31,3B
75 GB
5× · 4,9 GB libres
ou 4× · 2 % de marge
41 GB
4× · 23 GB libres
24 GB
2× · 8 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
5× · 5,1 GB libres
ou 4× · 2 % de marge
41 GB
4× · 23 GB libres
24 GB
2× · 8 GB libres
Qwen3.6 27B
Alibaba
27,8B
67 GB
5× · 13 GB libres
ou 4× · 15 % de marge
37 GB
4× · 27 GB libres
ou 2× · 4 % de marge
21 GB
2× · 11 GB libres
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
4× · 6,4 GB libres
32 GB
Tient tout juste sur 2×
18 GB
2× · 14 GB libres
ou 1× · 4 % de marge
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
2× · 15 GB libres
ou 1× · 16 % de marge
Gemma 3 12B
Google
12,2B
29 GB
2× · 2,8 GB libres
16 GB
2× · 16 GB libres
ou 1× · 19 % de marge
9,4 GB
1× · 6,6 GB libres
Granite 4.1 8B
IBM
8,8B
21 GB
2× · 11 GB libres
12 GB
1× · 4,4 GB libres
6,8 GB
1× · 9,2 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
2× · 12 GB libres
11 GB
1× · 5,2 GB libres
6,3 GB
1× · 9,7 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU T4 par heure ?
Le GPU T4 démarre à 0,10 € par GPU-heure, avec une médiane de 0,18 € sur 9 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU T4 ?
4 fournisseurs proposent actuellement le GPU T4 : Vast.ai, Theta EdgeCloud, Omega Gradient, Akash Network. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU T4 ?
Le GPU T4 dispose de 16 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU T4 ?
Avec 16 GB de VRAM, un seul GPU T4 peut servir des modèles comme Gemma 3 12B, Granite 4.1 8B, Qwen3 8B. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU T4 ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes T4 sont gpt-oss-120b sur 5 GPU en 4 bits, Qwen3.6 35B-A3B sur 2 GPU en 4 bits, Qwen3 32B sur 2 GPU en 4 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU T4 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU T4 est de 0,10 € par GPU-heure, chez Akash Network. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.