Retour à toutes les offres

NVIDIA A100 40GB

40 GB VRAM312 FP16 TFLOPS250 W TDP3 fournisseurs7 offres2 régions

Carte de classe entreprise, le GPU NVIDIA A100 40GB repose sur l'architecture Ampere et dispose de 40 GB de mémoire, avec une bande passante mémoire de 1 555 GB/s et un TDP de 250 W. Il offre 19,5 TFLOPS de performances FP32 et 312 TFLOPS de performances tensorielles FP16. Actuellement disponible chez 3 fournisseurs à partir de 1,12 €/GPU/heure, avec une médiane du marché de 1,35 €/GPU/heure sur 7 configurations.

Le moins cher
1,124 €/h
Verda
Médiane
1,351 €/h
sur 7 offres
Le plus cher
1,833 €/h
Omega Gradient
Tendance sur 90 jours
+10,4 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
40 GB
HBM2e
Quels LLM tiennent ? ↓
Performances FP16
312 TFLOPS
crête
TDP
250 W
Bande passante mémoire
1 555 GB/s
Architecture
Ampere
Performances FP32
19,5 TFLOPS
Marque
NVIDIA
Série
A100
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

4 offres chez 3 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
VerdaLe moins cher
×122120 GB--
À partir de1,124 €
+2,9 % 30 j
À partir de1,12 €
Lancer
×8120940 GB
États-Unis
À partir de1,289 €
+15,3 % 30 j
À partir de10,31 €
Lancer
×130200 GB
CanadaÉtats-Unis
1,351 €
0,0 % 30 j
À partir de1,35 €
Lancer
×1——--
1,745 €
1,75 €

LLM qui tiennent sur le GPU NVIDIA A100 40GB

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 40 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
DeepSeek V4 Flash
DeepSeek
284B
—
Non publié
—
Non publié
192 GB
8× · 128 GB libres
Solar Open2 250B
Upstage
250B
15B actifs
601 GB
Trop grand
330 GB
Juste sur 8× · 16 % de marge
192 GB
8× · 128 GB libres
Qwen3 235B-A22B
Alibaba
235B
22B actifs
564 GB
Trop grand
310 GB
8× · 9,7 GB libres
181 GB
8× · 139 GB libres
Laguna-S 2.1
Poolside
118B
8B actifs
282 GB
8× · 38 GB libres
155 GB
8× · 165 GB libres
90 GB
8× · 230 GB libres
gpt-oss-120b
OpenAI
117B
5,1B actifs
—
Non publié
—
Non publié
78 GB
8× · 242 GB libres
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
8× · 234 GB libres
47 GB
8× · 273 GB libres
ou 1× · 1 % de marge
28 GB
1× · 12 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
8× · 241 GB libres
43 GB
8× · 277 GB libres
ou 1× · 10 % de marge
25 GB
1× · 15 GB libres
Gemma 4 31B
Google
31,3B
75 GB
8× · 245 GB libres
41 GB
8× · 279 GB libres
ou 1× · 16 % de marge
24 GB
1× · 16 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
8× · 245 GB libres
41 GB
8× · 279 GB libres
ou 1× · 16 % de marge
24 GB
1× · 16 GB libres
Qwen3.6 27B
Alibaba
27,8B
67 GB
8× · 253 GB libres
37 GB
1× · 3,3 GB libres
21 GB
1× · 19 GB libres
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
8× · 262 GB libres
32 GB
1× · 8,3 GB libres
18 GB
1× · 22 GB libres
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
1× · 23 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU A100 40GB par heure ?
Le GPU A100 40GB démarre à 1,12 € par GPU-heure, avec une médiane de 1,35 € sur 7 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU A100 40GB ?
4 fournisseurs proposent actuellement le GPU A100 40GB : Verda, Runcrate, Omega Gradient, EmpirioLabs AI. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU A100 40GB ?
Le GPU A100 40GB dispose de 40 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU A100 40GB ?
Avec 40 GB de VRAM, un seul GPU A100 40GB peut servir des modèles comme Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU A100 40GB ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes A100 40GB sont DeepSeek V4 Flash sur 8 GPU en 4 bits, Solar Open2 250B sur 8 GPU en 4 bits, Qwen3 235B-A22B sur 8 GPU en 8 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU A100 40GB est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU A100 40GB est de 1,12 € par GPU-heure, chez Verda. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.