Retour à toutes les offres

NVIDIA GH200

96 GB VRAM989 FP16 TFLOPS700 W TDP0 fournisseurs0 offres0 régions

Carte de classe entreprise, le GPU NVIDIA GH200 repose sur l'architecture Hopper et dispose de 96 GB de mémoire, avec une bande passante mémoire de 4 000 GB/s et un TDP de 700 W. Il offre 67 TFLOPS de performances FP32 et 989 TFLOPS de performances tensorielles FP16.

Le moins cher
—
Aucune offre actuellement
Médiane
—
sur 0 offres
Le plus cher
—
Tendance sur 90 jours
+0,2 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
96 GB
HBM3
Quels LLM tiennent ? ↓
Performances FP16
989 TFLOPS
crête
TDP
700 W
Bande passante mémoire
4 000 GB/s
Architecture
Hopper
Performances FP32
67 TFLOPS
Marque
NVIDIA
Série
GH200
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

2 offres chez 0 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
×164432 GB--
2,008 €
0,0 % 30 j
2,01 €
Sesterce CloudLien affilié
×1144480 GB--
4,081 €
4,08 €

LLM qui tiennent sur le GPU NVIDIA GH200

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 96 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
Laguna-S 2.1
Poolside
118B
8B actifs
282 GB
Trop grand
155 GB
Trop grand
90 GB
1× · 5,7 GB libres
gpt-oss-120b
OpenAI
117B
5,1B actifs
—
Non publié
—
Non publié
78 GB
1× · 18 GB libres
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
1× · 9,7 GB libres
47 GB
1× · 49 GB libres
28 GB
1× · 68 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
1× · 17 GB libres
43 GB
1× · 53 GB libres
25 GB
1× · 71 GB libres
Gemma 4 31B
Google
31,3B
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres
Qwen3.6 27B
Alibaba
27,8B
67 GB
1× · 29 GB libres
37 GB
1× · 59 GB libres
21 GB
1× · 75 GB libres
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
1× · 38 GB libres
32 GB
1× · 64 GB libres
18 GB
1× · 78 GB libres
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
1× · 79 GB libres
Gemma 3 12B
Google
12,2B
29 GB
1× · 67 GB libres
16 GB
1× · 80 GB libres
9,4 GB
1× · 87 GB libres
Granite 4.1 8B
IBM
8,8B
21 GB
1× · 75 GB libres
12 GB
1× · 84 GB libres
6,8 GB
1× · 89 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
1× · 76 GB libres
11 GB
1× · 85 GB libres
6,3 GB
1× · 90 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Quels fournisseurs cloud proposent le GPU GH200 ?
2 fournisseurs proposent actuellement le GPU GH200 : Sesterce Cloud, Lambda. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU GH200 ?
Le GPU GH200 dispose de 96 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU GH200 ?
Avec 96 GB de VRAM, un seul GPU GH200 peut servir des modèles comme Laguna-S 2.1, gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.