NVIDIA H200
Carte de classe entreprise, le GPU NVIDIA H200 repose sur l'architecture Hopper et dispose de 141 GB de mémoire, avec une bande passante mémoire de 4 800 GB/s et un TDP de 700 W. Il offre 67 TFLOPS de performances FP32 et 989 TFLOPS de performances tensorielles FP16. Actuellement disponible chez 9 fournisseurs à partir de 2,63 €/GPU/heure, avec une médiane du marché de 3,85 €/GPU/heure sur 20 configurations.
Caractéristiques matérielles
Identiques chez tous les fournisseurs
Prix médian sur l'ensemble des fournisseurs
12 offres chez 9 fournisseurs
Triées par prix croissant. Comparez les configurations côte à côte.
| Fournisseur | Nombre | vCPU | RAM | Région | Par heure de GPU | Total/h | Action |
|---|---|---|---|---|---|---|---|
| ×1 | 12 | 188 GB | 4,025 € | 4,03 € | Lancer | ||
Sesterce CloudLien affilié | ×8 | 96 | 2 TB | -- | À partir de2,170 € | À partir de17,36 € | |
| ×8 | 190 | 1,76 TB | -- | 2,385 € | 19,08 € | ||
Jusqu'à4 €de crédit | ×1 | 24 | 236 GB | À partir de2,631 € -6,8 % 30 j | À partir de2,63 € | Lancer | |
Theta EdgeCloudTendance | ×1 | 8 | 141 GB | -- | 3,236 € | À partir de3,24 € | Lancer |
OblivusLien affilié | ×1 | — | — | 3,499 € | 3,50 € | Lancer | |
| ×8 | 176 | 1,76 TB | 3,499 € | 27,99 € | |||
| ×8 | 208 | 1,86 TB | -- | 3,683 € 0,0 % 30 j | 29,47 € | Lancer | |
| ×2 | 56 | 504 GB | 3,806 € +9,0 % 30 j | À partir de7,61 € | Lancer | ||
Jusqu'à88 €de crédit | ×1 | — | — | 3,902 € +0,2 % 30 j | 3,90 € | Lancer | |
Jusqu'à438 €de crédit | ×1 | 12 | 188 GB | 4,025 € | 4,03 € | Lancer | |
| ×8 | 176 | 1,33 TB | -- | À partir de4,068 € +10,5 % 30 j | À partir de32,54 € | Lancer | |
| ×1 | 24 | 236 GB | À partir de4,823 € 0,0 % 30 j | À partir de4,82 € | Lancer |
LLM qui tiennent sur le GPU NVIDIA H200
VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 141 GB par GPU. Affichage des 12 plus grands qui tiennent.
| Modèle | Paramètres | 16 bits | 8 bits | 4 bits |
|---|---|---|---|---|
| DeepSeek V4 Pro DeepSeek | 1,6T 49B actifs | — Non publié | — Non publié | 1 038 GB 8× · 90 GB libres |
| Kimi K2.5 Moonshot AI | 1T 32B actifs | — Non publié | — Non publié | 714 GB 8× · 414 GB libres |
| GLM-5.2 Z.ai | 753B | 1 808 GB Trop grand | 994 GB 8× · 134 GB libres | 579 GB 8× · 549 GB libres ou 4× · 16 % de marge |
| DeepSeek R1 DeepSeek | 671B 37B actifs | — Non publié | 826 GB 8× · 302 GB libres | 481 GB 4× · 83 GB libres |
| DeepSeek V4 Flash DeepSeek | 284B | — Non publié | — Non publié | 192 GB 2× · 90 GB libres |
| Solar Open2 250B Upstage | 250B 15B actifs | 601 GB 8× · 527 GB libres ou 4× · 12 % de marge | 330 GB 4× · 234 GB libres ou 2× · 2 % de marge | 192 GB 2× · 90 GB libres |
| Qwen3 235B-A22B Alibaba | 235B 22B actifs | 564 GB 8× · 564 GB libres ou 4× · 19 % de marge | 310 GB 4× · 254 GB libres ou 2× · 9 % de marge | 181 GB 2× · 101 GB libres |
| Laguna-S 2.1 Poolside | 118B 8B actifs | 282 GB 4× · 282 GB libres ou 2× · 19 % de marge | 155 GB 2× · 127 GB libres ou 1× · 9 % de marge | 90 GB 1× · 51 GB libres |
| gpt-oss-120b OpenAI | 117B 5,1B actifs | — Non publié | — Non publié | 78 GB 1× · 63 GB libres |
| Qwen3.6 35B-A3B Alibaba | 35B 3B actifs | 86 GB 1× · 55 GB libres | 47 GB 1× · 94 GB libres | 28 GB 1× · 113 GB libres |
| Qwen3 32B Alibaba | 32,8B | 79 GB 1× · 62 GB libres | 43 GB 1× · 98 GB libres | 25 GB 1× · 116 GB libres |
| Gemma 4 31B Google | 31,3B | 75 GB 1× · 66 GB libres | 41 GB 1× · 100 GB libres | 24 GB 1× · 117 GB libres |
Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle
Voir d'autres GPU similaires dans
Vous en voulez plus sur cette page ?
Des données erronées ?






