NVIDIA H100
Carte de classe entreprise, le GPU NVIDIA H100 repose sur l'architecture Hopper et dispose de 80 GB de mémoire, avec une bande passante mémoire de 3 350 GB/s et un TDP de 700 W. Il offre 67 TFLOPS de performances FP32 et 989 TFLOPS de performances tensorielles FP16. Actuellement disponible chez 15 fournisseurs à partir de 1,14 €/GPU/heure, avec une médiane du marché de 2,87 €/GPU/heure sur 68 configurations.

H100 · design de référence PCIe
Illustration PCIe. Les configurations proposées peuvent utiliser la variante SXM ou d'autres variantes.
Caractéristiques matérielles
Identiques chez tous les fournisseurs
Prix médian sur l'ensemble des fournisseurs
18 offres chez 15 fournisseurs
Triées par prix croissant. Comparez les configurations côte à côte.
| Fournisseur | Nombre | vCPU | RAM | Région | Par heure de GPU | Total/h | Action |
|---|---|---|---|---|---|---|---|
| ×1 | 26 | 125 GB | 3,061 € | 3,06 € | Lancer | ||
Jusqu'à4 €de crédit | ×1 | 20 | 236 GB | À partir de1,140 € -18,8 % 30 j | À partir de1,14 € | Lancer | |
Jusqu'à88 €de crédit | ×1 | — | — | 1,789 € 0,0 % 30 j | 1,79 € | Lancer | |
| ×1 | 8 | 94 GB | À partir de1,842 € +9,6 % 30 j | À partir de1,84 € | Lancer | ||
Theta EdgeCloudTendance | ×1 | 10 | 80 GB | -- | 2,008 € | À partir de2,01 € | Lancer |
| ×1 | 28 | 180 GB | À partir de2,192 € 0,0 % 30 j | À partir de2,19 € | Lancer | ||
| ×1 | 20 | 236 GB | À partir de2,280 € +35,7 % 30 j | À partir de2,28 € | Lancer | ||
| ×1 | 28 | 180 GB | À partir de2,306 € -0,1 % 30 j | À partir de2,31 € | Lancer | ||
| ×1 | 28 | 180 GB | 2,412 € +25,6 % 30 j | À partir de2,41 € | Lancer | ||
| ×1 | 20 | 128 GB | -- | À partir de2,631 € | À partir de2,63 € | ||
Thunder ComputeLien affilié | ×1 | 4 | 32 GB | -- | À partir de2,806 € 0,0 % 30 j | À partir de2,81 € | Lancer |
| ×1 | 24 | 240 GB | À partir de2,866 € +3,5 % 30 j | À partir de2,87 € | Lancer | ||
| ×1 | 26 | 200 GB | -- | À partir de2,885 € +1,2 % 30 j | À partir de2,89 € | ||
Jusqu'à1 €de crédit | ×8 | 128 | 1,5 TB | À partir de2,921 € -0,4 % 30 j | À partir de23,36 € | Lancer | |
Novita AILien affilié | ×1 | 16 | 128 GB | 2,973 € 0,0 % 30 j | 2,97 € | ||
Jusqu'à438 €de crédit | ×1 | 26 | 125 GB | À partir de3,061 € -8,6 % 30 j | À partir de3,06 € | Lancer | |
OblivusLien affilié | ×1 | 28 | 180 GB | À partir de3,069 € 0,0 % 30 j | À partir de3,07 € | Lancer | |
| ×1 | 30 | 120 GB | -- | 3,118 € +8,8 % 30 j | À partir de3,12 € | Lancer | |
Sesterce CloudLien affilié | ×2 | 48 | 480 GB | À partir de3,183 € +13,6 % 30 j | À partir de6,37 € | Lancer |
LLM qui tiennent sur le GPU NVIDIA H100
VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 80 GB par GPU. Affichage des 12 plus grands qui tiennent.
| Modèle | Paramètres | 16 bits | 8 bits | 4 bits |
|---|---|---|---|---|
| Kimi K2.5 Moonshot AI | 1T 32B actifs | — Non publié | — Non publié | 714 GB Juste sur 8× · 7 % de marge |
| GLM-5.2 Z.ai | 753B | — Non publié | 994 GB Trop grand | 579 GB 8× · 61 GB libres |
| DeepSeek R1 DeepSeek | 671B 37B actifs | — Non publié | 826 GB Trop grand | 481 GB 8× · 159 GB libres |
| DeepSeek V4 Flash DeepSeek | 284B | — Non publié | — Non publié | 192 GB 4× · 128 GB libres ou 2× · 0 % de marge |
| Solar Open2 250B Upstage | 250B 15B actifs | 601 GB 8× · 39 GB libres | 330 GB 8× · 310 GB libres ou 4× · 16 % de marge | 192 GB 4× · 128 GB libres |
| Qwen3 235B-A22B Alibaba | 235B 22B actifs | 564 GB 8× · 76 GB libres | 310 GB 4× · 9,7 GB libres | 181 GB 4× · 139 GB libres ou 2× · 6 % de marge |
| Laguna-S 2.1 Poolside | 118B 8B actifs | 282 GB 4× · 38 GB libres | 155 GB 2× · 4,8 GB libres | 90 GB 2× · 70 GB libres ou 1× · 6 % de marge |
| gpt-oss-120b OpenAI | 117B 5,1B actifs | — Non publié | — Non publié | 78 GB 1× · 1,7 GB libres |
| Qwen3.6 35B-A3B Alibaba | 35B 3B actifs | 86 GB 2× · 74 GB libres ou 1× · 11 % de marge | 47 GB 1× · 33 GB libres | 28 GB 1× · 52 GB libres |
| Qwen3 32B Alibaba | 32,8B | 79 GB 1× · 1,4 GB libres | 43 GB 1× · 37 GB libres | 25 GB 1× · 55 GB libres |
| Gemma 4 31B Google | 31,3B | 75 GB 1× · 4,9 GB libres | 41 GB 1× · 39 GB libres | 24 GB 1× · 56 GB libres |
| GLM-4.7 Flash Z.ai | 31,2B | 75 GB 1× · 5,1 GB libres | 41 GB 1× · 39 GB libres | 24 GB 1× · 56 GB libres |
Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle
GPU similaires
Voir d'autres GPU similaires dans
Vous en voulez plus sur cette page ?
Des données erronées ?










