Le GPU B300 SXM6 PC dispose de 269 GB de mémoire. Actuellement disponible chez 1 fournisseur à partir de 10,52 €/GPU/heure, avec une médiane du marché de 11,31 €/GPU/heure sur 3 configurations.
Caractéristiques matérielles
Identiques chez tous les fournisseurs
Prix médian sur l'ensemble des fournisseurs
1 offre chez 1 fournisseurs
Triées par prix croissant. Comparez les configurations côte à côte.
LLM qui tiennent sur le GPU B300 SXM6 PC
VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 269 GB par GPU. Affichage des 12 plus grands qui tiennent.
| Modèle | Paramètres | 16 bits | 8 bits | 4 bits |
|---|---|---|---|---|
| Kimi K3 Moonshot AI | 2,8T 104B actifs | — Non publié | — Non publié | 1 873 GB 8× · 279 GB libres |
| DeepSeek V4 Pro DeepSeek | 1,6T 49B actifs | — Non publié | — Non publié | 1 038 GB 8× · 1 114 GB libres |
| Kimi K2.5 Moonshot AI | 1T 32B actifs | — Non publié | — Non publié | 714 GB 8× · 1 438 GB libres |
| GLM-5.2 Z.ai | 753B | 1 808 GB 8× · 344 GB libres | 994 GB 8× · 1 158 GB libres | 579 GB 8× · 1 573 GB libres |
| DeepSeek R1 DeepSeek | 671B 37B actifs | — Non publié | 826 GB 8× · 1 326 GB libres | 481 GB 8× · 1 671 GB libres |
| DeepSeek V4 Flash DeepSeek | 284B | — Non publié | — Non publié | 192 GB 1× · 77 GB libres |
| Solar Open2 250B Upstage | 250B 15B actifs | 601 GB 8× · 1 551 GB libres | 330 GB 8× · 1 822 GB libres | 192 GB 1× · 77 GB libres |
| Qwen3 235B-A22B Alibaba | 235B 22B actifs | 564 GB 8× · 1 588 GB libres | 310 GB 8× · 1 842 GB libres ou 1× · 4 % de marge | 181 GB 1× · 88 GB libres |
| Laguna-S 2.1 Poolside | 118B 8B actifs | 282 GB 8× · 1 870 GB libres ou 1× · 14 % de marge | 155 GB 1× · 114 GB libres | 90 GB 1× · 179 GB libres |
| gpt-oss-120b OpenAI | 117B 5,1B actifs | — Non publié | — Non publié | 78 GB 1× · 191 GB libres |
| Qwen3.6 35B-A3B Alibaba | 35B 3B actifs | 86 GB 1× · 183 GB libres | 47 GB 1× · 222 GB libres | 28 GB 1× · 241 GB libres |
| Qwen3 32B Alibaba | 32,8B | 79 GB 1× · 190 GB libres | 43 GB 1× · 226 GB libres | 25 GB 1× · 244 GB libres |
Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle
Vous en voulez plus sur cette page ?
Des données erronées ?
