NVIDIA A100X
Carte de classe entreprise, le GPU NVIDIA A100X repose sur l'architecture Ampere et dispose de 80 GB de mémoire, avec une bande passante mémoire de 1 935 GB/s et un TDP de 300 W. Il offre 19,5 TFLOPS de performances FP32 et 312 TFLOPS de performances tensorielles FP16.
Caractéristiques matérielles
Identiques chez tous les fournisseurs
Aucun historique des prix disponible
Les données de suivi des prix apparaîtront ici dès qu'elles seront disponibles
0 offres chez 0 fournisseurs
Triées par prix croissant. Comparez les configurations côte à côte.
| Fournisseur | Nombre | vCPU | RAM | Région | Par heure de GPU | Total/h | Action |
|---|---|---|---|---|---|---|---|
| Essayez d'élargir vos filtres ou effacez-les tous pour recommencer. | |||||||
LLM qui tiennent sur le GPU NVIDIA A100X
VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 80 GB par GPU. Affichage des 12 plus grands qui tiennent.
| Modèle | Paramètres | 16 bits | 8 bits | 4 bits |
|---|---|---|---|---|
| Laguna-S 2.1 Poolside | 118B 8B actifs | 282 GB Trop grand | 155 GB Trop grand | 90 GB Juste sur 1× · 6 % de marge |
| gpt-oss-120b OpenAI | 117B 5,1B actifs | — Non publié | — Non publié | 78 GB 1× · 1,7 GB libres |
| Qwen3.6 35B-A3B Alibaba | 35B 3B actifs | 86 GB Juste sur 1× · 11 % de marge | 47 GB 1× · 33 GB libres | 28 GB 1× · 52 GB libres |
| Qwen3 32B Alibaba | 32,8B | 79 GB 1× · 1,4 GB libres | 43 GB 1× · 37 GB libres | 25 GB 1× · 55 GB libres |
| Gemma 4 31B Google | 31,3B | 75 GB 1× · 4,9 GB libres | 41 GB 1× · 39 GB libres | 24 GB 1× · 56 GB libres |
| GLM-4.7 Flash Z.ai | 31,2B | 75 GB 1× · 5,1 GB libres | 41 GB 1× · 39 GB libres | 24 GB 1× · 56 GB libres |
| Qwen3.6 27B Alibaba | 27,8B | 67 GB 1× · 13 GB libres | 37 GB 1× · 43 GB libres | 21 GB 1× · 59 GB libres |
| Mistral Small 3.2 24B Mistral AI | 24B | 58 GB 1× · 22 GB libres | 32 GB 1× · 48 GB libres | 18 GB 1× · 62 GB libres |
| gpt-oss-20b OpenAI | 21B 3,6B actifs | — Non publié | — Non publié | 17 GB 1× · 63 GB libres |
| Gemma 3 12B Google | 12,2B | 29 GB 1× · 51 GB libres | 16 GB 1× · 64 GB libres | 9,4 GB 1× · 71 GB libres |
| Granite 4.1 8B IBM | 8,8B | 21 GB 1× · 59 GB libres | 12 GB 1× · 68 GB libres | 6,8 GB 1× · 73 GB libres |
| Qwen3 8B Alibaba | 8,2B | 20 GB 1× · 60 GB libres | 11 GB 1× · 69 GB libres | 6,3 GB 1× · 74 GB libres |
Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle
Vous en voulez plus sur cette page ?
Des données erronées ?