Retour à toutes les offres

NVIDIA A2

16 GB VRAM36 FP16 TFLOPS60 W TDP0 fournisseurs0 offres0 régions

Carte de classe entreprise, le GPU NVIDIA A2 repose sur l'architecture Ampere et dispose de 16 GB de mémoire, avec une bande passante mémoire de 200 GB/s et un TDP de 60 W. Il offre 4,5 TFLOPS de performances FP32 et 36 TFLOPS de performances tensorielles FP16.

Le moins cher
—
Aucune offre actuellement
Médiane
—
sur 0 offres
Le plus cher
—
Tendance sur 90 jours
—
Données insuffisantes

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Performances FP16
36 TFLOPS
crête
TDP
60 W
Bande passante mémoire
200 GB/s
Architecture
Ampere
Performances FP32
4,5 TFLOPS
Marque
NVIDIA
Série
A2
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

1 offre chez 0 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
AceCloudLe moins cherSpot
Jusqu'à219 €de crédit
×21664 GB
États-Unis
À partir de0,138 €
+1,5 % 30 j
À partir de0,28 €
Lancer

LLM qui tiennent sur le GPU NVIDIA A2

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 16 GB par GPU.

ModèleParamètres16 bits8 bits4 bits
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
Trop grand
32 GB
Trop grand
18 GB
Juste sur 1× · 4 % de marge
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
Juste sur 1× · 16 % de marge
Gemma 3 12B
Google
12,2B
29 GB
Trop grand
16 GB
Juste sur 1× · 19 % de marge
9,4 GB
1× · 6,6 GB libres
Granite 4.1 8B
IBM
8,8B
21 GB
Trop grand
12 GB
1× · 4,4 GB libres
6,8 GB
1× · 9,2 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
Trop grand
11 GB
1× · 5,2 GB libres
6,3 GB
1× · 9,7 GB libres
Llama 3.1 8B Instruct
Meta
8B
19 GB
Trop grand
11 GB
1× · 5,4 GB libres
6,2 GB
1× · 9,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2B
17 GB
Juste sur 1× · 10 % de marge
9,6 GB
1× · 6,4 GB libres
5,6 GB
1× · 10 GB libres
Qwen3 4B
Alibaba
4B
9,7 GB
1× · 6,3 GB libres
5,3 GB
1× · 11 GB libres
3,1 GB
1× · 13 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Quels fournisseurs cloud proposent le GPU A2 ?
1 fournisseurs proposent actuellement le GPU A2 : AceCloud. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU A2 ?
Le GPU A2 dispose de 16 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU A2 ?
Avec 16 GB de VRAM, un seul GPU A2 peut servir des modèles comme Gemma 3 12B, Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.