Zurück zu allen Angeboten

NVIDIA A2

16 GB VRAM36 FP16 TFLOPS60 W TDP0 Anbieter0 Angebote0 Regionen

Die NVIDIA A2 ist eine Enterprise- GPU, basiert auf der Ampere-Architektur und verfügt über 16 GB Speicher mit 200 GB/s Speicherbandbreite und einer TDP von 60 W. Sie liefert 4,5 TFLOPS FP32-Rechenleistung und 36 TFLOPS FP16-Tensor-Leistung.

Günstigster
Keine aktuellen Angebote
Median
über 0 Angebote
Teuerster
90-Tage-Trend
Nicht genug Daten

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
36 TFLOPS
peak
TDP
60 W
Speicherbandbreite
200 GB/s
Architektur
Ampere
FP32-Leistung
4,5 TFLOPS
Marke
NVIDIA
Serie
A2
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 4 Stunden

1 Angebot von 0 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
AceCloud logoAceCloudGünstigsterSpot
Bis zu215 €Guthaben
×21664 GB
United States
Ab0,136 €
+39.5% 30T
Ab0,27 €
Starten

LLMs, die auf die NVIDIA A2 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 16 GB pro GPU.

ModellParameter16 Bit8 Bit4 Bit
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
Zu groß
32 GB
Zu groß
18 GB
Knapp auf 1× · 4 % übrig
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
Knapp auf 1× · 16 % übrig
Gemma 3 12B
Google
12,2 Mrd.
29 GB
Zu groß
16 GB
Knapp auf 1× · 19 % übrig
9,4 GB
1× · 6,6 GB frei
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
Zu groß
12 GB
1× · 4,4 GB frei
6,8 GB
1× · 9,2 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
Zu groß
11 GB
1× · 5,2 GB frei
6,3 GB
1× · 9,7 GB frei
Llama 3.1 8B Instruct
Meta
8 Mrd.
19 GB
Zu groß
11 GB
1× · 5,4 GB frei
6,2 GB
1× · 9,8 GB frei
Mistral 7B Instruct v0.3
Mistral AI
7,2 Mrd.
17 GB
Knapp auf 1× · 10 % übrig
9,6 GB
1× · 6,4 GB frei
5,6 GB
1× · 10 GB frei
Qwen3 4B
Alibaba
4 Mrd.
9,7 GB
1× · 6,3 GB frei
5,3 GB
1× · 11 GB frei
3,1 GB
1× · 13 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Welche Cloud-Anbieter bieten die A2 an?
1 Anbieter führen derzeit die A2: AceCloud. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die A2?
Die A2 verfügt über 16 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der A2 betreiben?
Mit 16 GB VRAM kann eine einzelne A2 Modelle wie Gemma 3 12B, Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.