Zurück zu allen Angeboten

NVIDIA A40

48 GB VRAM150 FP16 TFLOPS300 W TDP2 Anbieter7 Angebote3 Regionen

Die NVIDIA A40 ist eine Enterprise- GPU, basiert auf der Ampere-Architektur und verfügt über 48 GB Speicher mit 696 GB/s Speicherbandbreite und einer TDP von 300 W. Sie liefert 37,4 TFLOPS FP32-Rechenleistung und 150 TFLOPS FP16-Tensor-Leistung. Derzeit bei 2 Anbieter verfügbar, ab 0,38 €/GPU/Stunde, mit einem Marktmedian von 1,50 €/GPU/Stunde über 7 Konfigurationen.

Günstigster
0,378 €/Std.
Runpod
Median
1,503 €/Std.
über 7 Angebote
Teuerster
2,004 €/Std.
Vultr
90-Tage-Trend
+36.0%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
150 TFLOPS
peak
TDP
300 W
Speicherbandbreite
696 GB/s
Architektur
Ampere
FP32-Leistung
37,4 TFLOPS
Marke
NVIDIA
Serie
A40
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 7 Stunden

3 Angebote von 2 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Runpod logoRunpodEmpfehlungslinkIm TrendGünstigster
Bis zu429 €Guthaben
×1950 GB
CanadaSweden
0,378 €
0,38 €
Starten
Sesterce Cloud logoSesterce CloudEmpfehlungslink
×212120 GB--
Ab1,039 €
0.0% 30T
Ab2,08 €
×1/2015 GB
United States
Ab1,312 €
Ab0,07 €
Starten

LLMs, die auf die NVIDIA A40 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 48 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
Zu groß
47 GB
Passt knapp auf 1×
28 GB
1× · 20 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
Zu groß
43 GB
1× · 4,8 GB frei
25 GB
1× · 23 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
Zu groß
41 GB
1× · 6,7 GB frei
24 GB
1× · 24 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
Zu groß
41 GB
1× · 6,8 GB frei
24 GB
1× · 24 GB frei
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
Zu groß
37 GB
1× · 11 GB frei
21 GB
1× · 27 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
Zu groß
32 GB
1× · 16 GB frei
18 GB
1× · 30 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
1× · 31 GB frei
Gemma 3 12B
Google
12,2 Mrd.
29 GB
1× · 19 GB frei
16 GB
1× · 32 GB frei
9,4 GB
1× · 39 GB frei
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
1× · 27 GB frei
12 GB
1× · 36 GB frei
6,8 GB
1× · 41 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
1× · 28 GB frei
11 GB
1× · 37 GB frei
6,3 GB
1× · 42 GB frei
Llama 3.1 8B Instruct
Meta
8 Mrd.
19 GB
1× · 29 GB frei
11 GB
1× · 37 GB frei
6,2 GB
1× · 42 GB frei
Mistral 7B Instruct v0.3
Mistral AI
7,2 Mrd.
17 GB
1× · 31 GB frei
9,6 GB
1× · 38 GB frei
5,6 GB
1× · 42 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die A40 pro Stunde?
Die A40 beginnt bei 0,38 € pro GPU-Stunde, mit einem Median von 1,50 € über 7 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die A40 an?
3 Anbieter führen derzeit die A40: Vultr, Runpod, Sesterce Cloud. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die A40?
Die A40 verfügt über 48 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der A40 betreiben?
Mit 48 GB VRAM kann eine einzelne A40 Modelle wie Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Wo ist die A40 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die A40 erfassen, liegt bei 0,38 € pro GPU-Stunde bei Runpod. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.