Zurück zu allen Angeboten

NVIDIA A100 40GB

40 GB VRAM312 FP16 TFLOPS250 W TDP3 Anbieter8 Angebote2 Regionen

Die NVIDIA A100 40GB ist eine Enterprise- GPU, basiert auf der Ampere-Architektur und verfügt über 40 GB Speicher mit 1.555 GB/s Speicherbandbreite und einer TDP von 250 W. Sie liefert 19,5 TFLOPS FP32-Rechenleistung und 312 TFLOPS FP16-Tensor-Leistung. Derzeit bei 3 Anbieter verfügbar, ab 1,11 €/GPU/Stunde, mit einem Marktmedian von 1,53 €/GPU/Stunde über 8 Konfigurationen.

Günstigster
1,108 €/Std.
Verda
Median
1,529 €/Std.
über 8 Angebote
Teuerster
1,881 €/Std.
Runcrate
90-Tage-Trend
+25.8%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

Speicher
40 GB
HBM2e
Welche LLMs passen? ↓
FP16-Leistung
312 TFLOPS
peak
TDP
250 W
Speicherbandbreite
1.555 GB/s
Architektur
Ampere
FP32-Leistung
19,5 TFLOPS
Marke
NVIDIA
Serie
A100
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 3 Stunden

3 Angebote von 3 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Verda logoVerdaGünstigster
×122120 GB--
1,108 €
Ab1,11 €
Starten
×114117 GB
United StatesIndia
Ab1,262 €
0.0% 30T
Ab1,26 €
Starten
×130200 GB
IndiaUnited States
1,881 €
+46.0% 30T
1,88 €
Starten

LLMs, die auf die NVIDIA A100 40GB passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 40 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
DeepSeek V4 Flash
DeepSeek
284 Mrd.
Nicht veröffentlicht
Nicht veröffentlicht
192 GB
8× · 128 GB frei
Solar Open2 250B
Upstage
250 Mrd.
15 Mrd. aktiv
601 GB
Zu groß
330 GB
Knapp auf 8× · 16 % übrig
192 GB
8× · 128 GB frei
Qwen3 235B-A22B
Alibaba
235 Mrd.
22 Mrd. aktiv
564 GB
Zu groß
310 GB
8× · 9,7 GB frei
181 GB
8× · 139 GB frei
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
8× · 38 GB frei
155 GB
8× · 165 GB frei
90 GB
8× · 230 GB frei
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
8× · 242 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
8× · 234 GB frei
47 GB
8× · 273 GB frei
oder 1× · 1 % übrig
28 GB
1× · 12 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
8× · 241 GB frei
43 GB
8× · 277 GB frei
oder 1× · 10 % übrig
25 GB
1× · 15 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
8× · 245 GB frei
41 GB
8× · 279 GB frei
oder 1× · 16 % übrig
24 GB
1× · 16 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
8× · 245 GB frei
41 GB
8× · 279 GB frei
oder 1× · 16 % übrig
24 GB
1× · 16 GB frei
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
8× · 253 GB frei
37 GB
1× · 3,3 GB frei
21 GB
1× · 19 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
8× · 262 GB frei
32 GB
1× · 8,3 GB frei
18 GB
1× · 22 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
1× · 23 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die A100 40GB pro Stunde?
Die A100 40GB beginnt bei 1,11 € pro GPU-Stunde, mit einem Median von 1,53 € über 8 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die A100 40GB an?
3 Anbieter führen derzeit die A100 40GB: Omega Gradient, Runcrate, Verda. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die A100 40GB?
Die A100 40GB verfügt über 40 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der A100 40GB betreiben?
Mit 40 GB VRAM kann eine einzelne A100 40GB Modelle wie Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren A100 40GB betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere A100 40GB passen, sind DeepSeek V4 Flash auf 8 GPUs mit 4 Bit, Solar Open2 250B auf 8 GPUs mit 4 Bit, Qwen3 235B-A22B auf 8 GPUs mit 8 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die A100 40GB am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die A100 40GB erfassen, liegt bei 1,11 € pro GPU-Stunde bei Verda. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.