Zurück zu allen Angeboten

NVIDIA H100

80 GB VRAM989 FP16 TFLOPS700 W TDP15 Anbieter65 Angebote13 Regionen

Die NVIDIA H100 ist eine Enterprise- GPU, basiert auf der Hopper-Architektur und verfügt über 80 GB Speicher mit 3.350 GB/s Speicherbandbreite und einer TDP von 700 W. Sie liefert 67 TFLOPS FP32-Rechenleistung und 989 TFLOPS FP16-Tensor-Leistung. Derzeit bei 15 Anbieter verfügbar, ab 0,99 €/GPU/Stunde, mit einem Marktmedian von 2,75 €/GPU/Stunde über 65 Konfigurationen.

Günstigster
0,988 €/Std.
Lium
Median
2,748 €/Std.
über 65 Angebote
Teuerster
5,659 €/Std.
Sesterce Cloud
90-Tage-Trend
+0.7%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

Speicher
80 GB
HBM3
Welche LLMs passen? ↓
FP16-Leistung
989 TFLOPS
peak
TDP
700 W
Speicherbandbreite
3.350 GB/s
Architektur
Hopper
FP32-Leistung
67 TFLOPS
Marke
NVIDIA
Serie
H100
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 3 Stunden

16 Angebote von 15 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Runpod logoRunpodBeworben
Bis zu429 €GuthabenAffiliate-Werbung — wir erhalten möglicherweise eine Provision.
×116188 GB
JapanNetherlandsIceland+3
2,826 €2,83 €Starten
Lium logoLiumEmpfehlungslinkGünstigster
Bis zu4 €Guthaben
×248472 GB
FrancePolandRussia+1
Ab0,988 €
Ab1,98 €
Starten
Vast.ai logoVast.aiEmpfehlungslinkIm Trend
×218414 GB
MexicoUnited StatesAustralia+3
Ab1,142 €
+3.1% 30T
Ab2,28 €
Starten
×116192 GB
United StatesCanada
Ab1,795 €
-0.1% 30T
Ab1,80 €
Starten
×11080 GB--
1,967 €
Ab1,97 €
Starten
×128180 GB
CanadaUnited States
Ab2,147 €
-21.9% 30T
Ab2,15 €
Starten
×128180 GB
CanadaUnited StatesPoland+1
2,362 €
-8.3% 30T
Ab2,36 €
Starten
×120128 GB--
Ab2,577 €
Ab2,58 €
Thunder Compute logoThunder ComputeEmpfehlungslink
Bis zu17 €Studierenden-Guthaben
×11890 GB--
2,748 €
+0.3% 30T
Ab2,75 €
Starten
×130120 GB--
2,791 €
Ab2,79 €
Starten
×126200 GB
United States
Ab2,826 €
-12.1% 30T
Ab2,83 €
Starten
Runpod logoRunpodEmpfehlungslinkIm Trend
Bis zu429 €Guthaben
×116188 GB
JapanNetherlandsIceland+3
Ab2,826 €
-6.1% 30T
Ab2,83 €
Starten
×124240 GB
FrancePoland
Ab2,867 €
+1.4% 30T
Ab2,87 €
Starten
Bis zu1 €Guthaben
×81281,5 TB
India
Ab2,871 €
0.0% 30T
Ab22,97 €
Starten
Novita AI logoNovita AIEmpfehlungslink
×116128 GB
IcelandUnited States
2,912 €
0.0% 30T
2,91 €
Starten
Oblivus logoOblivusEmpfehlungslink
×128180 GB
United States
Ab3,006 €
-18.8% 30T
Ab3,01 €
Starten
Sesterce Cloud logoSesterce CloudEmpfehlungslink
×248480 GB
FranceUnited States
Ab3,118 €
-4.8% 30T
Ab6,24 €
Starten

LLMs, die auf die NVIDIA H100 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 80 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Kimi K2.5
Moonshot AI
1 Bio.
32 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
714 GB
Knapp auf 8× · 7 % übrig
GLM-5.2
Z.ai
753 Mrd.
Nicht veröffentlicht
994 GB
Zu groß
579 GB
8× · 61 GB frei
DeepSeek R1
DeepSeek
671 Mrd.
37 Mrd. aktiv
Nicht veröffentlicht
826 GB
Zu groß
481 GB
8× · 159 GB frei
DeepSeek V4 Flash
DeepSeek
284 Mrd.
Nicht veröffentlicht
Nicht veröffentlicht
192 GB
3× · 48 GB frei
oder 2× · 0 % übrig
Solar Open2 250B
Upstage
250 Mrd.
15 Mrd. aktiv
601 GB
8× · 39 GB frei
330 GB
8× · 310 GB frei
oder 4× · 16 % übrig
192 GB
3× · 48 GB frei
Qwen3 235B-A22B
Alibaba
235 Mrd.
22 Mrd. aktiv
564 GB
8× · 76 GB frei
310 GB
4× · 9,7 GB frei
181 GB
3× · 59 GB frei
oder 2× · 6 % übrig
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
4× · 38 GB frei
oder 3× · 2 % übrig
155 GB
2× · 4,8 GB frei
90 GB
2× · 70 GB frei
oder 1× · 6 % übrig
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
1× · 1,7 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
2× · 74 GB frei
oder 1× · 11 % übrig
47 GB
1× · 33 GB frei
28 GB
1× · 52 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
1× · 1,4 GB frei
43 GB
1× · 37 GB frei
25 GB
1× · 55 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
1× · 4,9 GB frei
41 GB
1× · 39 GB frei
24 GB
1× · 56 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
1× · 5,1 GB frei
41 GB
1× · 39 GB frei
24 GB
1× · 56 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die H100 pro Stunde?
Die H100 beginnt bei 0,99 € pro GPU-Stunde, mit einem Median von 2,75 € über 65 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die H100 an?
17 Anbieter führen derzeit die H100: AceCloud, Runpod, Sesterce Cloud, Vast.ai, Oblivus, Runcrate und 11 weitere. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die H100?
Die H100 verfügt über 80 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der H100 betreiben?
Mit 80 GB VRAM kann eine einzelne H100 Modelle wie gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren H100 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere H100 passen, sind GLM-5.2 auf 8 GPUs mit 4 Bit, DeepSeek R1 auf 8 GPUs mit 4 Bit, DeepSeek V4 Flash auf 3 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die H100 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die H100 erfassen, liegt bei 0,99 € pro GPU-Stunde bei Lium. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.