Zurück zu allen Angeboten

Intel Gaudi 2

96 GB VRAM432 FP16 TFLOPS600 W TDP4 Anbieter7 Angebote2 Regionen

Die Intel Gaudi 2 ist eine Enterprise- GPU, basiert auf der Gaudi 2-Architektur und verfügt über 96 GB Speicher mit 2.450 GB/s Speicherbandbreite und einer TDP von 600 W. Sie liefert 432 TFLOPS FP16-Tensor-Leistung. Derzeit bei 4 Anbieter verfügbar, ab 0,88 €/GPU/Stunde, mit einem Marktmedian von 0,91 €/GPU/Stunde über 7 Konfigurationen.

Günstigster
0,883 €/Std.
Cyfuture AI
Median
0,909 €/Std.
über 7 Angebote
Teuerster
1,039 €/Std.
Sesterce Cloud
90-Tage-Trend
+2.3%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
432 TFLOPS
peak
TDP
600 W
Speicherbandbreite
2.450 GB/s
Architektur
Gaudi 2
Marke
Intel
Serie
Gaudi
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 1 Stunde

4 Angebote von 4 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Cyfuture AI logoCyfuture AIGünstigster
Bis zu1 €Guthaben
×81522,25 TB
India
Ab0,883 €
+0.3% 30T
Ab7,06 €
Starten
×8152940 GB
United States
0,992 €
0.0% 30T
7,93 €
Starten
×81.2167,34 TB
United States
1,039 €
0.0% 30T
8,31 €
Starten
Sesterce Cloud logoSesterce CloudEmpfehlungslink
×8152940 GB
United States
1,039 €
0.0% 30T
8,31 €
Starten

LLMs, die auf die Intel Gaudi 2 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 96 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Kimi K2.5
Moonshot AI
1 Bio.
32 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
714 GB
8× · 54 GB frei
GLM-5.2
Z.ai
753 Mrd.
1.808 GB
Zu groß
994 GB
Zu groß
579 GB
8× · 189 GB frei
DeepSeek R1
DeepSeek
671 Mrd.
37 Mrd. aktiv
Nicht veröffentlicht
826 GB
Knapp auf 8× · 11 % übrig
481 GB
8× · 287 GB frei
DeepSeek V4 Flash
DeepSeek
284 Mrd.
Nicht veröffentlicht
Nicht veröffentlicht
192 GB
Passt knapp auf 2×
Solar Open2 250B
Upstage
250 Mrd.
15 Mrd. aktiv
601 GB
8× · 167 GB frei
330 GB
4× · 54 GB frei
192 GB
4× · 192 GB frei
oder 2× · 19 % übrig
Qwen3 235B-A22B
Alibaba
235 Mrd.
22 Mrd. aktiv
564 GB
8× · 204 GB frei
310 GB
4× · 74 GB frei
181 GB
2× · 11 GB frei
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
4× · 102 GB frei
155 GB
2× · 37 GB frei
90 GB
1× · 5,7 GB frei
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
1× · 18 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
1× · 9,7 GB frei
47 GB
1× · 49 GB frei
28 GB
1× · 68 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
1× · 17 GB frei
43 GB
1× · 53 GB frei
25 GB
1× · 71 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
1× · 21 GB frei
41 GB
1× · 55 GB frei
24 GB
1× · 72 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
1× · 21 GB frei
41 GB
1× · 55 GB frei
24 GB
1× · 72 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die Intel Gaudi 2 pro Stunde?
Die Intel Gaudi 2 beginnt bei 0,88 € pro GPU-Stunde, mit einem Median von 0,91 € über 7 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die Intel Gaudi 2 an?
4 Anbieter führen derzeit die Intel Gaudi 2: Sesterce Cloud, Runcrate, Cyfuture AI, Omega Gradient. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die Intel Gaudi 2?
Die Intel Gaudi 2 verfügt über 96 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der Intel Gaudi 2 betreiben?
Mit 96 GB VRAM kann eine einzelne Intel Gaudi 2 Modelle wie Laguna-S 2.1, gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren Intel Gaudi 2 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere Intel Gaudi 2 passen, sind Kimi K2.5 auf 8 GPUs mit 4 Bit, GLM-5.2 auf 8 GPUs mit 4 Bit, DeepSeek R1 auf 8 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die Intel Gaudi 2 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die Intel Gaudi 2 erfassen, liegt bei 0,88 € pro GPU-Stunde bei Cyfuture AI. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.