Zurück zu allen Angeboten

AMD Instinct MI350X

288 GB VRAM2.300 FP16 TFLOPS1.000 W TDP0 Anbieter0 Angebote0 Regionen

Die AMD Instinct MI350X ist eine Enterprise- GPU, basiert auf der CDNA 4-Architektur und verfügt über 288 GB Speicher mit 8.000 GB/s Speicherbandbreite und einer TDP von 1.000 W. Sie liefert 144,2 TFLOPS FP32-Rechenleistung und 2.300 TFLOPS FP16-Tensor-Leistung.

Günstigster
—
Keine aktuellen Angebote
Median
—
über 0 Angebote
Teuerster
—
90-Tage-Trend
-42.9%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

FP16-Leistung
2.300 TFLOPS
peak
TDP
1000 W
Speicherbandbreite
8.000 GB/s
Architektur
CDNA 4
FP32-Leistung
144,2 TFLOPS
Marke
AMD
Serie
Instinct MI
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 5 Stunden

0 Angebote von 0 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Erweitern Sie Ihre Filter oder setzen Sie alle Filter zurück.

LLMs, die auf die AMD Instinct MI350X passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 288 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
DeepSeek V4 Flash
DeepSeek
284 Mrd.
—
Nicht veröffentlicht
—
Nicht veröffentlicht
192 GB
1× · 96 GB frei
Solar Open2 250B
Upstage
250 Mrd.
15 Mrd. aktiv
601 GB
Zu groß
330 GB
Knapp auf 1× · 4 % übrig
192 GB
1× · 96 GB frei
Qwen3 235B-A22B
Alibaba
235 Mrd.
22 Mrd. aktiv
564 GB
Zu groß
310 GB
Knapp auf 1× · 11 % übrig
181 GB
1× · 107 GB frei
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
282 GB
1× · 5,8 GB frei
155 GB
1× · 133 GB frei
90 GB
1× · 198 GB frei
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
—
Nicht veröffentlicht
—
Nicht veröffentlicht
78 GB
1× · 210 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
1× · 202 GB frei
47 GB
1× · 241 GB frei
28 GB
1× · 260 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
1× · 209 GB frei
43 GB
1× · 245 GB frei
25 GB
1× · 263 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
1× · 213 GB frei
41 GB
1× · 247 GB frei
24 GB
1× · 264 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
1× · 213 GB frei
41 GB
1× · 247 GB frei
24 GB
1× · 264 GB frei
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
1× · 221 GB frei
37 GB
1× · 251 GB frei
21 GB
1× · 267 GB frei
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
1× · 230 GB frei
32 GB
1× · 256 GB frei
18 GB
1× · 270 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
—
Nicht veröffentlicht
—
Nicht veröffentlicht
17 GB
1× · 271 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel VRAM hat die Instinct MI350X?
Die Instinct MI350X verfügt über 288 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der Instinct MI350X betreiben?
Mit 288 GB VRAM kann eine einzelne Instinct MI350X Modelle wie DeepSeek V4 Flash, Solar Open2 250B, Qwen3 235B-A22B, Laguna-S 2.1 bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.