Zurück zu allen Angeboten

NVIDIA Quadro P4000

8 GB VRAM105 W TDP1 Anbieter2 Angebote1 Regionen

Die NVIDIA Quadro P4000 ist eine Enterprise- GPU, basiert auf der Pascal-Architektur und verfügt über 8 GB Speicher mit 243 GB/s Speicherbandbreite und einer TDP von 105 W. Sie liefert 5,3 TFLOPS FP32-Rechenleistung. Derzeit bei 1 Anbieter verfügbar, ab 0,03 €/GPU/Stunde, mit einem Marktmedian von 0,03 €/GPU/Stunde über 2 Konfigurationen.

Günstigster
0,035 €/Std.
Vast.ai
Median
0,035 €/Std.
über 2 Angebote
Teuerster
0,035 €/Std.
Vast.ai
90-Tage-Trend
-20.0%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

TDP
105 W
Speicherbandbreite
243 GB/s
Architektur
Pascal
FP32-Leistung
5,3 TFLOPS
Marke
NVIDIA
Serie
Quadro
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 17 Minuten

1 Angebot von 1 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Vast.ai logoVast.aiEmpfehlungslinkIm TrendGünstigster
×1616 GB
United States
0,035 €
-16.7% 30T
Ab0,03 €
Starten

LLMs, die auf die NVIDIA Quadro P4000 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 8 GB pro GPU.

ModellParameter16 Bit8 Bit4 Bit
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
Zu groß
32 GB
Zu groß
18 GB
Knapp auf 2× · 4 % übrig
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
Knapp auf 2× · 16 % übrig
Gemma 3 12B
Google
12,2 Mrd.
29 GB
Zu groß
16 GB
Knapp auf 2× · 19 % übrig
9,4 GB
2× · 6,6 GB frei
oder 1× · 2 % übrig
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
Zu groß
12 GB
2× · 4,4 GB frei
6,8 GB
1× · 1,2 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
Zu groß
11 GB
2× · 5,2 GB frei
6,3 GB
1× · 1,7 GB frei
Llama 3.1 8B Instruct
Meta
8 Mrd.
19 GB
Zu groß
11 GB
2× · 5,4 GB frei
6,2 GB
1× · 1,8 GB frei
Mistral 7B Instruct v0.3
Mistral AI
7,2 Mrd.
17 GB
Knapp auf 2× · 10 % übrig
9,6 GB
2× · 6,4 GB frei
oder 1× · 0 % übrig
5,6 GB
1× · 2,4 GB frei
Qwen3 4B
Alibaba
4 Mrd.
9,7 GB
2× · 6,3 GB frei
5,3 GB
1× · 2,7 GB frei
3,1 GB
1× · 4,9 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die Quadro P4000 pro Stunde?
Die Quadro P4000 beginnt bei 0,03 € pro GPU-Stunde, mit einem Median von 0,03 € über 2 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die Quadro P4000 an?
1 Anbieter führen derzeit die Quadro P4000: Vast.ai. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die Quadro P4000?
Die Quadro P4000 verfügt über 8 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der Quadro P4000 betreiben?
Mit 8 GB VRAM kann eine einzelne Quadro P4000 Modelle wie Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct, Mistral 7B Instruct v0.3 bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren Quadro P4000 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere Quadro P4000 passen, sind Gemma 3 12B auf 2 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die Quadro P4000 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die Quadro P4000 erfassen, liegt bei 0,03 € pro GPU-Stunde bei Vast.ai. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.