Zurück zu allen Angeboten

NVIDIA RTX 3080

10 GB VRAM320 W TDP3 Anbieter14 Angebote4 Regionen

Die NVIDIA RTX 3080 ist eine Consumer- GPU, basiert auf der Ampere-Architektur und verfügt über 10 GB Speicher mit 760 GB/s Speicherbandbreite und einer TDP von 320 W. Sie liefert 29,8 TFLOPS FP32-Rechenleistung. Derzeit bei 3 Anbieter verfügbar, ab 0,03 €/GPU/Stunde, mit einem Marktmedian von 0,11 €/GPU/Stunde über 14 Konfigurationen.

Günstigster
0,026 €/Std.
Vast.ai
Median
0,112 €/Std.
über 14 Angebote
Teuerster
0,180 €/Std.
Theta EdgeCloud
90-Tage-Trend
-42.2%
Medianpreis

Hardware-Spezifikationen

Gleich bei allen Anbietern

Speicher
10 GB
GDDR6X
Welche LLMs passen? ↓
TDP
320 W
Speicherbandbreite
760 GB/s
Architektur
Ampere
FP32-Leistung
29,8 TFLOPS
Marke
NVIDIA
Serie
GeForce RTX
Marktpreis-Verlauf

Medianpreis über alle Anbieter

Preise aktualisiert vor 3 Stunden

3 Angebote von 3 Anbietern

Sortiert nach aufsteigendem Preis. Konfigurationen direkt vergleichen.

AnbieterAnzahlvCPURAMRegionPro GPU/Std.Gesamt/Std.Aktion
Vast.ai logoVast.aiEmpfehlungslinkIm TrendGünstigster
×11663 GB
ChinaUnited StatesCanada+1
Ab0,026 €
+4.3% 30T
Ab0,03 €
Starten
×1815 GB--
Ab0,069 €
+50.0% 30T
Ab0,07 €
Starten
×140110 GB
Ukraine
Ab0,172 €
0.0% 30T
Ab0,17 €
Starten

LLMs, die auf die NVIDIA RTX 3080 passen

Geschätzter VRAM-Bedarf beliebter Open-Weight-LLMs bei 16 Bit (FP16/BF16), 8 Bit (FP8/INT8) und 4 Bit (INT4/MXFP4), bei 10 GB pro GPU. Gezeigt werden die 12 größten passenden Modelle.

ModellParameter16 Bit8 Bit4 Bit
Laguna-S 2.1
Poolside
118 Mrd.
8 Mrd. aktiv
Nicht veröffentlicht
155 GB
Zu groß
90 GB
Knapp auf 8× · 6 % übrig
gpt-oss-120b
OpenAI
117 Mrd.
5,1 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
78 GB
8× · 1,7 GB frei
Qwen3.6 35B-A3B
Alibaba
35 Mrd.
3 Mrd. aktiv
86 GB
Knapp auf 8× · 11 % übrig
47 GB
8× · 33 GB frei
oder 4× · 1 % übrig
28 GB
4× · 12 GB frei
Qwen3 32B
Alibaba
32,8 Mrd.
79 GB
8× · 1,4 GB frei
43 GB
8× · 37 GB frei
oder 4× · 10 % übrig
25 GB
4× · 15 GB frei
Gemma 4 31B
Google
31,3 Mrd.
75 GB
8× · 4,9 GB frei
41 GB
8× · 39 GB frei
oder 4× · 16 % übrig
24 GB
4× · 16 GB frei
GLM-4.7 Flash
Z.ai
31,2 Mrd.
75 GB
8× · 5,1 GB frei
41 GB
8× · 39 GB frei
oder 4× · 16 % übrig
24 GB
4× · 16 GB frei
oder 2× · 0 % übrig
Qwen3.6 27B
Alibaba
27,8 Mrd.
67 GB
8× · 13 GB frei
37 GB
4× · 3,3 GB frei
21 GB
4× · 19 GB frei
oder 2× · 12 % übrig
Mistral Small 3.2 24B
Mistral AI
24 Mrd.
58 GB
8× · 22 GB frei
32 GB
4× · 8,3 GB frei
18 GB
2× · 1,6 GB frei
gpt-oss-20b
OpenAI
21 Mrd.
3,6 Mrd. aktiv
Nicht veröffentlicht
Nicht veröffentlicht
17 GB
2× · 3,5 GB frei
Gemma 3 12B
Google
12,2 Mrd.
29 GB
4× · 11 GB frei
16 GB
2× · 3,9 GB frei
9,4 GB
Passt knapp auf 1×
Granite 4.1 8B
IBM
8,8 Mrd.
21 GB
4× · 19 GB frei
oder 2× · 13 % übrig
12 GB
2× · 8,4 GB frei
oder 1× · 3 % übrig
6,8 GB
1× · 3,2 GB frei
Qwen3 8B
Alibaba
8,2 Mrd.
20 GB
Passt knapp auf 2×
11 GB
2× · 9,2 GB frei
oder 1× · 10 % übrig
6,3 GB
1× · 3,7 GB frei

Schätzungen: Modellgewichte plus 20 % für KV-Cache und Laufzeit-Overhead, bei kurzen Kontextlängen. Lange Kontexte und große Batches benötigen mehr. Als „knapp“ markierte Zeilen fassen die Gewichte, aber nicht diesen vollen Puffer. Ein ×N-Wert ist der gesamte VRAM über N dieser GPUs und sagt nichts über den Durchsatz der Verbindung aus. Wie wir das schätzen · Stattdessen vom Modell aus starten

Mehr von dieser Seite?

Falsche Daten?

Häufig gestellte Fragen

Wie viel kostet die RTX 3080 pro Stunde?
Die RTX 3080 beginnt bei 0,03 € pro GPU-Stunde, mit einem Median von 0,11 € über 14 verfügbare Konfigurationen. Der tatsächliche Preis hängt von Anbieter, Region und Mietart (On-Demand, Spot oder Reserved) ab.
Welche Cloud-Anbieter bieten die RTX 3080 an?
3 Anbieter führen derzeit die RTX 3080: Omega Gradient, Vast.ai, Theta EdgeCloud. Vergleichen Sie Stundenpreise, Regionen und Spezifikationen in der Tabelle oben.
Wie viel VRAM hat die RTX 3080?
Die RTX 3080 verfügt über 10 GB VRAM, was bestimmt, welche Modelle und Batch-Größen sie für Training und Inferenz im Speicher halten kann.
Welche LLMs kann ich auf der RTX 3080 betreiben?
Mit 10 GB VRAM kann eine einzelne RTX 3080 Modelle wie Gemma 3 12B, Granite 4.1 8B, Qwen3 8B bereitstellen. Die Tabelle oben zeigt den geschätzten VRAM-Bedarf jedes Modells bei 16 Bit, 8 Bit und 4 Bit — inklusive der Multi-GPU-Konfigurationen, die größere Modelle benötigen.
Welches ist das größte LLM, das ich auf mehreren RTX 3080 betreiben kann?
Die größten von uns erfassten Modelle, die auf mehrere RTX 3080 passen, sind gpt-oss-120b auf 8 GPUs mit 4 Bit, Qwen3.6 35B-A3B auf 4 GPUs mit 4 Bit, Qwen3 32B auf 4 GPUs mit 4 Bit. Bei einer Multi-GPU-Konfiguration mieten und bezahlen Sie jede Karte für die gesamte Laufzeit, und die Aufteilung eines Modells über mehrere Karten kostet zusätzlich Durchsatz: Die GPUs tauschen bei jedem Token Aktivierungen aus, die Leistung hängt also davon ab, wie schnell sie miteinander verbunden sind. Wir erfassen den Interconnect nicht — prüfen Sie die Knoten-Spezifikation des Anbieters. Die Tabelle oben nennt die kleinste Konfiguration jedes Modells bei 16 Bit, 8 Bit und 4 Bit.
Wo ist die RTX 3080 am günstigsten?
Der niedrigste On-Demand-Preis, den wir derzeit für die RTX 3080 erfassen, liegt bei 0,03 € pro GPU-Stunde bei Vast.ai. Da Anbieter Preise und Verfügbarkeit häufig ändern, prüfen Sie die Live-Tabelle oben vor dem Start.