Retour à toutes les offres

NVIDIA RTX 3080

10 GB VRAM320 W TDP1 fournisseurs6 offres5 régions

Carte grand public, le GPU NVIDIA RTX 3080 repose sur l'architecture Ampere et dispose de 10 GB de mémoire, avec une bande passante mémoire de 760 GB/s et un TDP de 320 W. Il offre 29,8 TFLOPS de performances FP32. Actuellement disponible chez 1 fournisseur à partir de 0,07 €/GPU/heure, avec une médiane du marché de 0,18 €/GPU/heure sur 6 configurations.

Le moins cher
0,070 €/h
Vast.ai
Médiane
0,175 €/h
sur 6 offres
Le plus cher
1,158 €/h
Vast.ai
Tendance sur 90 jours
+33,3 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
10 GB
GDDR6X
Quels LLM tiennent ? ↓
TDP
320 W
Bande passante mémoire
760 GB/s
Architecture
Ampere
Performances FP32
29,8 TFLOPS
Marque
NVIDIA
Série
GeForce RTX
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

1 offre chez 1 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
Vast.aiLien affiliéTendanceLe moins cher
×1816 GB
ChineTaïwanÉtats-Unis+2
À partir de0,070 €
+33,3 % 30 j
À partir de0,07 €
Lancer

LLM qui tiennent sur le GPU NVIDIA RTX 3080

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 10 GB par GPU.

ModèleParamètres16 bits8 bits4 bits
GLM-4.7 Flash
Z.ai
31,2B
75 GB
Trop grand
41 GB
Trop grand
24 GB
Juste sur 2× · 0 % de marge
Qwen3.6 27B
Alibaba
27,8B
67 GB
Trop grand
37 GB
Trop grand
21 GB
Juste sur 2× · 12 % de marge
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
Trop grand
32 GB
Trop grand
18 GB
2× · 1,6 GB libres
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
2× · 3,5 GB libres
Gemma 3 12B
Google
12,2B
29 GB
Trop grand
16 GB
2× · 3,9 GB libres
9,4 GB
Tient tout juste sur 1×
Granite 4.1 8B
IBM
8,8B
21 GB
Juste sur 2× · 13 % de marge
12 GB
2× · 8,4 GB libres
ou 1× · 3 % de marge
6,8 GB
1× · 3,2 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
Tient tout juste sur 2×
11 GB
2× · 9,2 GB libres
ou 1× · 10 % de marge
6,3 GB
1× · 3,7 GB libres
Llama 3.1 8B Instruct
Meta
8B
19 GB
Tient tout juste sur 2×
11 GB
2× · 9,4 GB libres
ou 1× · 13 % de marge
6,2 GB
1× · 3,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2B
17 GB
2× · 2,6 GB libres
9,6 GB
Tient tout juste sur 1×
5,6 GB
1× · 4,4 GB libres
Qwen3 4B
Alibaba
4B
9,7 GB
Tient tout juste sur 1×
5,3 GB
1× · 4,7 GB libres
3,1 GB
1× · 6,9 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU RTX 3080 par heure ?
Le GPU RTX 3080 démarre à 0,07 € par GPU-heure, avec une médiane de 0,18 € sur 6 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU RTX 3080 ?
1 fournisseurs proposent actuellement le GPU RTX 3080 : Vast.ai. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU RTX 3080 ?
Le GPU RTX 3080 dispose de 10 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU RTX 3080 ?
Avec 10 GB de VRAM, un seul GPU RTX 3080 peut servir des modèles comme Gemma 3 12B, Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU RTX 3080 ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes RTX 3080 sont Mistral Small 3.2 24B sur 2 GPU en 4 bits, gpt-oss-20b sur 2 GPU en 4 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU RTX 3080 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU RTX 3080 est de 0,07 € par GPU-heure, chez Vast.ai. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.