Retour à toutes les offres

NVIDIA RTX 5090

32 GB VRAM575 W TDP10 fournisseurs64 offres14 régions

Carte grand public, le GPU NVIDIA RTX 5090 repose sur l'architecture Blackwell et dispose de 32 GB de mémoire, avec une bande passante mémoire de 1 792 GB/s et un TDP de 575 W. Il offre 104 TFLOPS de performances FP32. Actuellement disponible chez 10 fournisseurs à partir de 0,18 €/GPU/heure, avec une médiane du marché de 0,65 €/GPU/heure sur 64 configurations.

RTX 5090 · référence Founders Edition

RTX 5090 · référence Founders Edition

Design représentatif. Le matériel du fournisseur peut différer.

Le moins cher
0,184 €/h
Vast.ai
Médiane
0,653 €/h
sur 64 offres
Le plus cher
8,191 €/h
Vast.ai
Tendance sur 90 jours
+2,8 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
32 GB
GDDR7
Quels LLM tiennent ? ↓
TDP
575 W
Bande passante mémoire
1 792 GB/s
Architecture
Blackwell
Performances FP32
104 TFLOPS
Marque
NVIDIA
Série
GeForce RTX
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

12 offres chez 10 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
RunpodPromu
Jusqu'à438 €de créditPromotion affiliée — nous pouvons percevoir une commission.
×1——--0,868 €0,87 €Lancer
Vast.aiLien affiliéTendanceLe moins cher
×11263 GB
Corée du SudBulgarieCanada+8
À partir de0,184 €
+45,0 % 30 j
À partir de0,18 €
Lancer
×11630 GB
États-Unis
À partir de0,438 €
+23,2 % 30 j
À partir de0,44 €
Lancer
Novita AILien affilié
×11658 GB
États-Unis
À partir de0,491 €
0,0 % 30 j
À partir de0,49 €
Jusqu'à88 €de crédit
×1——
États-Unis
0,509 €
+1,8 % 30 j
0,51 €
LiumLien affilié
Jusqu'à4 €de crédit
×11647 GB
AllemagneUkraineRoumanie+1
À partir de0,526 €
-6,3 % 30 j
À partir de0,53 €
Lancer
×1—73 GB
États-Unis
0,548 €
0,55 €
Lancer
Nova CloudLien affilié
Jusqu'à13 €de crédit
×12284 GB
Canada
0,579 €
+15,8 % 30 j
0,58 €
Lancer
Sesterce CloudLien affilié
×112120 GB
NorvègeÉtats-Unis
À partir de0,627 €
0,0 % 30 j
À partir de0,63 €
Lancer
×112120 GB
NorvègeÉtats-Unis
0,631 €
0,0 % 30 j
À partir de0,63 €
Lancer
×132126 GB
États-Unis
À partir de0,649 €
-0,6 % 30 j
À partir de0,65 €
Lancer
RunpodLien affiliéTendance
Jusqu'à438 €de crédit
×1——--
0,868 €
0,87 €
Lancer
×132126 GB
RoumanieCanada
1,228 €
+40,0 % 30 j
1,23 €
Lancer

LLM qui tiennent sur le GPU NVIDIA RTX 5090

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 32 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
GLM-5.2
Z.ai
753B
—
Non publié
—
Non publié
579 GB
Juste sur 16× · 6 % de marge
DeepSeek R1
DeepSeek
671B
37B actifs
—
Non publié
—
Non publié
481 GB
16× · 31 GB libres
DeepSeek V4 Flash
DeepSeek
284B
—
Non publié
—
Non publié
192 GB
7× · 32 GB libres
Solar Open2 250B
Upstage
250B
15B actifs
601 GB
Juste sur 16× · 2 % de marge
330 GB
16× · 182 GB libres
ou 9× · 4 % de marge
192 GB
7× · 32 GB libres
Qwen3 235B-A22B
Alibaba
235B
22B actifs
564 GB
Juste sur 16× · 8 % de marge
310 GB
16× · 202 GB libres
ou 9× · 11 % de marge
181 GB
7× · 43 GB libres
Laguna-S 2.1
Poolside
118B
8B actifs
282 GB
9× · 5,8 GB libres
ou 8× · 8 % de marge
155 GB
7× · 69 GB libres
90 GB
3× · 5,7 GB libres
gpt-oss-120b
OpenAI
117B
5,1B actifs
—
Non publié
—
Non publié
78 GB
3× · 18 GB libres
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
3× · 9,7 GB libres
47 GB
2× · 17 GB libres
28 GB
1× · 4,4 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
3× · 17 GB libres
43 GB
2× · 21 GB libres
25 GB
1× · 6,8 GB libres
Gemma 4 31B
Google
31,3B
75 GB
3× · 21 GB libres
ou 2× · 2 % de marge
41 GB
2× · 23 GB libres
24 GB
1× · 8 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
3× · 21 GB libres
ou 2× · 2 % de marge
41 GB
2× · 23 GB libres
24 GB
1× · 8 GB libres
Qwen3.6 27B
Alibaba
27,8B
67 GB
3× · 29 GB libres
ou 2× · 15 % de marge
37 GB
2× · 27 GB libres
ou 1× · 4 % de marge
21 GB
1× · 11 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU RTX 5090 par heure ?
Le GPU RTX 5090 démarre à 0,18 € par GPU-heure, avec une médiane de 0,65 € sur 64 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU RTX 5090 ?
12 fournisseurs proposent actuellement le GPU RTX 5090 : Runpod, Vast.ai, Sesterce Cloud, Theta EdgeCloud, Nova Cloud, Runcrate et 6 autres. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU RTX 5090 ?
Le GPU RTX 5090 dispose de 32 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU RTX 5090 ?
Avec 32 GB de VRAM, un seul GPU RTX 5090 peut servir des modèles comme Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU RTX 5090 ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes RTX 5090 sont DeepSeek R1 sur 16 GPU en 4 bits, DeepSeek V4 Flash sur 7 GPU en 4 bits, Solar Open2 250B sur 7 GPU en 4 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU RTX 5090 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU RTX 5090 est de 0,18 € par GPU-heure, chez Vast.ai. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.