Retour à toutes les offres

NVIDIA Quadro RTX 4000

8 GB VRAM160 W TDP1 fournisseurs1 offres0 régions

Carte de classe entreprise, le GPU NVIDIA Quadro RTX 4000 repose sur l'architecture Turing et dispose de 8 GB de mémoire, avec une bande passante mémoire de 416 GB/s et un TDP de 160 W. Il offre 7,1 TFLOPS de performances FP32. Actuellement disponible chez 1 fournisseur à partir de 0,10 €/GPU/heure, avec une médiane du marché de 0,10 €/GPU/heure sur 1 configurations.

Le moins cher
0,096 €/h
Omega Gradient
Médiane
0,096 €/h
sur 1 offres
Le plus cher
0,096 €/h
Omega Gradient
Tendance sur 90 jours
+57,1 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
8 GB
GDDR6X
Quels LLM tiennent ? ↓
TDP
160 W
Bande passante mémoire
416 GB/s
Architecture
Turing
Performances FP32
7,1 TFLOPS
Marque
NVIDIA
Série
Quadro RTX
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

1 offre chez 1 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
Omega GradientLe moins cher
×11263 GB--
0,096 €
0,10 €
Lancer

LLM qui tiennent sur le GPU NVIDIA Quadro RTX 4000

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 8 GB par GPU.

ModèleParamètres16 bits8 bits4 bits
Gemma 3 12B
Google
12,2B
29 GB
Trop grand
16 GB
Trop grand
9,4 GB
Juste sur 1× · 2 % de marge
Granite 4.1 8B
IBM
8,8B
21 GB
Trop grand
12 GB
Trop grand
6,8 GB
1× · 1,2 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
Trop grand
11 GB
Trop grand
6,3 GB
1× · 1,7 GB libres
Llama 3.1 8B Instruct
Meta
8B
19 GB
Trop grand
11 GB
Trop grand
6,2 GB
1× · 1,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2B
17 GB
Trop grand
9,6 GB
Juste sur 1× · 0 % de marge
5,6 GB
1× · 2,4 GB libres
Qwen3 4B
Alibaba
4B
9,7 GB
Trop grand
5,3 GB
1× · 2,7 GB libres
3,1 GB
1× · 4,9 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU Quadro RTX 4000 par heure ?
Le GPU Quadro RTX 4000 démarre à 0,10 € par GPU-heure, avec une médiane de 0,10 € sur 1 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU Quadro RTX 4000 ?
1 fournisseurs proposent actuellement le GPU Quadro RTX 4000 : Omega Gradient. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU Quadro RTX 4000 ?
Le GPU Quadro RTX 4000 dispose de 8 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU Quadro RTX 4000 ?
Avec 8 GB de VRAM, un seul GPU Quadro RTX 4000 peut servir des modèles comme Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct, Mistral 7B Instruct v0.3. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Où le GPU Quadro RTX 4000 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU Quadro RTX 4000 est de 0,10 € par GPU-heure, chez Omega Gradient. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.