Retour à toutes les offres

NVIDIA RTX 3070

8 GB VRAM220 W TDP3 fournisseurs11 offres5 régions

Carte grand public, le GPU NVIDIA RTX 3070 repose sur l'architecture Ampere et dispose de 8 GB de mémoire, avec une bande passante mémoire de 448 GB/s et un TDP de 220 W. Il offre 20,4 TFLOPS de performances FP32. Actuellement disponible chez 3 fournisseurs à partir de 0,08 €/GPU/heure, avec une médiane du marché de 0,10 €/GPU/heure sur 11 configurations.

Le moins cher
0,079 €/h
Vast.ai
Médiane
0,096 €/h
sur 11 offres
Le plus cher
3,508 €/h
Vast.ai
Tendance sur 90 jours
+69,2 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Mémoire
8 GB
GDDR6X
Quels LLM tiennent ? ↓
TDP
220 W
Bande passante mémoire
448 GB/s
Architecture
Ampere
Performances FP32
20,4 TFLOPS
Marque
NVIDIA
Série
GeForce RTX
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

3 offres chez 3 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
Vast.aiLien affiliéTendanceLe moins cher
×256126 GB
États-UnisRussieUkraine+1
À partir de0,079 €
+15,8 % 30 j
À partir de0,16 €
Lancer
×1631 GB
Finlande
0,088 €
+5,3 % 30 j
0,09 €
Lancer
×21663 GB
États-Unis
0,202 €
+170,6 % 30 j
0,40 €
Lancer

LLM qui tiennent sur le GPU NVIDIA RTX 3070

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 8 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
Trop grand
47 GB
Tient tout juste sur 6×
28 GB
6× · 20 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
Trop grand
43 GB
6× · 4,8 GB libres
25 GB
6× · 23 GB libres
Gemma 4 31B
Google
31,3B
75 GB
Trop grand
41 GB
6× · 6,7 GB libres
24 GB
6× · 24 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
Trop grand
41 GB
6× · 6,8 GB libres
24 GB
6× · 24 GB libres
Qwen3.6 27B
Alibaba
27,8B
67 GB
Trop grand
37 GB
6× · 11 GB libres
21 GB
6× · 27 GB libres
Mistral Small 3.2 24B
Mistral AI
24B
58 GB
Trop grand
32 GB
6× · 16 GB libres
18 GB
6× · 30 GB libres
ou 2× · 4 % de marge
gpt-oss-20b
OpenAI
21B
3,6B actifs
—
Non publié
—
Non publié
17 GB
6× · 31 GB libres
ou 2× · 16 % de marge
Gemma 3 12B
Google
12,2B
29 GB
6× · 19 GB libres
16 GB
6× · 32 GB libres
ou 2× · 19 % de marge
9,4 GB
2× · 6,6 GB libres
ou 1× · 2 % de marge
Granite 4.1 8B
IBM
8,8B
21 GB
6× · 27 GB libres
12 GB
2× · 4,4 GB libres
6,8 GB
1× · 1,2 GB libres
Qwen3 8B
Alibaba
8,2B
20 GB
6× · 28 GB libres
11 GB
2× · 5,2 GB libres
6,3 GB
1× · 1,7 GB libres
Llama 3.1 8B Instruct
Meta
8B
19 GB
6× · 29 GB libres
11 GB
2× · 5,4 GB libres
6,2 GB
1× · 1,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2B
17 GB
6× · 31 GB libres
ou 2× · 10 % de marge
9,6 GB
2× · 6,4 GB libres
ou 1× · 0 % de marge
5,6 GB
1× · 2,4 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU RTX 3070 par heure ?
Le GPU RTX 3070 démarre à 0,08 € par GPU-heure, avec une médiane de 0,10 € sur 11 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU RTX 3070 ?
3 fournisseurs proposent actuellement le GPU RTX 3070 : Vast.ai, Theta EdgeCloud, Omega Gradient. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU RTX 3070 ?
Le GPU RTX 3070 dispose de 8 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU RTX 3070 ?
Avec 8 GB de VRAM, un seul GPU RTX 3070 peut servir des modèles comme Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct, Mistral 7B Instruct v0.3. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU RTX 3070 ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes RTX 3070 sont Qwen3.6 35B-A3B sur 6 GPU en 8 bits, Qwen3 32B sur 6 GPU en 8 bits, Gemma 4 31B sur 6 GPU en 8 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU RTX 3070 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU RTX 3070 est de 0,08 € par GPU-heure, chez Vast.ai. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.