Retour à toutes les offres

Intel Gaudi 2

96 GB VRAM432 FP16 TFLOPS600 W TDP1 fournisseurs4 offres1 régions

Carte de classe entreprise, le GPU Intel Gaudi 2 repose sur l'architecture Gaudi 2 et dispose de 96 GB de mémoire, avec une bande passante mémoire de 2 450 GB/s et un TDP de 600 W. Il offre 432 TFLOPS de performances tensorielles FP16. Actuellement disponible chez 1 fournisseur à partir de 0,90 €/GPU/heure, avec une médiane du marché de 0,91 €/GPU/heure sur 4 configurations.

Le moins cher
0,898 €/h
Cyfuture AI
Médiane
0,912 €/h
sur 4 offres
Le plus cher
0,925 €/h
Cyfuture AI
Tendance sur 90 jours
+0,5 %
tarif médian

Caractéristiques matérielles

Identiques chez tous les fournisseurs

Performances FP16
432 TFLOPS
crête
TDP
600 W
Bande passante mémoire
2 450 GB/s
Architecture
Gaudi 2
Marque
Intel
Série
Gaudi
Historique des prix du marché

Prix médian sur l'ensemble des fournisseurs

Prix mis à jour

2 offres chez 1 fournisseurs

Triées par prix croissant. Comparez les configurations côte à côte.

FournisseurNombrevCPURAMRégionPar heure de GPUTotal/hAction
Cyfuture AILe moins cher
Jusqu'à1 €de crédit
×81522,25 TB
Inde
À partir de0,898 €
-0,4 % 30 j
À partir de7,19 €
Lancer
Sesterce CloudLien affilié
×8152940 GB--
1,061 €
0,0 % 30 j
8,49 €

LLM qui tiennent sur le GPU Intel Gaudi 2

VRAM estimée des LLM à poids ouverts populaires en précision 16 bits (FP16/BF16), 8 bits (FP8/INT8) et 4 bits (INT4/MXFP4), pour 96 GB par GPU. Affichage des 12 plus grands qui tiennent.

ModèleParamètres16 bits8 bits4 bits
Kimi K2.5
Moonshot AI
1T
32B actifs
—
Non publié
—
Non publié
714 GB
8× · 54 GB libres
GLM-5.2
Z.ai
753B
1 808 GB
Trop grand
994 GB
Trop grand
579 GB
8× · 189 GB libres
DeepSeek R1
DeepSeek
671B
37B actifs
—
Non publié
826 GB
Juste sur 8× · 11 % de marge
481 GB
8× · 287 GB libres
DeepSeek V4 Flash
DeepSeek
284B
—
Non publié
—
Non publié
192 GB
Tient tout juste sur 2×
Solar Open2 250B
Upstage
250B
15B actifs
601 GB
8× · 167 GB libres
330 GB
4× · 54 GB libres
192 GB
4× · 192 GB libres
ou 2× · 19 % de marge
Qwen3 235B-A22B
Alibaba
235B
22B actifs
564 GB
8× · 204 GB libres
310 GB
4× · 74 GB libres
181 GB
2× · 11 GB libres
Laguna-S 2.1
Poolside
118B
8B actifs
282 GB
4× · 102 GB libres
155 GB
2× · 37 GB libres
90 GB
1× · 5,7 GB libres
gpt-oss-120b
OpenAI
117B
5,1B actifs
—
Non publié
—
Non publié
78 GB
1× · 18 GB libres
Qwen3.6 35B-A3B
Alibaba
35B
3B actifs
86 GB
1× · 9,7 GB libres
47 GB
1× · 49 GB libres
28 GB
1× · 68 GB libres
Qwen3 32B
Alibaba
32,8B
79 GB
1× · 17 GB libres
43 GB
1× · 53 GB libres
25 GB
1× · 71 GB libres
Gemma 4 31B
Google
31,3B
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres
GLM-4.7 Flash
Z.ai
31,2B
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres

Estimations : poids du modèle plus 20 % pour le cache KV et le surcoût du runtime, avec des contextes courts. Les contextes longs et les lots importants demandent davantage. Les lignes marquées « juste » contiennent les poids, mais pas toute cette marge. Une valeur ×N correspond à la VRAM totale de N de ces GPU et ne préjuge en rien du débit de l'interconnexion. Notre méthode d'estimation · Partir plutôt d'un modèle

Vous en voulez plus sur cette page ?

Des données erronées ?

Questions fréquentes

Combien coûte le GPU Intel Gaudi 2 par heure ?
Le GPU Intel Gaudi 2 démarre à 0,90 € par GPU-heure, avec une médiane de 0,91 € sur 4 configurations disponibles. Le prix réel dépend du fournisseur, de la région et du mode de location : à la demande, Spot ou réservé.
Quels fournisseurs cloud proposent le GPU Intel Gaudi 2 ?
2 fournisseurs proposent actuellement le GPU Intel Gaudi 2 : Sesterce Cloud, Cyfuture AI. Comparez leurs prix horaires, leurs régions et les caractéristiques des machines dans le tableau ci-dessus.
Combien de VRAM a le GPU Intel Gaudi 2 ?
Le GPU Intel Gaudi 2 dispose de 96 GB de VRAM, ce qui détermine les plus grands modèles et tailles de batch qu'il peut garder en mémoire pour l'entraînement et l'inférence.
Quels LLM puis-je faire tourner sur le GPU Intel Gaudi 2 ?
Avec 96 GB de VRAM, un seul GPU Intel Gaudi 2 peut servir des modèles comme Laguna-S 2.1, gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B. Le tableau ci-dessus indique la VRAM estimée pour chaque modèle en précision 16 bits, 8 bits et 4 bits, y compris les configurations multi-GPU nécessaires aux plus grands modèles.
Quel est le plus grand LLM que je peux faire tourner sur plusieurs GPU Intel Gaudi 2 ?
Les plus grands modèles que nous suivons et qui tiennent sur plusieurs cartes Intel Gaudi 2 sont Kimi K2.5 sur 8 GPU en 4 bits, GLM-5.2 sur 8 GPU en 4 bits, DeepSeek R1 sur 8 GPU en 4 bits. Une configuration multi-GPU signifie que vous louez et payez chaque carte pendant toute la durée d'utilisation, et répartir un modèle sur plusieurs cartes coûte aussi du débit : les GPU échangent des activations à chaque token, donc les performances dépendent de la rapidité de leur interconnexion. Nous ne suivons pas l'interconnexion : vérifiez les caractéristiques du nœud auprès du fournisseur. Le tableau ci-dessus donne la plus petite configuration pour chaque modèle en précision 16 bits, 8 bits et 4 bits.
Où le GPU Intel Gaudi 2 est-il le moins cher ?
Le prix à la demande le plus bas que nous suivons actuellement pour le GPU Intel Gaudi 2 est de 0,90 € par GPU-heure, chez Cyfuture AI. Les fournisseurs modifiant fréquemment leurs prix et leur disponibilité, vérifiez le tableau en direct ci-dessus avant de lancer une instance.