Volver a todas las ofertas

NVIDIA GH200

96 GB VRAM989 FP16 TFLOPS700 W TDP1 proveedores1 ofertas1 regiones

La NVIDIA GH200 es una GPU de nivel empresarial basada en la arquitectura Hopper y cuenta con 96 GB de memoria con 4000 GB/s de ancho de banda de memoria y un TDP de 700 W. Ofrece 67 TFLOPS de rendimiento FP32 y 989 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 1 proveedor desde 2,16 €/GPU/hora, con una mediana de mercado de 2,16 €/GPU/hora en 1 configuraciones.

Más barato
2,164 €/h
Runcrate
Mediana
2,164 €/h
en 1 ofertas
Más caro
2,164 €/h
Runcrate
Tendencia 90 días
+0.2%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Memoria
96 GB
HBM3
¿Qué LLM caben? ↓
Rendimiento FP16
989 TFLOPS
peak
TDP
700 W
Ancho de banda de memoria
4000 GB/s
Arquitectura
Hopper
Rendimiento FP32
67 TFLOPS
Marca
NVIDIA
Serie
GH200
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 7 horas

3 ofertas de 1 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
×164432 GB--
1,967 €
0.0% 30d
1,97 €
Runcrate logoRuncrateMás barato
×164432 GB
United States
2,164 €
0.0% 30d
2,16 €
Abrir
Sesterce Cloud logoSesterce CloudEnlace de referido
×1144480 GB--
3,996 €
4,00 €

LLM que caben en la NVIDIA GH200

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 96 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
Laguna-S 2.1
Poolside
118 mil M
8 mil M activos
282 GB
Demasiado grande
155 GB
Demasiado grande
90 GB
1× · 5,7 GB libres
gpt-oss-120b
OpenAI
117 mil M
5,1 mil M activos
No publicado
No publicado
78 GB
1× · 18 GB libres
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
1× · 9,7 GB libres
47 GB
1× · 49 GB libres
28 GB
1× · 68 GB libres
Qwen3 32B
Alibaba
32,8 mil M
79 GB
1× · 17 GB libres
43 GB
1× · 53 GB libres
25 GB
1× · 71 GB libres
Gemma 4 31B
Google
31,3 mil M
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
1× · 21 GB libres
41 GB
1× · 55 GB libres
24 GB
1× · 72 GB libres
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
1× · 29 GB libres
37 GB
1× · 59 GB libres
21 GB
1× · 75 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
1× · 38 GB libres
32 GB
1× · 64 GB libres
18 GB
1× · 78 GB libres
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
1× · 79 GB libres
Gemma 3 12B
Google
12,2 mil M
29 GB
1× · 67 GB libres
16 GB
1× · 80 GB libres
9,4 GB
1× · 87 GB libres
Granite 4.1 8B
IBM
8,8 mil M
21 GB
1× · 75 GB libres
12 GB
1× · 84 GB libres
6,8 GB
1× · 89 GB libres
Qwen3 8B
Alibaba
8,2 mil M
20 GB
1× · 76 GB libres
11 GB
1× · 85 GB libres
6,3 GB
1× · 90 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la GH200 por hora?
La GH200 empieza en 2,16 € por GPU-hora, con una mediana de 2,16 € entre 1 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la GH200?
3 proveedores ofrecen actualmente la GH200: Sesterce Cloud, Runcrate, Lambda. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la GH200?
La GH200 cuenta con 96 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la GH200?
Con 96 GB de VRAM, una sola GH200 puede servir modelos como Laguna-S 2.1, gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Dónde es más barata la GH200?
El precio on-demand más bajo que registramos actualmente para la GH200 es 2,16 € por GPU-hora en Runcrate. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.