Volver a todas las ofertas

NVIDIA B200

180 GB VRAM2250 FP16 TFLOPS1000 W TDP6 proveedores19 ofertas6 regiones

La NVIDIA B200 es una GPU de nivel empresarial basada en la arquitectura Blackwell y cuenta con 180 GB de memoria con 8000 GB/s de ancho de banda de memoria y un TDP de 1000 W. Ofrece 75 TFLOPS de rendimiento FP32 y 2250 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 6 proveedores desde 4,38 €/GPU/hora, con una mediana de mercado de 5,15 €/GPU/hora en 19 configuraciones.

Más barato
4,380 €/h
Beyond.pl
Mediana
5,153 €/h
en 19 ofertas
Más caro
8,932 €/h
Vast.ai
Tendencia 90 días
+2.7%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Memoria
180 GB
HBM3
¿Qué LLM caben? ↓
Rendimiento FP16
2250 TFLOPS
peak
TDP
1000 W
Ancho de banda de memoria
8000 GB/s
Arquitectura
Blackwell
Rendimiento FP32
75 TFLOPS
Marca
NVIDIA
Serie
B200
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 14 minutos

8 ofertas de 6 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Runpod logoRunpodPromocionado
Hasta429 €créditoPromoción de afiliados — podemos ganar una comisión.
×124188 GB
United StatesRomania
5,832 €5,83 €Abrir
Sesterce Cloud logoSesterce CloudEnlace de referido
×8962 TB--
Desde3,533 €
0.0% 30d
Desde28,27 €
Beyond.pl logoBeyond.plMás barato
×128256 GB
Poland
4,380 €
Desde4,38 €
Abrir
Vast.ai logoVast.aiEnlace de referidoEn tendencia
×124250 GB
United States
Desde4,561 €
-9.3% 30d
Desde4,56 €
Abrir
LiumEnlace de referido
Hasta4 €crédito
×126354 GB
AustraliaUnited StatesFinland
Desde4,724 €
Desde4,72 €
Abrir
×82522 TB
Canada
5,153 €
41,23 €
Abrir
×130170 GB--
5,248 €
Desde5,25 €
Abrir
×82082,83 TB--
Desde5,746 €
Desde45,97 €
Runpod logoRunpodEnlace de referidoEn tendencia
Hasta429 €crédito
×124188 GB
United StatesRomania
5,832 €
0.0% 30d
5,83 €
Abrir

LLM que caben en la NVIDIA B200

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 180 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
DeepSeek V4 Pro
DeepSeek
1,6 B
49 mil M activos
No publicado
No publicado
1038 GB
8× · 402 GB libres
Kimi K2.5
Moonshot AI
1 B
32 mil M activos
No publicado
No publicado
714 GB
4× · 5,8 GB libres
GLM-5.2
Z.ai
753 mil M
1808 GB
Demasiado grande
994 GB
8× · 446 GB libres
579 GB
4× · 141 GB libres
DeepSeek R1
DeepSeek
671 mil M
37 mil M activos
No publicado
826 GB
8× · 614 GB libres
o 4× · 4 % libre
481 GB
4× · 239 GB libres
DeepSeek V4 Flash
DeepSeek
284 mil M
No publicado
No publicado
192 GB
2× · 168 GB libres
o 1× · 12 % libre
Solar Open2 250B
Upstage
250 mil M
15 mil M activos
601 GB
4× · 119 GB libres
330 GB
2× · 30 GB libres
192 GB
2× · 168 GB libres
o 1× · 12 % libre
Qwen3 235B-A22B
Alibaba
235 mil M
22 mil M activos
564 GB
4× · 156 GB libres
310 GB
2× · 50 GB libres
181 GB
2× · 179 GB libres
o 1× · 19 % libre
Laguna-S 2.1
Poolside
118 mil M
8 mil M activos
282 GB
2× · 78 GB libres
155 GB
1× · 25 GB libres
90 GB
1× · 90 GB libres
gpt-oss-120b
OpenAI
117 mil M
5,1 mil M activos
No publicado
No publicado
78 GB
1× · 102 GB libres
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
1× · 94 GB libres
47 GB
1× · 133 GB libres
28 GB
1× · 152 GB libres
Qwen3 32B
Alibaba
32,8 mil M
79 GB
1× · 101 GB libres
43 GB
1× · 137 GB libres
25 GB
1× · 155 GB libres
Gemma 4 31B
Google
31,3 mil M
75 GB
1× · 105 GB libres
41 GB
1× · 139 GB libres
24 GB
1× · 156 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la B200 por hora?
La B200 empieza en 4,38 € por GPU-hora, con una mediana de 5,15 € entre 19 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la B200?
8 proveedores ofrecen actualmente la B200: Runpod, Hyperstack, Lium, Sesterce Cloud, Beyond.pl, Verda y 2 más. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la B200?
La B200 cuenta con 180 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la B200?
Con 180 GB de VRAM, una sola B200 puede servir modelos como Laguna-S 2.1, gpt-oss-120b, Qwen3.6 35B-A3B, Qwen3 32B. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Cuál es el LLM más grande que puedo ejecutar en varias B200?
Los modelos más grandes que registramos y que caben repartidos entre varias B200 son DeepSeek V4 Pro en 8 GPUs a 4 bits, Kimi K2.5 en 4 GPUs a 4 bits, GLM-5.2 en 4 GPUs a 4 bits. En una configuración multi-GPU alquilas y pagas todas las tarjetas durante toda la ejecución, y repartir un modelo entre varias tarjetas también cuesta rendimiento: las GPU intercambian activaciones en cada token, así que el rendimiento depende de la velocidad de la conexión entre ellas. No registramos el interconnect, así que consulta las especificaciones del nodo del proveedor. La tabla anterior indica la configuración más pequeña de cada modelo con precisión de 16, 8 y 4 bits.
¿Dónde es más barata la B200?
El precio on-demand más bajo que registramos actualmente para la B200 es 4,38 € por GPU-hora en Beyond.pl. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.