Volver a todas las ofertas

NVIDIA A100 40GB

40 GB VRAM312 FP16 TFLOPS250 W TDP3 proveedores8 ofertas2 regiones

La NVIDIA A100 40GB es una GPU de nivel empresarial basada en la arquitectura Ampere y cuenta con 40 GB de memoria con 1555 GB/s de ancho de banda de memoria y un TDP de 250 W. Ofrece 19,5 TFLOPS de rendimiento FP32 y 312 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 3 proveedores desde 1,11 €/GPU/hora, con una mediana de mercado de 1,53 €/GPU/hora en 8 configuraciones.

Más barato
1,108 €/h
Verda
Mediana
1,529 €/h
en 8 ofertas
Más caro
1,881 €/h
Runcrate
Tendencia 90 días
+8.8%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Memoria
40 GB
HBM2e
¿Qué LLM caben? ↓
Rendimiento FP16
312 TFLOPS
peak
TDP
250 W
Ancho de banda de memoria
1555 GB/s
Arquitectura
Ampere
Rendimiento FP32
19,5 TFLOPS
Marca
NVIDIA
Serie
A100
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 6 horas

3 ofertas de 3 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Verda logoVerdaMás barato
×122120 GB--
1,108 €
Desde1,11 €
Abrir
×114117 GB
United StatesIndia
Desde1,262 €
0.0% 30d
Desde1,26 €
Abrir
×130200 GB
IndiaUnited States
1,881 €
+2.7% 30d
1,88 €
Abrir

LLM que caben en la NVIDIA A100 40GB

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 40 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
DeepSeek V4 Flash
DeepSeek
284 mil M
No publicado
No publicado
192 GB
8× · 128 GB libres
Solar Open2 250B
Upstage
250 mil M
15 mil M activos
601 GB
Demasiado grande
330 GB
Ajustado en 8× · 16 % libre
192 GB
8× · 128 GB libres
Qwen3 235B-A22B
Alibaba
235 mil M
22 mil M activos
564 GB
Demasiado grande
310 GB
8× · 9,7 GB libres
181 GB
8× · 139 GB libres
Laguna-S 2.1
Poolside
118 mil M
8 mil M activos
282 GB
8× · 38 GB libres
155 GB
8× · 165 GB libres
90 GB
8× · 230 GB libres
gpt-oss-120b
OpenAI
117 mil M
5,1 mil M activos
No publicado
No publicado
78 GB
8× · 242 GB libres
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
8× · 234 GB libres
47 GB
8× · 273 GB libres
o 1× · 1 % libre
28 GB
1× · 12 GB libres
Qwen3 32B
Alibaba
32,8 mil M
79 GB
8× · 241 GB libres
43 GB
8× · 277 GB libres
o 1× · 10 % libre
25 GB
1× · 15 GB libres
Gemma 4 31B
Google
31,3 mil M
75 GB
8× · 245 GB libres
41 GB
8× · 279 GB libres
o 1× · 16 % libre
24 GB
1× · 16 GB libres
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
8× · 245 GB libres
41 GB
8× · 279 GB libres
o 1× · 16 % libre
24 GB
1× · 16 GB libres
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
8× · 253 GB libres
37 GB
1× · 3,3 GB libres
21 GB
1× · 19 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
8× · 262 GB libres
32 GB
1× · 8,3 GB libres
18 GB
1× · 22 GB libres
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
1× · 23 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la A100 40GB por hora?
La A100 40GB empieza en 1,11 € por GPU-hora, con una mediana de 1,53 € entre 8 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la A100 40GB?
3 proveedores ofrecen actualmente la A100 40GB: Omega Gradient, Runcrate, Verda. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la A100 40GB?
La A100 40GB cuenta con 40 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la A100 40GB?
Con 40 GB de VRAM, una sola A100 40GB puede servir modelos como Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Cuál es el LLM más grande que puedo ejecutar en varias A100 40GB?
Los modelos más grandes que registramos y que caben repartidos entre varias A100 40GB son DeepSeek V4 Flash en 8 GPUs a 4 bits, Solar Open2 250B en 8 GPUs a 4 bits, Qwen3 235B-A22B en 8 GPUs a 8 bits. En una configuración multi-GPU alquilas y pagas todas las tarjetas durante toda la ejecución, y repartir un modelo entre varias tarjetas también cuesta rendimiento: las GPU intercambian activaciones en cada token, así que el rendimiento depende de la velocidad de la conexión entre ellas. No registramos el interconnect, así que consulta las especificaciones del nodo del proveedor. La tabla anterior indica la configuración más pequeña de cada modelo con precisión de 16, 8 y 4 bits.
¿Dónde es más barata la A100 40GB?
El precio on-demand más bajo que registramos actualmente para la A100 40GB es 1,11 € por GPU-hora en Verda. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.