Volver a todas las ofertas

NVIDIA A40

48 GB VRAM150 FP16 TFLOPS300 W TDP5 proveedores11 ofertas5 regiones

La NVIDIA A40 es una GPU de nivel empresarial basada en la arquitectura Ampere y cuenta con 48 GB de memoria con 696 GB/s de ancho de banda de memoria y un TDP de 300 W. Ofrece 37,4 TFLOPS de rendimiento FP32 y 150 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 5 proveedores desde 0,38 €/GPU/hora, con una mediana de mercado de 1,68 €/GPU/hora en 11 configuraciones.

Más barato
0,378 €/h
Runpod
Mediana
1,683 €/h
en 11 ofertas
Más caro
2,004 €/h
Vultr
Tendencia 90 días
+33.1%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Rendimiento FP16
150 TFLOPS
peak
TDP
300 W
Ancho de banda de memoria
696 GB/s
Arquitectura
Ampere
Rendimiento FP32
37,4 TFLOPS
Marca
NVIDIA
Serie
A40
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 5 horas

5 ofertas de 5 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Runpod logoRunpodEnlace de referidoEn tendenciaMás barato
Hasta429 €crédito
×1950 GB
CanadaSweden
0,378 €
0,38 €
Abrir
×1/2015 GB
United States
Desde1,312 €
Desde0,07 €
Abrir
×124120 GB--
1,683 €
0.0% 30d
1,68 €
Abrir
Sesterce Cloud logoSesterce CloudEnlace de referido
×124120 GB
United KingdomSingapore
Desde1,757 €
0.0% 30d
Desde1,76 €
Abrir
×124120 GB
SingaporeUnited Kingdom
1,760 €
0.0% 30d
1,76 €
Abrir

LLM que caben en la NVIDIA A40

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 48 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
Demasiado grande
47 GB
Cabe justo en 1×
28 GB
1× · 20 GB libres
Qwen3 32B
Alibaba
32,8 mil M
79 GB
Demasiado grande
43 GB
1× · 4,8 GB libres
25 GB
1× · 23 GB libres
Gemma 4 31B
Google
31,3 mil M
75 GB
Demasiado grande
41 GB
1× · 6,7 GB libres
24 GB
1× · 24 GB libres
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
Demasiado grande
41 GB
1× · 6,8 GB libres
24 GB
1× · 24 GB libres
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
Demasiado grande
37 GB
1× · 11 GB libres
21 GB
1× · 27 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
Demasiado grande
32 GB
1× · 16 GB libres
18 GB
1× · 30 GB libres
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
1× · 31 GB libres
Gemma 3 12B
Google
12,2 mil M
29 GB
1× · 19 GB libres
16 GB
1× · 32 GB libres
9,4 GB
1× · 39 GB libres
Granite 4.1 8B
IBM
8,8 mil M
21 GB
1× · 27 GB libres
12 GB
1× · 36 GB libres
6,8 GB
1× · 41 GB libres
Qwen3 8B
Alibaba
8,2 mil M
20 GB
1× · 28 GB libres
11 GB
1× · 37 GB libres
6,3 GB
1× · 42 GB libres
Llama 3.1 8B Instruct
Meta
8 mil M
19 GB
1× · 29 GB libres
11 GB
1× · 37 GB libres
6,2 GB
1× · 42 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2 mil M
17 GB
1× · 31 GB libres
9,6 GB
1× · 38 GB libres
5,6 GB
1× · 42 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la A40 por hora?
La A40 empieza en 0,38 € por GPU-hora, con una mediana de 1,68 € entre 11 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la A40?
5 proveedores ofrecen actualmente la A40: Omega Gradient, Runcrate, Vultr, Runpod, Sesterce Cloud. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la A40?
La A40 cuenta con 48 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la A40?
Con 48 GB de VRAM, una sola A40 puede servir modelos como Qwen3.6 35B-A3B, Qwen3 32B, Gemma 4 31B, GLM-4.7 Flash. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Dónde es más barata la A40?
El precio on-demand más bajo que registramos actualmente para la A40 es 0,38 € por GPU-hora en Runpod. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.