Volver a todas las ofertas

NVIDIA Tesla M40

24 GB VRAM250 W TDP0 proveedores0 ofertas0 regiones

La NVIDIA Tesla M40 es una GPU de nivel empresarial basada en la arquitectura Maxwell y cuenta con 24 GB de memoria con 288 GB/s de ancho de banda de memoria y un TDP de 250 W. Ofrece 6,8 TFLOPS de rendimiento FP32.

Más barato
Sin ofertas actuales
Mediana
en 0 ofertas
Más caro
Tendencia 90 días
+1673.3%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

TDP
250 W
Ancho de banda de memoria
288 GB/s
Arquitectura
Maxwell
Rendimiento FP32
6,8 TFLOPS
Marca
NVIDIA
Serie
Tesla
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 14 minutos

0 ofertas de 0 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Amplía tus filtros o limpia todos los filtros para volver a empezar.

LLM que caben en la NVIDIA Tesla M40

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 24 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
Demasiado grande
47 GB
Demasiado grande
28 GB
Ajustado en 1× · 4 % libre
Qwen3 32B
Alibaba
32,8 mil M
79 GB
Demasiado grande
43 GB
Demasiado grande
25 GB
Ajustado en 1× · 14 % libre
Gemma 4 31B
Google
31,3 mil M
75 GB
Demasiado grande
41 GB
Demasiado grande
24 GB
Ajustado en 1× · 19 % libre
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
Demasiado grande
41 GB
Demasiado grande
24 GB
Cabe justo en 1×
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
Demasiado grande
37 GB
Demasiado grande
21 GB
1× · 2,7 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
Demasiado grande
32 GB
Demasiado grande
18 GB
1× · 5,6 GB libres
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
1× · 7,5 GB libres
Gemma 3 12B
Google
12,2 mil M
29 GB
Demasiado grande
16 GB
1× · 7,9 GB libres
9,4 GB
1× · 15 GB libres
Granite 4.1 8B
IBM
8,8 mil M
21 GB
1× · 2,9 GB libres
12 GB
1× · 12 GB libres
6,8 GB
1× · 17 GB libres
Qwen3 8B
Alibaba
8,2 mil M
20 GB
1× · 4,3 GB libres
11 GB
1× · 13 GB libres
6,3 GB
1× · 18 GB libres
Llama 3.1 8B Instruct
Meta
8 mil M
19 GB
1× · 4,7 GB libres
11 GB
1× · 13 GB libres
6,2 GB
1× · 18 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2 mil M
17 GB
1× · 6,6 GB libres
9,6 GB
1× · 14 GB libres
5,6 GB
1× · 18 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánta VRAM tiene la Tesla M40?
La Tesla M40 cuenta con 24 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la Tesla M40?
Con 24 GB de VRAM, una sola Tesla M40 puede servir modelos como GLM-4.7 Flash, Qwen3.6 27B, Mistral Small 3.2 24B, gpt-oss-20b. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.