Volver a todas las ofertas

NVIDIA L4

24 GB VRAM121 FP16 TFLOPS72 W TDP7 proveedores23 ofertas7 regiones

La NVIDIA L4 es una GPU de nivel empresarial basada en la arquitectura Ada Lovelace y cuenta con 24 GB de memoria con 300 GB/s de ancho de banda de memoria y un TDP de 72 W. Ofrece 30,3 TFLOPS de rendimiento FP32 y 121 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 7 proveedores desde 0,15 €/GPU/hora, con una mediana de mercado de 0,86 €/GPU/hora en 23 configuraciones.

Más barato
0,146 €/h
Vast.ai
Mediana
0,857 €/h
en 23 ofertas
Más caro
0,902 €/h
Runcrate
Tendencia 90 días
+92.2%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Rendimiento FP16
121 TFLOPS
peak
TDP
72 W
Ancho de banda de memoria
300 GB/s
Arquitectura
Ada Lovelace
Rendimiento FP32
30,3 TFLOPS
Marca
NVIDIA
Serie
L4
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 3 horas

7 ofertas de 7 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Runpod logoRunpodPromocionado
Hasta429 €créditoPromoción de afiliados — podemos ganar una comisión.
×1655 GB
RomaniaIceland
0,421 €0,42 €Abrir
Vast.ai logoVast.aiEnlace de referidoEn tendenciaMás barato
×232125 GB
NetherlandsSwitzerlandUnited States
Desde0,146 €
-15.0% 30d
Desde0,29 €
Abrir
Theta EdgeCloud logoTheta EdgeCloudEn tendencia
×148252 GB
United States
0,283 €
0.0% 30d
0,28 €
Abrir
Runpod logoRunpodEnlace de referidoEn tendencia
Hasta429 €crédito
×1655 GB
RomaniaIceland
0,421 €
0.0% 30d
0,42 €
Abrir
×1848 GB
FrancePoland
0,788 €
+1.5% 30d
Desde0,79 €
Abrir
×432192 GB--
Desde0,857 €
+0.1% 30d
Desde3,43 €
Abrir
Sesterce Cloud logoSesterce CloudEnlace de referido
×1848 GB
PolandFrance
0,897 €
0.0% 30d
Desde0,90 €
Abrir
×1848 GB
PolandFrance
0,902 €
0.0% 30d
Desde0,90 €
Abrir

LLM que caben en la NVIDIA L4

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 24 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
DeepSeek V4 Flash
DeepSeek
284 mil M
No publicado
No publicado
192 GB
Cabe justo en 8×
Solar Open2 250B
Upstage
250 mil M
15 mil M activos
No publicado
330 GB
Demasiado grande
192 GB
Ajustado en 8× · 19 % libre
Qwen3 235B-A22B
Alibaba
235 mil M
22 mil M activos
No publicado
310 GB
Demasiado grande
181 GB
8× · 11 GB libres
Laguna-S 2.1
Poolside
118 mil M
8 mil M activos
282 GB
Demasiado grande
155 GB
8× · 37 GB libres
90 GB
4× · 5,7 GB libres
gpt-oss-120b
OpenAI
117 mil M
5,1 mil M activos
No publicado
No publicado
78 GB
4× · 18 GB libres
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
4× · 9,7 GB libres
47 GB
Cabe justo en 2×
28 GB
2× · 20 GB libres
o 1× · 4 % libre
Qwen3 32B
Alibaba
32,8 mil M
79 GB
4× · 17 GB libres
43 GB
2× · 4,8 GB libres
25 GB
2× · 23 GB libres
o 1× · 14 % libre
Gemma 4 31B
Google
31,3 mil M
75 GB
4× · 21 GB libres
41 GB
2× · 6,7 GB libres
24 GB
2× · 24 GB libres
o 1× · 19 % libre
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
4× · 21 GB libres
41 GB
2× · 6,8 GB libres
24 GB
Cabe justo en 1×
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
4× · 29 GB libres
37 GB
2× · 11 GB libres
21 GB
1× · 2,7 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
4× · 38 GB libres
32 GB
2× · 16 GB libres
18 GB
1× · 5,6 GB libres
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
1× · 7,5 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la L4 por hora?
La L4 empieza en 0,15 € por GPU-hora, con una mediana de 0,86 € entre 23 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la L4?
8 proveedores ofrecen actualmente la L4: Omega Gradient, Sesterce Cloud, Scaleway, Runcrate, AceCloud, Vast.ai y 2 más. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la L4?
La L4 cuenta con 24 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la L4?
Con 24 GB de VRAM, una sola L4 puede servir modelos como GLM-4.7 Flash, Qwen3.6 27B, Mistral Small 3.2 24B, gpt-oss-20b. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Cuál es el LLM más grande que puedo ejecutar en varias L4?
Los modelos más grandes que registramos y que caben repartidos entre varias L4 son DeepSeek V4 Flash en 8 GPUs a 4 bits, Qwen3 235B-A22B en 8 GPUs a 4 bits, Laguna-S 2.1 en 4 GPUs a 4 bits. En una configuración multi-GPU alquilas y pagas todas las tarjetas durante toda la ejecución, y repartir un modelo entre varias tarjetas también cuesta rendimiento: las GPU intercambian activaciones en cada token, así que el rendimiento depende de la velocidad de la conexión entre ellas. No registramos el interconnect, así que consulta las especificaciones del nodo del proveedor. La tabla anterior indica la configuración más pequeña de cada modelo con precisión de 16, 8 y 4 bits.
¿Dónde es más barata la L4?
El precio on-demand más bajo que registramos actualmente para la L4 es 0,15 € por GPU-hora en Vast.ai. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.