Volver a todas las ofertas

NVIDIA T4

16 GB VRAM65 FP16 TFLOPS70 W TDP3 proveedores8 ofertas2 regiones

La NVIDIA T4 es una GPU de nivel empresarial basada en la arquitectura Turing y cuenta con 16 GB de memoria con 300 GB/s de ancho de banda de memoria y un TDP de 70 W. Ofrece 8,1 TFLOPS de rendimiento FP32 y 65 TFLOPS de rendimiento tensorial FP16. Disponible actualmente en 3 proveedores desde 0,11 €/GPU/hora, con una mediana de mercado de 0,16 €/GPU/hora en 8 configuraciones.

Más barato
0,112 €/h
Omega Gradient
Mediana
0,163 €/h
en 8 ofertas
Más caro
10,305 €/h
Vast.ai
Tendencia 90 días
-5.0%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Rendimiento FP16
65 TFLOPS
peak
TDP
70 W
Ancho de banda de memoria
300 GB/s
Arquitectura
Turing
Rendimiento FP32
8,1 TFLOPS
Marca
NVIDIA
Serie
T4
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados hace 3 horas

3 ofertas de 3 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Vast.ai logoVast.aiPromocionado
Promoción de afiliados — podemos ganar una comisión.
×248126 GB
China
0,146 €0,29 €Abrir
Omega Gradient logoOmega GradientMás barato
×272252 GB
United States
0,112 €
0,22 €
Abrir
Vast.ai logoVast.aiEnlace de referidoEn tendencia
×248126 GB
ChinaUnited States
Desde0,146 €
+20.0% 30d
Desde0,29 €
Abrir
Theta EdgeCloud logoTheta EdgeCloudEn tendencia
×128 GB--
0,172 €
Desde0,17 €
Abrir

LLM que caben en la NVIDIA T4

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 16 GB por GPU. Se muestran los 12 modelos más grandes que caben.

ModeloParámetros16 bits8 bits4 bits
Qwen3.6 35B-A3B
Alibaba
35 mil M
3 mil M activos
86 GB
Demasiado grande
47 GB
4× · 17 GB libres
28 GB
2× · 4,4 GB libres
Qwen3 32B
Alibaba
32,8 mil M
79 GB
Demasiado grande
43 GB
4× · 21 GB libres
25 GB
2× · 6,8 GB libres
Gemma 4 31B
Google
31,3 mil M
75 GB
Ajustado en 4× · 2 % libre
41 GB
4× · 23 GB libres
24 GB
2× · 8 GB libres
GLM-4.7 Flash
Z.ai
31,2 mil M
75 GB
Ajustado en 4× · 2 % libre
41 GB
4× · 23 GB libres
24 GB
2× · 8 GB libres
Qwen3.6 27B
Alibaba
27,8 mil M
67 GB
Ajustado en 4× · 15 % libre
37 GB
4× · 27 GB libres
o 2× · 4 % libre
21 GB
2× · 11 GB libres
Mistral Small 3.2 24B
Mistral AI
24 mil M
58 GB
4× · 6,4 GB libres
32 GB
Cabe justo en 2×
18 GB
2× · 14 GB libres
o 1× · 4 % libre
gpt-oss-20b
OpenAI
21 mil M
3,6 mil M activos
No publicado
No publicado
17 GB
2× · 15 GB libres
o 1× · 16 % libre
Gemma 3 12B
Google
12,2 mil M
29 GB
2× · 2,8 GB libres
16 GB
2× · 16 GB libres
o 1× · 19 % libre
9,4 GB
1× · 6,6 GB libres
Granite 4.1 8B
IBM
8,8 mil M
21 GB
2× · 11 GB libres
12 GB
1× · 4,4 GB libres
6,8 GB
1× · 9,2 GB libres
Qwen3 8B
Alibaba
8,2 mil M
20 GB
2× · 12 GB libres
11 GB
1× · 5,2 GB libres
6,3 GB
1× · 9,7 GB libres
Llama 3.1 8B Instruct
Meta
8 mil M
19 GB
2× · 13 GB libres
11 GB
1× · 5,4 GB libres
6,2 GB
1× · 9,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2 mil M
17 GB
2× · 15 GB libres
o 1× · 10 % libre
9,6 GB
1× · 6,4 GB libres
5,6 GB
1× · 10 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos · Empezar por el modelo

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánto cuesta la T4 por hora?
La T4 empieza en 0,11 € por GPU-hora, con una mediana de 0,16 € entre 8 configuraciones disponibles. El precio real depende del proveedor, la región y de si alquilas on-demand, spot o reservado.
¿Qué proveedores cloud ofrecen la T4?
3 proveedores ofrecen actualmente la T4: Omega Gradient, Vast.ai, Theta EdgeCloud. Compara sus precios por hora, regiones y especificaciones en la tabla de arriba.
¿Cuánta VRAM tiene la T4?
La T4 cuenta con 16 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la T4?
Con 16 GB de VRAM, una sola T4 puede servir modelos como Gemma 3 12B, Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.
¿Cuál es el LLM más grande que puedo ejecutar en varias T4?
Los modelos más grandes que registramos y que caben repartidos entre varias T4 son Qwen3.6 35B-A3B en 2 GPUs a 4 bits, Qwen3 32B en 2 GPUs a 4 bits, Gemma 4 31B en 2 GPUs a 4 bits. En una configuración multi-GPU alquilas y pagas todas las tarjetas durante toda la ejecución, y repartir un modelo entre varias tarjetas también cuesta rendimiento: las GPU intercambian activaciones en cada token, así que el rendimiento depende de la velocidad de la conexión entre ellas. No registramos el interconnect, así que consulta las especificaciones del nodo del proveedor. La tabla anterior indica la configuración más pequeña de cada modelo con precisión de 16, 8 y 4 bits.
¿Dónde es más barata la T4?
El precio on-demand más bajo que registramos actualmente para la T4 es 0,11 € por GPU-hora en Omega Gradient. Como los proveedores actualizan precios y disponibilidad con frecuencia, consulta la tabla en vivo de arriba antes de lanzar.