Volver a todas las ofertas

NVIDIA Quadro RTX 4000

8 GB VRAM160 W TDP0 proveedores0 ofertas0 regiones

La NVIDIA Quadro RTX 4000 es una GPU de nivel empresarial basada en la arquitectura Turing y cuenta con 8 GB de memoria con 416 GB/s de ancho de banda de memoria y un TDP de 160 W. Ofrece 7,1 TFLOPS de rendimiento FP32.

Más barato
Sin ofertas actuales
Mediana
en 0 ofertas
Más caro
Tendencia 90 días
-75.0%
tarifa mediana

Especificaciones de hardware

Iguales en todos los proveedores

Memoria
8 GB
GDDR6X
¿Qué LLM caben? ↓
TDP
160 W
Ancho de banda de memoria
416 GB/s
Arquitectura
Turing
Rendimiento FP32
7,1 TFLOPS
Marca
NVIDIA
Serie
Quadro RTX
Histórico de precios del mercado

Precio mediano entre todos los proveedores

Precios actualizados ahora

0 ofertas de 0 proveedores

Ordenadas por precio ascendente. Compara configuraciones lado a lado.

ProveedorCantidadvCPURAMRegiónPor GPU/hTotal/hAcción
Amplía tus filtros o limpia todos los filtros para volver a empezar.

LLM que caben en la NVIDIA Quadro RTX 4000

VRAM estimada para LLM populares de pesos abiertos con precisión de 16 bits (FP16/BF16), 8 bits (FP8/INT8) y 4 bits (INT4/MXFP4), con 8 GB por GPU.

ModeloParámetros16 bits8 bits4 bits
Gemma 3 12B
Google
12,2 mil M
29 GB
Demasiado grande
16 GB
Demasiado grande
9,4 GB
Ajustado en 1× · 2 % libre
Granite 4.1 8B
IBM
8,8 mil M
21 GB
Demasiado grande
12 GB
Demasiado grande
6,8 GB
1× · 1,2 GB libres
Qwen3 8B
Alibaba
8,2 mil M
20 GB
Demasiado grande
11 GB
Demasiado grande
6,3 GB
1× · 1,7 GB libres
Llama 3.1 8B Instruct
Meta
8 mil M
19 GB
Demasiado grande
11 GB
Demasiado grande
6,2 GB
1× · 1,8 GB libres
Mistral 7B Instruct v0.3
Mistral AI
7,2 mil M
17 GB
Demasiado grande
9,6 GB
Ajustado en 1× · 0 % libre
5,6 GB
1× · 2,4 GB libres
Qwen3 4B
Alibaba
4 mil M
9,7 GB
Demasiado grande
5,3 GB
1× · 2,7 GB libres
3,1 GB
1× · 4,9 GB libres

Estimaciones: pesos del modelo más un 20 % para la caché KV y la sobrecarga de ejecución, con contextos cortos. Los contextos largos y los lotes grandes necesitan más. Las filas marcadas como «ajustadas» albergan los pesos, pero no ese margen completo. Una cifra ×N es la VRAM total de N de estas GPU y no afirma nada sobre el rendimiento de la interconexión. Cómo lo estimamos

¿Quieres más de esta página?

¿Datos incorrectos?

Preguntas frecuentes

¿Cuánta VRAM tiene la Quadro RTX 4000?
La Quadro RTX 4000 cuenta con 8 GB de VRAM, lo que determina los modelos y tamaños de lote más grandes que puede mantener en memoria para entrenamiento e inferencia.
¿Qué LLM puedo ejecutar en la Quadro RTX 4000?
Con 8 GB de VRAM, una sola Quadro RTX 4000 puede servir modelos como Granite 4.1 8B, Qwen3 8B, Llama 3.1 8B Instruct, Mistral 7B Instruct v0.3. La tabla anterior indica la VRAM estimada de cada modelo con precisión de 16, 8 y 4 bits, incluidas las configuraciones multi-GPU que necesitan los modelos más grandes.