RTX 4090 vs RTX 4080 Super: ¿qué GPU elegir para la IA local?
Comparativa orientada a LLM en local : miramos lo que realmente importa para ejecutar modelos: la VRAM ante todo, luego la generación y el precio. Veredicto de compra al final.
Actualizado el 09/10/2026
Comparativa de un vistazo
| Criterio | RTX 4090 | RTX 4080 Super |
|---|---|---|
| Memoria | 24 GB de VRAM | 16 GB VRAM |
| Marca | NVIDIA | NVIDIA |
| Modelos compatibles (Q4) | 178 modelos del catálogo | 143 modelos del catálogo |
| Modelo más grande (Q4) | Salamandra 40B Instruct (40B) | Qwen 3.8 27B Obliterated (28B) |
¿Cuál elegir para ejecutar un LLM?
Regla de oro: a igual presupuesto, elige siempre la GPU con más VRAM. Un modelo que no cabe en la VRAM pierde drásticamente velocidad (offload a la CPU). La VRAM determina el tamaño del modelo; la potencia de cálculo determina sobre todo la velocidad.
Dónde comprar (precios y stock actualizados)
Alternativa de compra: GMKtec EVO-X2 64 GB / 1 TB (Ryzen AI Max+ 395). Un mini-PC es una máquina completa, no una tarjeta de reemplazo; verifica la memoria y la compatibilidad de software.
Opción de compra: RTX 5080 16 GB
Enlaces de afiliación — QuéLLM puede percibir una comisión por las compras, sin coste adicional para ti, lo que no influye en esta comparativa (establecida de forma independiente). Como socio de Amazon, QuéLLM obtiene beneficios de las compras que cumplen las condiciones requeridas.
Preguntas frecuentes
¿RTX 4090 o RTX 4080 Super para ejecutar un LLM localmente?
Para uso local, la VRAM prima. La RTX 4090 (24 GB) ejecuta modelos más grandes que la RTX 4080 Super (16 GB).
¿Cuál es el modelo más grande que la RTX 4090 puede ejecutar?
Hasta Salamandra 40B Instruct (40B) en cuantización Q4, con sus 24 GB.
¿Conviene comprar de segunda mano?
Para los LLM, una GPU de segunda mano con más VRAM suele superar a una tarjeta nueva más reciente pero con menos VRAM. Verifica el estado y la garantía.