¿Qué LLM en MacBook Pro M1 Pro / Max (16–64 GB)? ?
Lanzado a finales de 2021, el MacBook Pro M1 Pro / Max sigue siendo en 2026 una máquina destacada para la IA local, especialmente en la versión Max de 64 GB. Ancho de banda de 200 a 400 GB/s, ventiladores activos (sin throttling), hasta 64 GB de memoria unificada: un MoE Qwen 3.6 35B funciona a ~34 tokens/segundo y un modelo de 30B cabe en Q8 con plena calidad, algo imposible en un portátil de consumo equivalente. Esta guía detalla cómo aprovechar esta máquina hoy.
¿Estás eligiendo un equipo? Nuestras opciones por presupuesto →
Alternativa de compra para esta guía: MacBook Pro M5 Pro — 24 GB / 1 TB.
Comparar todas las opciones por presupuesto, de 800 a 3 500 € →
Cuando te desplazas: qué portátil elegir para la IA local →
Enlaces de afiliados — posible comisión sin coste adicional para ti. Como socio de Amazon, QuelLLM obtiene un beneficio de las compras que cumplen las condiciones requeridas.
#MBP M1 Pro / Max en 2026
- Fecha de lanzamiento
- Octubre de 2021. Sigue siendo compatible con macOS Sequoia (15) en 2026.
- M1 Pro
- 8 o 10 núcleos de CPU + 14 o 16 núcleos de GPU, ancho de banda 200 GB/s, RAM 16 o 32 GB.
- M1 Max
- 10 núcleos de CPU + 24 o 32 núcleos de GPU, ancho de banda de 400 GB/s, RAM de 32 o 64 GB.
- Refrigeración
- Ventiladores activos: sin reducción del rendimiento por temperatura al usar LLM. Puede funcionar durante 24 horas seguidas.
- Valor de segunda mano en 2026
- MBP M1 Pro y M1 Max: de segunda mano, precio variable según estado
#1. M1 Pro vs M1 Max: elegir
- M1 Pro (200 GB/s)
- Excelente para modelos de 8 a 12B. Un MoE de 30-35B (Qwen 3.6 35B-A3B) cabe en la versión de 32 GB, pero no en 16 GB.
- M1 Max (400 GB/s)
- 2× el ancho de banda = 2× la velocidad de inferencia en modelos ≥ 13B. Imprescindible para ejecutar un 30B en Q8 con calidad plena.
- Núcleos GPU
- El M1 Max de 32 núcleos es un 15-20 % más rápido que el de 24 núcleos con modelos de 8B. La diferencia se amplía con los modelos de 27-35B.
#2. 16, 32, 64 GB: qué modelos
| Modelo | Quant | RAM del modelo | M1 Pro 16 GB | M1 Pro 32 GB | M1 Max 64 GB |
|---|---|---|---|---|---|
| Qwen 3.5 9B | Q5_K_M | 7 GB | 28 | 31 | 43 |
| Granite 4.2 8B | Q5_K_M | 6 GB | 30 | 34 | 47 |
| Gemma 4 12B | Q5_K_M | 9 GB | 18 | 21 | 30 |
| Qwen 3.8 27B | Q4_K_M | 18 GB | — | 11 | 18 |
| Mistral Small 24B | Q5_K_M | 16 GB | — | 10 | 18 |
| Qwen 3.6 35B-A3B (MoE) | Q4_K_M | 23 GB | — | 22 | 34 |
| Qwen3-Coder 30B-A3B | Q8_0 | 32 GB | — | — | 24 |
#3. Pruebas de rendimiento en tokens/s
| Modelo | Q4_K_M | Q5_K_M | Q8_0 |
|---|---|---|---|
| Qwen 3.5 9B | 46 t/s | 43 t/s | 28 t/s |
| Granite 4.2 8B | 50 t/s | 47 t/s | 30 t/s |
| Gemma 4 12B | 32 t/s | 30 t/s | 19 t/s |
| Qwen 3.8 27B | 18 t/s | 16 t/s | 10 t/s |
| Qwen 3.6 35B-A3B | 34 t/s | — | 22 t/s |
#4. Instalación y configuración
#5. Identificar el límite de memoria del GPU
En un MBP M1 Max de 64 GB, macOS asigna por defecto ~43 GB a la GPU. Para cargar un modelo de 30-35B en Q8 (~35 GB) con un contexto ampliado —la caché KV de un contexto de 256k puede superar por sí sola los 10 GB—, el conjunto supera rápidamente los 43 GB y es necesario aumentar el límite.
Tu MacBook Pro M1 puede ejecutar más de lo que crees. El kit Mac muestra cómo ampliar el límite de memoria de la GPU (cap. 2), elegir el modelo adecuado para tu chip (cap. 4) y solucionar lo que falla: Metal, memoria, swap (cap. 14).
- Espacio en línea de por vida
- PDF + archivos
- Reembolsado 30 j
#6. Ejecutar un modelo grande de 2026 en M1 Max
El MBP M1 Max de 64 GB ejecuta los modelos más grandes de 2026 con toda su calidad: un MoE de 30-35B en Q8, o varios modelos cargados en paralelo. Esta es la configuración óptima:
#¿Cambiar a M3 Max o M4 Max?
- M3 Max 16-core (2023)
- Un 50 % más de velocidad pura frente al M1 Max. Hasta 128 GB de RAM (frente a 64 GB). Justifica la actualización si quieres que un MoE de 30-35B supere los 50 tok/s.
- M4 Max 16-core (2024)
- +90 % frente al M1 Max, ancho de banda de 546 GB/s. 128 GB de RAM. El mejor portátil Mac para LLM en 2026.
- Seguir con el M1 Max de 64 GB
- Completamente viable: MoE 35B a ~34 tok/s, 27B denso a 18 tok/s. No hay razón para actualizar antes de 2027 si la velocidad actual te satisface.
#Preguntas frecuentes
¿MBP M1 Pro 16 GB o M1 Max 32 GB para IA local?+
¿Se puede ejecutar un modelo grande en un MBP M1 Max de 32 GB?+
¿El MBP M1 Pro es mejor que un PC con RTX 3060 para los LLM?+
¿Los ventiladores giran a altas revoluciones durante la inferencia de un LLM?+
¿Conviene elegir la pantalla de 16" o la de 14" para los LLM?+
¿Ollama o MLX en un MBP M1 Max?+
¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.