Instalar Ollama en macOS (Apple Silicon): guía 2026
Los Mac Apple Silicon (M1, M2, M3, M4) están entre los mejores equipos de consumo para la IA local. La memoria unificada permite que un MacBook Pro de 64 GB ejecute modelos de 70B que quedan muy lejos del alcance de un PC gamer de 2 000 €. Así puedes empezar en 3 minutos.
#¿Por qué un Mac para la IA local?
En un PC convencional, la VRAM de la GPU está físicamente separada de la RAM de la CPU. ¿Tienes una RTX 4070 de 12 GB? Estás limitado a 12 GB para tus modelos, independientemente de tus 64 GB de RAM del sistema.
En un Mac con Apple Silicon, la memoria es unificada: GPU, CPU y Neural Engine comparten la misma RAM. Un MacBook Pro M3 Max de 64 GB puede asignar 48 GB a un modelo, suficiente para cargar un MoE grande como Qwen 3.6 35B-A3B con precisión completa o ejecutar varios modelos a la vez, sin esfuerzo.
#Prerrequisitos
Ollama funciona en tu Mac. El kit Mac lo convierte en un servicio confiable —arranque automático, red, registros (cap. 7)—, le conecta Open WebUI (cap. 8) y te explica qué cambia la memoria unificada a la hora de elegir el modelo (cap. 2).
- Espacio en línea de por vida
- PDF + archivos
- Actualizaciones de por vida
- macOS 12 Monterey o más reciente
- Sonoma (14) o Sequoia (15) recomendados para las últimas optimizaciones de Metal.
- Mac Apple Silicon
- M1, M2, M3 o M4 — pro, max, ultra, da igual. Los Mac con Intel no tienen soporte oficial (funcionamiento lento).
- 16 GB de RAM como mínimo
- 8 GB bastan para un 3B, pero queda poco margen. 16 GB permiten ejecutar modelos de 8-9B, 32 GB los MoE de 30B (tipo Qwen 3.6 35B-A3B) y 64 GB los modelos grandes en precisión completa.
- ~20 GB de espacio en disco
- Para 3-4 modelos. Las descargas se guardan en ~/.ollama/models.
#1. Instalación
Dos métodos, ambos ofrecen una instalación limpia: el .dmg oficial o Homebrew. Los desarrolladores preferirán Homebrew; los demás optarán por lo más sencillo.
#Opción A — Aplicación .dmg
- 01Abre el .dmg descargadoArrastra Ollama.app a tu carpeta Aplicaciones, como cualquier otra app de Mac.
- 02Inicia Ollama.app una vezAl abrir la aplicación por primera vez, macOS pide confirmación ("aplicación descargada desde internet"). Haz clic en Abrir.
- 03Autoriza la herramienta de línea de comandosOllama ofrece instalar el comando ollama. Acepta: se te pedirá una contraseña de administrador.
- 04El icono de la llama aparece en la barra de menúsEs el demonio. Puedes cerrar la ventana de bienvenida; seguirá funcionando.
#Opción B — Homebrew
Más rápido de actualizar. Ventaja: ejecuta brew upgrade ollama cuando salga una nueva versión.
#Verificación
#2. Tu primer modelo
En un Mac con 16 GB, empieza por Qwen 3.5 9B o Granite 4.2 8B. Con 32 GB o más, puedes optar directamente por Qwen 3.8 27B o por un MoE rápido como Qwen 3.6 35B-A3B.
#3. Comprender la memoria unificada
macOS asigna dinámicamente la RAM entre las aplicaciones. Cuando Ollama carga un modelo, el sistema mueve automáticamente otras cosas al swap si es necesario. Por lo tanto, puedes cargar modelos más grandes de lo habitual, a costa de una ralentización general.
Para supervisar esto en tiempo real mientras un modelo se ejecuta:
#4. Verificar la aceleración Metal
Metal es el equivalente de CUDA en Apple: la API que permite a Ollama ejecutar los cálculos en la GPU integrada del Mac. Está activado por defecto, pero conviene comprobarlo.
En la columna PROCESSOR, debes ver 100% GPU. Si ves CPU, algo va mal: se trata de un modelo no compatible o de un controlador de Metal demasiado antiguo.
#5. Una interfaz similar a ChatGPT
Para un uso diario, trabajar con el terminal resulta cansado enseguida. Tres buenas opciones en Mac:
- Enchanted (gratuito, App Store)
- El más cuidado en cuanto a diseño. Nativo, desarrollado con SwiftUI, se conecta a Ollama sin configuración.
- Msty (gratuito, .dmg)
- Más completo: múltiples modelos, pestañas, prompts guardados, RAG integrado.
- Open WebUI a través de Docker
- Si ya tienes Docker, esta es la versión más completa (historial, markdown, extensiones).
#6. Ollama al inicio
Por defecto, Ollama se inicia con tu sesión si lo has instalado mediante el .dmg. Con Homebrew, el inicio es manual:
Para desactivar: brew services stop ollama. Para ver el estado: brew services list.
#Solución de problemas
- "ollama : command not found" después de instalar
- El enlace simbólico no se creó. Ejecuta Ollama.app una vez y acepta la propuesta de instalar la CLI.
- El modelo se bloquea a mitad de camino
- Memoria insuficiente. Cierra Chrome/Electron y vuelve a intentarlo. Si no basta, elige una cuantización que ocupe menos memoria.
- Ventiladores a plena potencia en MacBook
- Es normal durante la inferencia intensiva. Para reducirlo: utiliza un modelo más pequeño o conecta el MacBook a la corriente (los MacBook reducen el rendimiento cuando funcionan con batería).
- Imposible eliminar Ollama
- Detén el daemon: ollama stop. Luego elimina Ollama.app y el directorio ~/.ollama (contiene todos los modelos descargados).
¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.