Principiante 3 minOllama

Instalar Ollama en macOS (Apple Silicon): guía 2026

Los Mac Apple Silicon (M1, M2, M3, M4) están entre los mejores equipos de consumo para la IA local. La memoria unificada permite que un MacBook Pro de 64 GB ejecute modelos de 70B que quedan muy lejos del alcance de un PC gamer de 2 000 €. Así puedes empezar en 3 minutos.

Por Mohamed Meguedmi·Actualización 2026-08-27·Probado en macOS 14+

#¿Por qué un Mac para la IA local?

En un PC convencional, la VRAM de la GPU está físicamente separada de la RAM de la CPU. ¿Tienes una RTX 4070 de 12 GB? Estás limitado a 12 GB para tus modelos, independientemente de tus 64 GB de RAM del sistema.

En un Mac con Apple Silicon, la memoria es unificada: GPU, CPU y Neural Engine comparten la misma RAM. Un MacBook Pro M3 Max de 64 GB puede asignar 48 GB a un modelo, suficiente para cargar un MoE grande como Qwen 3.6 35B-A3B con precisión completa o ejecutar varios modelos a la vez, sin esfuerzo.

→
Regla práctica
macOS reserva aproximadamente un 25 % de la RAM para el sistema. En un Mac de 16 GB, cuenta con ~12 GB disponibles. En 32 GB: ~24 GB. En 64 GB: ~48 GB.

#Prerrequisitos

El kit Mac

Ollama funciona en tu Mac. El kit Mac lo convierte en un servicio confiable —arranque automático, red, registros (cap. 7)—, le conecta Open WebUI (cap. 8) y te explica qué cambia la memoria unificada a la hora de elegir el modelo (cap. 2).

  • Espacio en línea de por vida
  • PDF + archivos
  • Actualizaciones de por vida
macOS 12 Monterey o más reciente
Sonoma (14) o Sequoia (15) recomendados para las últimas optimizaciones de Metal.
Mac Apple Silicon
M1, M2, M3 o M4 — pro, max, ultra, da igual. Los Mac con Intel no tienen soporte oficial (funcionamiento lento).
16 GB de RAM como mínimo
8 GB bastan para un 3B, pero queda poco margen. 16 GB permiten ejecutar modelos de 8-9B, 32 GB los MoE de 30B (tipo Qwen 3.6 35B-A3B) y 64 GB los modelos grandes en precisión completa.
~20 GB de espacio en disco
Para 3-4 modelos. Las descargas se guardan en ~/.ollama/models.

#1. Instalación

Dos métodos, ambos ofrecen una instalación limpia: el .dmg oficial o Homebrew. Los desarrolladores preferirán Homebrew; los demás optarán por lo más sencillo.

#Opción A — Aplicación .dmg

Descarga oficial
https://ollama.com/download/mac
  1. 01
    Abre el .dmg descargado
    Arrastra Ollama.app a tu carpeta Aplicaciones, como cualquier otra app de Mac.
  2. 02
    Inicia Ollama.app una vez
    Al abrir la aplicación por primera vez, macOS pide confirmación ("aplicación descargada desde internet"). Haz clic en Abrir.
  3. 03
    Autoriza la herramienta de línea de comandos
    Ollama ofrece instalar el comando ollama. Acepta: se te pedirá una contraseña de administrador.
  4. 04
    El icono de la llama aparece en la barra de menús
    Es el demonio. Puedes cerrar la ventana de bienvenida; seguirá funcionando.

#Opción B — Homebrew

Terminal
brew install --cask ollama

Más rápido de actualizar. Ventaja: ejecuta brew upgrade ollama cuando salga una nueva versión.

#Verificación

Terminal
ollama --version

#2. Tu primer modelo

En un Mac con 16 GB, empieza por Qwen 3.5 9B o Granite 4.2 8B. Con 32 GB o más, puedes optar directamente por Qwen 3.8 27B o por un MoE rápido como Qwen 3.6 35B-A3B.

Qwen 3.5 9B (todas las configuraciones ≥16 GB)
ollama run qwen3.5:9b
Granite 4.2 8B (≥16 GB para usarlo con holgura)
ollama run granite4.2:8b
Qwen 3.8 27B (≥32 GB recomendados)
ollama run qwen3.8:27b
Qwen 3.6 35B-A3B MoE (≥32 GB, cómodo en 64 GB)
ollama run qwen3.6:35b
i
Primera descarga
El modelo se descarga a través de la CDN de Ollama (varios GB). Calcula entre 2 y 10 minutos según tu conexión. Los siguientes arranques son instantáneos.

#3. Comprender la memoria unificada

macOS asigna dinámicamente la RAM entre las aplicaciones. Cuando Ollama carga un modelo, el sistema mueve automáticamente otras cosas al swap si es necesario. Por lo tanto, puedes cargar modelos más grandes de lo habitual, a costa de una ralentización general.

Para supervisar esto en tiempo real mientras un modelo se ejecuta:

Monitor de memoria
top -o mem
!
Swap excesivo = lentitud
Si ves más de 10 GB de swap activo mientras Ollama está funcionando, tu modelo es demasiado grande para tu Mac. Pasa a un modelo de menor tamaño o elige una cuantización más agresiva (Q3 en lugar de Q4).

#4. Verificar la aceleración Metal

Metal es el equivalente de CUDA en Apple: la API que permite a Ollama ejecutar los cálculos en la GPU integrada del Mac. Está activado por defecto, pero conviene comprobarlo.

Estado del modelo cargado
ollama ps

En la columna PROCESSOR, debes ver 100% GPU. Si ves CPU, algo va mal: se trata de un modelo no compatible o de un controlador de Metal demasiado antiguo.

Consumo de GPU en directo
sudo powermetrics --samplers gpu_power -i 500

#5. Una interfaz similar a ChatGPT

Para un uso diario, trabajar con el terminal resulta cansado enseguida. Tres buenas opciones en Mac:

Enchanted (gratuito, App Store)
El más cuidado en cuanto a diseño. Nativo, desarrollado con SwiftUI, se conecta a Ollama sin configuración.
Msty (gratuito, .dmg)
Más completo: múltiples modelos, pestañas, prompts guardados, RAG integrado.
Open WebUI a través de Docker
Si ya tienes Docker, esta es la versión más completa (historial, markdown, extensiones).
Enchanted en 1 línea
open 'macappstore://apps.apple.com/app/enchanted-llm/id6474268307'

#6. Ollama al inicio

Por defecto, Ollama se inicia con tu sesión si lo has instalado mediante el .dmg. Con Homebrew, el inicio es manual:

Inicio automático mediante brew services
brew services start ollama

Para desactivar: brew services stop ollama. Para ver el estado: brew services list.

#Solución de problemas

"ollama : command not found" después de instalar
El enlace simbólico no se creó. Ejecuta Ollama.app una vez y acepta la propuesta de instalar la CLI.
El modelo se bloquea a mitad de camino
Memoria insuficiente. Cierra Chrome/Electron y vuelve a intentarlo. Si no basta, elige una cuantización que ocupe menos memoria.
Ventiladores a plena potencia en MacBook
Es normal durante la inferencia intensiva. Para reducirlo: utiliza un modelo más pequeño o conecta el MacBook a la corriente (los MacBook reducen el rendimiento cuando funcionan con batería).
Imposible eliminar Ollama
Detén el daemon: ollama stop. Luego elimina Ollama.app y el directorio ~/.ollama (contiene todos los modelos descargados).
¿Esta guía te ha ayudado?

¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.