Instalar Ollama en 5 minutos (Windows, macOS, Linux)
Para instalar Ollama, descarga el instalador en ollama.com (Windows, macOS 14 o posterior) o ejecuta el comando oficial de curl en Linux, luego escribe ollama run seguido del nombre de un modelo. Calcula 5 minutos para realizar estos pasos, sin contar la descarga del modelo. No se requiere ninguna GPU: la memoria disponible determina el tamaño del modelo que puedes ejecutar.
Esta página cubre la instalación de Ollama en los tres sistemas, lo que hay que verificar antes de empezar, qué modelo ejecutar primero y los pocos ajustes que evitan sorpresas desagradables: dónde se almacenan los modelos, cómo liberar memoria y qué permanece en tu equipo. Los detalles específicos de cada sistema se encuentran en una guía dedicada.
#Instalar Ollama: la versión corta para cada sistema
Ollama es un motor que descarga modelos de lenguaje de peso abierto y los ejecuta en tu máquina, con una interfaz de línea de comandos y una API local. Su instalación se realiza en una sola etapa en cada sistema. En Windows y macOS, descargas una aplicación desde ollama.com/download; en Linux, un script oficial instala el programa y el servicio. Luego, el comando ollama run suivie con el nombre de un modelo descarga dicho modelo en el primer llamado y abre una conversación.
| Sistema | Método | Requisitos anunciados por Ollama |
|---|---|---|
| Windows | Instalador OllamaSetup.exe, o comando de PowerShell irm https://ollama.com/install.ps1 | iex | Windows 10 22H2 o más reciente; controlador NVIDIA 551.61 o más reciente si tienes una tarjeta NVIDIA |
| macOS | El archivo ollama.dmg se arrastra a Aplicaciones, o se instala con brew install ollama | macOS 14 Sonoma o una versión más reciente; chip Apple M (CPU y GPU) o x86 (solo CPU) |
| Linux | curl -fsSL https://ollama.com/install.sh | sh | Controlador NVIDIA 550 o más reciente (o ROCm v7 para AMD) si se desea aceleración GPU |
En los tres casos, el servidor escucha en http://localhost:11434 y el comando ollama está disponible en el terminal. Las secciones siguientes detallan cada sistema sin repetir las guías específicas paso a paso y luego pasan al primer modelo.
#Requisitos previos: qué máquina, qué tamaño de modelo
Tu ChatGPT privado y gratuito en tu máquina en 1 hora — LM Studio, Ollama, Open WebUI, tus documentos, sin nube.
- Espacio en línea de por vida
- PDF + archivos
- Actualizaciones de por vida
Ollama se inicia en casi cualquier máquina reciente; lo que varía es el tamaño de modelo aceptable. El factor limitante es la memoria disponible para los pesos: la VRAM de una tarjeta gráfica dedicada, la memoria unificada de un Mac Apple Silicon o, en su defecto, la RAM del sistema, usando entonces solo el procesador y con respuestas más lentas.
| Tamaño del modelo | Memoria para los pesos | Equipo razonable para empezar |
|---|---|---|
| 3B | alrededor de 2 GB | PC con 8 GB de RAM, sin GPU |
| 7-8B | aproximadamente 5 GB | 16 GB de RAM, o GPU de 8 GB |
| 14B | alrededor de 9 GB | GPU de 12 GB, o Mac de 16 GB |
| 32B | alrededor de 19-20 GB | GPU de 24 GB, o Mac de 32 GB |
| 70B | aproximadamente 40 GB | Mac de 64 GB o más, o varios GPUs |
Estas cifras solo incluyen los pesos. Hay que sumar el contexto (caché KV), que crece con la longitud de la conversación, y dejar espacio para el sistema: un modelo de 5 GB en una máquina con 8 GB de RAM funciona, pero sin margen para tener también un navegador abierto. Para elegir la cuantización, ver la guía sobre Q4, Q5 y Q8.
En cuanto al disco, la documentación de Ollama indica al menos 4 GB para el programa en Windows, a los que se suman los modelos, que pueden alcanzar decenas o incluso cientos de GB según lo que descargues. Un SSD interno es preferible: cargar un modelo desde un disco externo lento se nota en cada arranque.
#Instalar Ollama en Windows
Ollama funciona como una aplicación nativa de Windows, con soporte para tarjetas NVIDIA y AMD Radeon. Una vez instalado, se ejecuta en segundo plano y el comando ollama pasa a estar disponible en cmd, PowerShell o cualquier otro terminal. La instalación no requiere permisos de administrador y se realiza por defecto en tu carpeta personal.
- 01DescargarEn ollama.com/download, elige Windows y descarga OllamaSetup.exe. La página también ofrece el comando PowerShell irm https://ollama.com/install.ps1 | iex, que tiene el mismo efecto.
- 02Ejecutar el instaladorHaz doble clic en el archivo. Para instalarlo en una ubicación distinta de la carpeta personal, ejecútalo con el parámetro /DIR seguido de la ruta, por ejemplo OllamaSetup.exe /DIR="d:\dossier".
- 03VerificarAbre PowerShell y escribe ollama --version. También aparece un icono de Ollama en la zona de notificaciones, cerca del reloj.
- 04Verificar el controlador GPUCon una tarjeta NVIDIA, la documentación exige el controlador 551.61 o más reciente. Para una tarjeta AMD, se necesita o bien la pila ROCm v7 o bien un controlador Radeon compatible con Vulkan.
Para el paso a paso completo y la solución de problemas específicos de Windows, consulta la guía dedicada a Windows 11.
#Instalar Ollama en macOS
Ollama requiere macOS 14 Sonoma o una versión más reciente. Los chips Apple M se benefician del procesamiento en la GPU; los Mac con procesador Intel (x86) solo funcionan con la CPU, lo que los limita a modelos muy pequeños. El método recomendado en la documentación es montar el archivo ollama.dmg y arrastrar la aplicación a la carpeta Applications del sistema.
- Aplicación oficial
- Al primer arranque, la aplicación verifica que el comando ollama esté en tu PATH y, en caso contrario, pide permiso para crear un enlace en /usr/local/bin.
- Homebrew
- Existe una fórmula ollama en Homebrew (brew install ollama): es la opción del terminal para quienes ya tienen Homebrew, sin necesidad de usar el archivo .dmg.
- Memoria unificada
- En Apple Silicon, CPU y GPU comparten la misma memoria: un Mac de 16 GB puede cargar un modelo de 14B en Q4, mientras que un PC con una tarjeta de 8 GB de VRAM no lo podría hacer.
La guía dedicada a macOS detalla la elección del modelo según la memoria del Mac y los ajustes útiles en Apple Silicon.
#Instalar Ollama en Linux
En Linux, un comando basta. El script oficial descarga el programa y lo configura como servicio.
La documentación también ofrece una instalación manual: extracción del archivo ollama-linux-amd64.tar.zst en /usr (o del archivo arm64 para máquinas ARM), archivo ROCm adicional para tarjetas AMD, luego creación de un usuario y un servicio systemd si deseas un arranque automático. Para actualizar, simplemente vuelve a ejecutar el script de instalación; la variable OLLAMA_VERSION permite instalar una versión específica.
Para una tarjeta NVIDIA, instala el controlador y comprueba con nvidia-smi que aparezca tu tarjeta. Para una tarjeta AMD, la documentación exige el controlador ROCm v7. La guía específica de Linux detalla systemd, los permisos y las variables de entorno.
#Ejecutar tu primer modelo
Una vez instalado Ollama, ollama run t descarga el modelo solicitado si no está presente, luego abre una conversación en el terminal. La primera llamada depende de tu conexión: un modelo de 3 a 5 GB tarda unos minutos, y los archivos permanecen luego en el disco. Las llamadas siguientes arrancan sin nuevo descarga, solo se realiza el cargado en memoria.
La familia Qwen 3.5 se publica en ollama.com en tamaños de 0.8b a 122b, con visión, herramientas y razonamiento según las versiones. La etiqueta 4b cabe en unos pocos GB en Q4, por lo que funciona en casi cualquier máquina. Si dispones de 16 GB de memoria, prueba un modelo de 8-9B; la tabla anterior te da la referencia. Las páginas de selección por VRAM del sitio te ayudan a afinar.
#Comandos que debes conocer tras la instalación
- ollama list
- Muestra los modelos descargados y su tamaño en disco.
- ollama pull nom
- Descarga un modelo sin ejecutarlo, útil para preparar varios modelos antes de un viaje.
- ollama ps
- Muestra los modelos cargados en memoria y si cada uno se ejecuta en GPU o en CPU.
- ollama stop nom
- Descarga un modelo de la memoria sin esperar los 5 minutos predeterminados.
- ollama rm nom
- Elimina un modelo para liberar espacio en disco.
- ollama serve
- Inicia el servidor a mano, útil bajo Linux si el servicio no está activo.
Para continuar (actualización, eliminación completa de Ollama y de sus modelos), consulta la guía de mantenimiento de Ollama.
#¿Dónde se almacenan los modelos y cómo se trasladan?
Los modelos pueden alcanzar fácilmente varias decenas de GB, y el disco del sistema rara vez es el mejor lugar. Las preguntas frecuentes oficiales indican su ubicación predeterminada: ~/.ollama/models en macOS, /usr/share/ollama/.ollama/models en Linux, C:\Users\%username%\.ollama\models en Windows.
Para moverlos, establece como valor de la variable de entorno OLLAMA_MODELS la ruta de la carpeta deseada. En Windows, cierra Ollama desde el área de notificación, abre las variables de entorno de tu cuenta, crea la variable y vuelve a iniciar la aplicación. En Linux, con la instalación estándar, el usuario ollama debe tener permisos de lectura y escritura en esa carpeta: la documentación propone sudo chown -R ollama:ollama seguido de la ruta de la carpeta.
#Confidencialidad: lo que permanece en local
En modo local, las consultas y respuestas permanecen en tu máquina: la FAQ de Ollama indica que la empresa no ve tus prompts ni tus datos cuando ejecutas un modelo localmente. Los modelos llamados en la nube son diferentes: pasan por los servidores de Ollama. Si deseas un uso estrictamente local, la documentación describe un modo exclusivamente local: la variable OLLAMA_NO_CLOUD=1, o la configuración disable_ollama_cloud en ~/.ollama/server.json. Reinicia luego Ollama.
Por defecto, el servidor solo escucha en 127.0.0.1, puerto 11434: nadie más en tu red puede acceder a él. Cambiar OLLAMA_HOST a 0.0.0.0 lo expone a toda la red local sin autenticación. Solo hacerlo detrás de un firewall o un proxy.
#Solución de problemas: cinco problemas frecuentes
- Comando no encontrado
- Cierra y vuelve a abrir el terminal: el instalador acaba de modificar el PATH. En macOS, vuelve a iniciar la aplicación para que te ofrezca el enlace /usr/local/bin.
- GPU no utilizada
- Ejecuta un modelo y después ollama ps: la columna del procesador indica GPU o CPU. Actualiza el controlador (NVIDIA 551.61 como mínimo en Windows, 550 en Linux) y vuelve a iniciar Ollama.
- Tarjeta AMD no reconocida en Windows
- La documentación indica que algunos sistemas RDNA2 (RX 6000) no exponen ROCm v7 en Windows. Vulkan, activado por defecto, es entonces la alternativa recomendada.
- Puerto 11434 ocupado
- Otra instancia de Ollama ya está en ejecución, u otro programa está usando el puerto. Cierra la aplicación y vuelve a iniciarla.
- Descarga bloqueada tras un proxy
- Utiliza HTTPS_PROXY y evita HTTP_PROXY, que puede interferir con las conexiones del cliente según las preguntas frecuentes; el certificado del proxy debe instalarse como certificado del sistema.
¿Cómo instalar Ollama en Windows 10?+
¿Ollama es gratuito?+
¿Se necesita una tarjeta gráfica para usar Ollama?+
¿Dónde almacena Ollama los modelos?+
¿Envía Ollama mis conversaciones a Internet?+
¿Cómo saber si Ollama utiliza mi GPU?+
- Instalar Ollama en Windows 11: guía completa
- Instalar Ollama en macOS (Apple Silicon)
- Instalar Ollama en Linux
- Ollama con Docker
- Elegir tu cuantización
- Ollama : actualizar, eliminar, desinstalar
- Fuente: documentación de Ollama para Windows
- Fuente: documentación de Ollama para macOS
- Fuente: documentación de Ollama para Linux
- Fuente: Preguntas frecuentes de Ollama
¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.