Principiante 11 minOllama

Instalar Ollama en 5 minutos (Windows, macOS, Linux)

Respuesta directa

Para instalar Ollama, descarga el instalador en ollama.com (Windows, macOS 14 o posterior) o ejecuta el comando oficial de curl en Linux, luego escribe ollama run seguido del nombre de un modelo. Calcula 5 minutos para realizar estos pasos, sin contar la descarga del modelo. No se requiere ninguna GPU: la memoria disponible determina el tamaño del modelo que puedes ejecutar.

Esta página cubre la instalación de Ollama en los tres sistemas, lo que hay que verificar antes de empezar, qué modelo ejecutar primero y los pocos ajustes que evitan sorpresas desagradables: dónde se almacenan los modelos, cómo liberar memoria y qué permanece en tu equipo. Los detalles específicos de cada sistema se encuentran en una guía dedicada.

Por Mohamed Meguedmi·Actualización 2026-09-29·Probado en Windows 11

#Instalar Ollama: la versión corta para cada sistema

Ollama es un motor que descarga modelos de lenguaje de peso abierto y los ejecuta en tu máquina, con una interfaz de línea de comandos y una API local. Su instalación se realiza en una sola etapa en cada sistema. En Windows y macOS, descargas una aplicación desde ollama.com/download; en Linux, un script oficial instala el programa y el servicio. Luego, el comando ollama run suivie con el nombre de un modelo descarga dicho modelo en el primer llamado y abre una conversación.

Instalación de Ollama por sistema (documentación oficial, septiembre de 2026)
SistemaMétodoRequisitos anunciados por Ollama
WindowsInstalador OllamaSetup.exe, o comando de PowerShell irm https://ollama.com/install.ps1 | iexWindows 10 22H2 o más reciente; controlador NVIDIA 551.61 o más reciente si tienes una tarjeta NVIDIA
macOSEl archivo ollama.dmg se arrastra a Aplicaciones, o se instala con brew install ollamamacOS 14 Sonoma o una versión más reciente; chip Apple M (CPU y GPU) o x86 (solo CPU)
Linuxcurl -fsSL https://ollama.com/install.sh | shControlador NVIDIA 550 o más reciente (o ROCm v7 para AMD) si se desea aceleración GPU

En los tres casos, el servidor escucha en http://localhost:11434 y el comando ollama está disponible en el terminal. Las secciones siguientes detallan cada sistema sin repetir las guías específicas paso a paso y luego pasan al primer modelo.

#Requisitos previos: qué máquina, qué tamaño de modelo

El kit de IA Local

Tu ChatGPT privado y gratuito en tu máquina en 1 hora — LM Studio, Ollama, Open WebUI, tus documentos, sin nube.

  • Espacio en línea de por vida
  • PDF + archivos
  • Actualizaciones de por vida

Ollama se inicia en casi cualquier máquina reciente; lo que varía es el tamaño de modelo aceptable. El factor limitante es la memoria disponible para los pesos: la VRAM de una tarjeta gráfica dedicada, la memoria unificada de un Mac Apple Silicon o, en su defecto, la RAM del sistema, usando entonces solo el procesador y con respuestas más lentas.

Memoria orientativa por tamaño del modelo, con cuantización Q4 (solo pesos)
Tamaño del modeloMemoria para los pesosEquipo razonable para empezar
3Balrededor de 2 GBPC con 8 GB de RAM, sin GPU
7-8Baproximadamente 5 GB16 GB de RAM, o GPU de 8 GB
14Balrededor de 9 GBGPU de 12 GB, o Mac de 16 GB
32Balrededor de 19-20 GBGPU de 24 GB, o Mac de 32 GB
70Baproximadamente 40 GBMac de 64 GB o más, o varios GPUs

Estas cifras solo incluyen los pesos. Hay que sumar el contexto (caché KV), que crece con la longitud de la conversación, y dejar espacio para el sistema: un modelo de 5 GB en una máquina con 8 GB de RAM funciona, pero sin margen para tener también un navegador abierto. Para elegir la cuantización, ver la guía sobre Q4, Q5 y Q8.

En cuanto al disco, la documentación de Ollama indica al menos 4 GB para el programa en Windows, a los que se suman los modelos, que pueden alcanzar decenas o incluso cientos de GB según lo que descargues. Un SSD interno es preferible: cargar un modelo desde un disco externo lento se nota en cada arranque.

→
Sin GPU: es posible, pero elige un modelo pequeño
Solo con procesador, un modelo de 3 a 4 mil millones de parámetros sigue siendo usable para resumir o redactar un texto corto. Por encima de 7-8B sin acelerador, la espera se vuelve incómoda. La guía sobre LLM sin GPU detalla los modelos según la cantidad de RAM.

#Instalar Ollama en Windows

Ollama funciona como una aplicación nativa de Windows, con soporte para tarjetas NVIDIA y AMD Radeon. Una vez instalado, se ejecuta en segundo plano y el comando ollama pasa a estar disponible en cmd, PowerShell o cualquier otro terminal. La instalación no requiere permisos de administrador y se realiza por defecto en tu carpeta personal.

  1. 01
    Descargar
    En ollama.com/download, elige Windows y descarga OllamaSetup.exe. La página también ofrece el comando PowerShell irm https://ollama.com/install.ps1 | iex, que tiene el mismo efecto.
  2. 02
    Ejecutar el instalador
    Haz doble clic en el archivo. Para instalarlo en una ubicación distinta de la carpeta personal, ejecútalo con el parámetro /DIR seguido de la ruta, por ejemplo OllamaSetup.exe /DIR="d:\dossier".
  3. 03
    Verificar
    Abre PowerShell y escribe ollama --version. También aparece un icono de Ollama en la zona de notificaciones, cerca del reloj.
  4. 04
    Verificar el controlador GPU
    Con una tarjeta NVIDIA, la documentación exige el controlador 551.61 o más reciente. Para una tarjeta AMD, se necesita o bien la pila ROCm v7 o bien un controlador Radeon compatible con Vulkan.
i
Windows 10: terminal y fuentes
La documentación indica que los caracteres Unicode de la barra de progreso pueden mostrarse como cuadrados en algunos terminales de Windows 10. Cambiar la fuente del terminal soluciona el problema; es un aspecto estético y no afecta la descarga.

Para el paso a paso completo y la solución de problemas específicos de Windows, consulta la guía dedicada a Windows 11.

#Instalar Ollama en macOS

Ollama requiere macOS 14 Sonoma o una versión más reciente. Los chips Apple M se benefician del procesamiento en la GPU; los Mac con procesador Intel (x86) solo funcionan con la CPU, lo que los limita a modelos muy pequeños. El método recomendado en la documentación es montar el archivo ollama.dmg y arrastrar la aplicación a la carpeta Applications del sistema.

Aplicación oficial
Al primer arranque, la aplicación verifica que el comando ollama esté en tu PATH y, en caso contrario, pide permiso para crear un enlace en /usr/local/bin.
Homebrew
Existe una fórmula ollama en Homebrew (brew install ollama): es la opción del terminal para quienes ya tienen Homebrew, sin necesidad de usar el archivo .dmg.
Memoria unificada
En Apple Silicon, CPU y GPU comparten la misma memoria: un Mac de 16 GB puede cargar un modelo de 14B en Q4, mientras que un PC con una tarjeta de 8 GB de VRAM no lo podría hacer.

La guía dedicada a macOS detalla la elección del modelo según la memoria del Mac y los ajustes útiles en Apple Silicon.

#Instalar Ollama en Linux

En Linux, un comando basta. El script oficial descarga el programa y lo configura como servicio.

Instalación oficial
curl -fsSL https://ollama.com/install.sh | sh

La documentación también ofrece una instalación manual: extracción del archivo ollama-linux-amd64.tar.zst en /usr (o del archivo arm64 para máquinas ARM), archivo ROCm adicional para tarjetas AMD, luego creación de un usuario y un servicio systemd si deseas un arranque automático. Para actualizar, simplemente vuelve a ejecutar el script de instalación; la variable OLLAMA_VERSION permite instalar una versión específica.

Para una tarjeta NVIDIA, instala el controlador y comprueba con nvidia-smi que aparezca tu tarjeta. Para una tarjeta AMD, la documentación exige el controlador ROCm v7. La guía específica de Linux detalla systemd, los permisos y las variables de entorno.

#Ejecutar tu primer modelo

Una vez instalado Ollama, ollama run t descarga el modelo solicitado si no está presente, luego abre una conversación en el terminal. La primera llamada depende de tu conexión: un modelo de 3 a 5 GB tarda unos minutos, y los archivos permanecen luego en el disco. Las llamadas siguientes arrancan sin nuevo descarga, solo se realiza el cargado en memoria.

Primer inicio
ollama run qwen3.5:4b

La familia Qwen 3.5 se publica en ollama.com en tamaños de 0.8b a 122b, con visión, herramientas y razonamiento según las versiones. La etiqueta 4b cabe en unos pocos GB en Q4, por lo que funciona en casi cualquier máquina. Si dispones de 16 GB de memoria, prueba un modelo de 8-9B; la tabla anterior te da la referencia. Las páginas de selección por VRAM del sitio te ayudan a afinar.

→
Salir de la conversación
Escribe /bye para salir. Por defecto, Ollama mantiene el modelo en memoria durante 5 minutos después de la última solicitud, lo que acelera las siguientes ejecuciones; ollama stop seguido del nombre del modelo lo retira de la memoria inmediatamente.

#Comandos que debes conocer tras la instalación

ollama list
Muestra los modelos descargados y su tamaño en disco.
ollama pull nom
Descarga un modelo sin ejecutarlo, útil para preparar varios modelos antes de un viaje.
ollama ps
Muestra los modelos cargados en memoria y si cada uno se ejecuta en GPU o en CPU.
ollama stop nom
Descarga un modelo de la memoria sin esperar los 5 minutos predeterminados.
ollama rm nom
Elimina un modelo para liberar espacio en disco.
ollama serve
Inicia el servidor a mano, útil bajo Linux si el servicio no está activo.

Para continuar (actualización, eliminación completa de Ollama y de sus modelos), consulta la guía de mantenimiento de Ollama.

#¿Dónde se almacenan los modelos y cómo se trasladan?

Los modelos pueden alcanzar fácilmente varias decenas de GB, y el disco del sistema rara vez es el mejor lugar. Las preguntas frecuentes oficiales indican su ubicación predeterminada: ~/.ollama/models en macOS, /usr/share/ollama/.ollama/models en Linux, C:\Users\%username%\.ollama\models en Windows.

Para moverlos, establece como valor de la variable de entorno OLLAMA_MODELS la ruta de la carpeta deseada. En Windows, cierra Ollama desde el área de notificación, abre las variables de entorno de tu cuenta, crea la variable y vuelve a iniciar la aplicación. En Linux, con la instalación estándar, el usuario ollama debe tener permisos de lectura y escritura en esa carpeta: la documentación propone sudo chown -R ollama:ollama seguido de la ruta de la carpeta.

#Confidencialidad: lo que permanece en local

En modo local, las consultas y respuestas permanecen en tu máquina: la FAQ de Ollama indica que la empresa no ve tus prompts ni tus datos cuando ejecutas un modelo localmente. Los modelos llamados en la nube son diferentes: pasan por los servidores de Ollama. Si deseas un uso estrictamente local, la documentación describe un modo exclusivamente local: la variable OLLAMA_NO_CLOUD=1, o la configuración disable_ollama_cloud en ~/.ollama/server.json. Reinicia luego Ollama.

Por defecto, el servidor solo escucha en 127.0.0.1, puerto 11434: nadie más en tu red puede acceder a él. Cambiar OLLAMA_HOST a 0.0.0.0 lo expone a toda la red local sin autenticación. Solo hacerlo detrás de un firewall o un proxy.

#Solución de problemas: cinco problemas frecuentes

Comando no encontrado
Cierra y vuelve a abrir el terminal: el instalador acaba de modificar el PATH. En macOS, vuelve a iniciar la aplicación para que te ofrezca el enlace /usr/local/bin.
GPU no utilizada
Ejecuta un modelo y después ollama ps: la columna del procesador indica GPU o CPU. Actualiza el controlador (NVIDIA 551.61 como mínimo en Windows, 550 en Linux) y vuelve a iniciar Ollama.
Tarjeta AMD no reconocida en Windows
La documentación indica que algunos sistemas RDNA2 (RX 6000) no exponen ROCm v7 en Windows. Vulkan, activado por defecto, es entonces la alternativa recomendada.
Puerto 11434 ocupado
Otra instancia de Ollama ya está en ejecución, u otro programa está usando el puerto. Cierra la aplicación y vuelve a iniciarla.
Descarga bloqueada tras un proxy
Utiliza HTTPS_PROXY y evita HTTP_PROXY, que puede interferir con las conexiones del cliente según las preguntas frecuentes; el certificado del proxy debe instalarse como certificado del sistema.
Preguntas frecuentes sobre la instalación de Ollama
¿Cómo instalar Ollama en Windows 10?+
Ollama exige Windows 10 22H2 o más reciente, edición Home o Pro. Descarga OllamaSetup.exe desde ollama.com/download y ejecútalo: no se pide permiso de administrador. Abre luego PowerShell y escribe ollama --version. Con una tarjeta NVIDIA, instala primero el controlador 551.61 o más reciente, de lo contrario Ollama vuelve al procesador y las respuestas se ralentizan mucho.
¿Ollama es gratuito?+
Sí, para el uso local: el programa y los modelos abiertos que ejecuta son gratuitos; solo cuenta el consumo eléctrico de tu hardware. Ollama ofrece además modelos en la nube con una cuenta, distintos de la ejecución en tu máquina; forman parte de una oferta separada, que no es necesaria para esta guía.
¿Se necesita una tarjeta gráfica para usar Ollama?+
No. Ollama funciona solo con procesador, pero las respuestas son más lentas, lo que limita el uso cómodo a modelos pequeños de 3 a 4 mil millones de parámetros. Una tarjeta NVIDIA o AMD compatible, o un Mac con Apple Silicon, acelera significativamente la generación. Comprueba después con ollama ps dónde está realmente cargado el modelo.
¿Dónde almacena Ollama los modelos?+
En macOS ~/.ollama/models, en Linux /usr/share/ollama/.ollama/models, en Windows C:\Users\nom\.ollama\models. Para cambiar de ubicación, define la variable OLLAMA_MODELS y luego reinicia Ollama para que se tenga en cuenta. Después, copia los modelos existentes a esa carpeta o vuelve a descargarlos si prefieres empezar desde cero; luego comprueba el resultado con ollama list.
¿Envía Ollama mis conversaciones a Internet?+
No en modo local: Ollama indica que no ve tus prompts ni tus datos cuando el modelo corre en tu máquina. Los modelos en la nube, en cambio, pasan por sus servidores. OLLAMA_NO_CLOUD=1 desactiva estas funciones para mantenerse estrictamente local, luego reinicia Ollama para aplicar el ajuste.
¿Cómo saber si Ollama utiliza mi GPU?+
Arranca un modelo, luego escribe ollama ps en un segundo terminal. La columna del procesador indica la parte del modelo cargada en GPU o en CPU. Si indica CPU aunque tengas una tarjeta compatible, actualiza el controlador y vuelve a iniciar Ollama.
¿Esta guía te ha ayudado?

¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.