La guía de referencia · 16 capítulos · recursos incluidos · actualizaciones de por vida
Tu Mac, a tope
para la IA local
El kit Mac : LA guía de referencia para aprovechar al máximo la IA local en Apple Silicon — memoria unificada, MLX frente a GGUF, el modelo adecuado para TU chip (M1 a M5/M6), y todo lo que macOS ofrece además. Tanto para un Mac recién comprado como para un Mac de 2020 que nunca se ha aprovechado al máximo.
Obtener el kit — 24 €24 € · pago único · actualizaciones de por vida incluidas
¿Qué es el kit Mac?
El kit para Mac es una guía de referencia de 16 capítulos con 21 archivos de recursos y un espacio en línea de por vida. Está dirigido a usuarios de Mac Apple Silicon (chips M1 a M5/M6, de 8 a 512 GB de memoria unificada), con tres perfiles de referencia que van del MacBook Air de 16 GB al Mac Studio de 64 GB. Resultado: un primer LLM con aceleración Metal en menos de una hora y, después, el máximo aprovechamiento de la memoria unificada y MLX.
- 16 capítulos y 21 archivos de recursos: tabla maestra, scripts launchd, Atajos.
- Cubre los chips M1 a M5/M6, con entre 8 y 512 GB de memoria unificada.
- Perfiles de referencia: MacBook Air M2 16 GB, Mac mini M4 24 GB, Studio 64 GB.
- Herramientas cubiertas: LM Studio (MLX), Ollama, Open WebUI y mlx-lm.
- Primer LLM funcionando con la aceleración Metal activa en menos de una hora.
- 24 € en un pago único, actualizaciones de por vida incluidas y garantía de satisfacción o devolución del dinero durante 30 días.
✓ Para ti si…
tienes un Mac Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac — chip M1 a M5/M6) y quieres entender y aprovechar sus características propias para la IA local: su memoria unificada, MLX, el modelo adecuado para tu chip concreto y el rendimiento real, tanto si estás empezando como si ya ejecutas Ollama/LM Studio sin estar seguro de sacarles el máximo partido.
✗ No es para ti si…
estás en PC o Linux (es el kit IA Local, para varios sistemas operativos) o buscas un copiloto que programe en tu editor (es el kit Copiloto Local, con una única referencia a Xcode en este kit, nunca un capítulo dedicado).
¿Por qué puedes confiar en ello?
Esta guía está escrita y mantenida por el equipo de QuelLLM.fr — 250 modelos indexados, 335 guías en francés, actualizados cada mañana — que también opera plataformas de IA en producción todo el año (RegulIA, IAPRO). Cada comando, modelo, versión y precio de esta guía se comprueba con la fuente oficial en la fecha de edición (Apple, Ollama, LM Studio, Hugging Face) y se vuelve a comprobar en cada edición, en los perfiles de equipos que nosotros mismos utilizamos. Lo que lees es conciso, está verificado y va al grano. No es una recopilación de tutoriales encontrados al azar. ¿Quién está detrás de QuelLLM? →
El problema
Un Mac Apple Silicon no es no es solo un PC con un logotipo para la IA local: memoria unificada compartida con la GPU, MLX frente a GGUF, un límite de memoria predeterminado que se puede aumentar si sabes cómo hacerlo: la mayoría de las guías tratan tu Mac como cualquier otra máquina y desaprovechas la mitad de su capacidad.
La información sobre Mac ya está ahí, repartida entre 21 guías gratuitas del sitio — una por máquina, una para MLX, una para la memoria unificada. El kit es EL método de referencia: la tabla de modelos por chip Y por nivel de RAM reunida en un solo lugar, los scripts de launchd y de Atajos listos para pegar, el método para medir tu propio rendimiento; no una recopilación de tutoriales cuya información tengas que contrastar por tu cuenta.
MLX natif vs GGUF en tu Mac
El mismo modelo, dos formatos — la elección peor explicada en las guías gratuitas existentes. La comparativa honesta:
| MLX (Apple) | GGUF (llama.cpp/Ollama) | |
|---|---|---|
| Diseñado desde el principio para memoria unificada | Sí | Compatible, no nativo |
| Disponibilidad de los modelos | Una buena parte, no todo | La práctica totalidad |
| Compatibilidad multi-OS (PC, Linux) | No — solo Apple Silicon | Sí |
| Cambiar a LM Studio | Un ajuste de interfaz gráfica | Un ajuste de interfaz gráfica |
Línea de comandos (mlx-lm) | Opcional, para profundizar | CLI nativa de Ollama |
El kit te dice en qué casos MLX aporta una ventaja real y en qué casos GGUF sigue siendo la opción adecuada (modelo no disponible en MLX, necesidad de compatibilidad con varios sistemas operativos): nunca un dogma, sino un método.
Lo que obtienes
- Tu espacio en línea, de por vida — los 16 capítulos disponibles para leer en la web, siempre en su última edición.
- Guía completa en PDF — el mismo contenido, tuyo para siempre, sin conexión.
- 21 archivos de recursos listos para usar — la tabla maestra GB→modelo por chip (
.md+.csv), la hoja de referencia de memoria unificada (comandossysctl+ LaunchDaemon), el árbol de decisión MLX/GGUF, el.plistlaunchd para ejecutar Ollama como servicio, el archivo Compose de Open WebUI adaptado a Mac, la exportación de Atajos y más. - 3 perfiles de referencia — MacBook Air M2 16 GB (tu máquina actual si tienes uno; ya no se vende nuevo, véase el cap. 15), Mac mini M4 24 GB, Mac Studio M4 Max 64 GB: encuentras tu configuración en cada capítulo, nunca un ejemplo que no tenga que ver contigo.
- El capítulo «cuando algo falla en Mac» — un árbol de decisión por síntoma (Metal no detectado, sistema inutilizable durante una generación, modelo que no se carga, throttling).
- Edición en actualización continua — cada actualización (nuevos chips de Apple, nuevos modelos, evolución de MLX) aparece en tu espacio, de por vida, sin volver a pagar nada.
Herramientas: LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Mac Apple Silicon exclusivamente, 0 €/mes una vez instalado.
Los 16 capítulos del kit
Desde tu primer LLM 100 % Metal en menos de una hora hasta la tabla de criterios de compra de 2026. No hay nada que saltarse: cada capítulo remite a los siguientes.
- Tu primer LLM 100 % Metal, en una hora
- Memoria unificada: qué cambia realmente (y cómo forzar el límite de GPU)
- MLX o GGUF: ¿cuál elegir y cuándo importa?
- La tabla de referencia: qué modelo para QUÉ chip y cuánta RAM
- Cuantización y contexto largo: calcular tu verdadero presupuesto de memoria
- Rendimiento real: tokens/segundo, prefill, calor, batería
- Ollama como servicio: lanzamiento automático, red, logs (launchd)
- Open WebUI en Mac: Docker Desktop, OrbStack o instalación nativa
- La visión local, acelerada nativamente por Metal
- Modelos en francés y inglés: lo que funciona realmente bien en Apple Silicon
- Atajos, Automator, Spotlight: la IA local en macOS
- Tu Mac mini como servidor IA para toda la casa
- Confidencialidad: iCloud, Spotlight, telemetría — lo que realmente permanece en local
- Cuando falla en Mac: Metal, memoria, swap
- ¿Qué Mac comprar para la IA local en 2026?
- Esta edición está obsoleta — y después de eso?
Edición en constante actualización: cada actualización amplía este índice (registro de actualizaciones con fechas, cap. 16): no tendrás que volver a comprar nada cuando salga la próxima versión.
Tu primer LLM 100 % Metal en una hora, paso a paso
Tanto si empiezas desde cero como si ya tienes una herramienta instalada, la guía te acompaña paso a paso hasta obtener un resultado concreto:
1 · LM Studio o Ollama
2 comandos si empiezas desde cero (referencia completa al kit de IA local); si no, pasamos directamente a la siguiente parte.
2 · Verifica que Metal esté funcionando
El Monitor de Actividad (pestaña GPU) debe mostrar la GPU trabajando, sin que se recurra silenciosamente a la CPU.
3 · El modelo adecuado para tu chip
La tabla del Capítulo 4 te dice cuál según tu chip y tu memoria unificada — no necesitas adivinar.
4 · Avanza más
Memoria unificada, MLX, launchd, Atajos — todo está en los capítulos siguientes.
- El espacio en línea de por vida: 16 capítulos siempre actualizados (índice completo más arriba)
- La guía PDF + los 21 archivos de recursos (tabla maestra, scripts de launchd/Atajos, listas de comprobación) para descargar
- Los 3 perfiles de referencia (Air, mini, Studio) y el árbol de resolución de problemas de Metal/memoria/swap
- Todas las ediciones futuras, de por vida — aparecen en tu espacio
- Acceso inmediato tras el pago, clave de acceso enviada por email
Pago seguro mediante Stripe. Factura PDF enviada automáticamente · IVA no aplicable, art. 293 B del CGI.
La verdad sin adornos
Un Mac Apple Silicon tiene ventajas reales para la IA local y limitaciones reales que ninguna tabla de chips resuelve. Una guía de referencia debe ofrecerte esta visión honesta:
Al final, tú sabes hacer
- Explicar la memoria unificada y aumentar, si es necesario, el límite asignado a la GPU (
iogpu.wired_limit_mb). - Elegir entre MLX y GGUF según el modelo, sin jerga innecesaria, y arrancar los dos si es necesario.
- Encontrar el modelo adecuado para TU chip y TU memoria unificada con una sola lectura de la tabla principal.
- Ejecutar Ollama como un verdadero servicio macOS (launchd) y transformar un Mac mini en servidor familiar.
- Comprobar por ti mismo que nada sale de tu Mac (iCloud Drive, Spotlight), no solo fiarse de nuestra palabra.
- Diagnosticar y reparar por tu cuenta los fallos específicos de Mac (Metal, memoria, swap).
Edición vivante — como todos los kits QuelLLM
«Actualizaciones de por vida» no es un eslogan: el hardware de Apple cambia dos veces al año y MLX evoluciona rápido; el kit se mantiene al día con el ecosistema por ti, sin que tengas que volver a pagar nada.
v2026.09 (edición actual) — primera edición del kit: 16 capítulos, 3 perfiles de referencia (MacBook Air M2 16 GB, Mac mini M4 24 GB, Mac Studio M4 Max 64 GB), 21 archivos de recursos, tabla maestra GB→modelo por chip.
Las próximas ediciones (nuevos chips de Apple, nuevos modelos, evolución de MLX) se añaden aquí, con fecha, y llegan a tu espacio sin que tengas que volver a pagar nada.
Preguntas frecuentes
¿Cuál es la diferencia con el kit de IA local?
El kit de IA local te instala un asistente de IA privado en Mac O en PC y está dirigido al público general que utiliza distintos sistemas operativos; su enfoque se mantiene deliberadamente general. Este kit parte de que ya tienes un Mac y profundiza en todo lo específico de Apple Silicon: la memoria unificada y su límite para la GPU, MLX frente a GGUF, la tabla de modelos por chip Y por nivel de RAM (M1 a M5/M6, 8 a 512 GB), el método para medir tu rendimiento real y lo que macOS ofrece además (Atajos, launchd, Spotlight, Apple Intelligence). Los dos se complementan, no se solapan.
¿Solo funciona en Mac con Apple Silicon?
Sí, exclusivamente: un Mac con chip de M1 a M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Un Mac Intel no tiene memoria unificada ni MLX; la mayor parte del kit no es aplicable. Si usas un PC (o aún no sabes qué Mac comprar), empieza por el kit IA Local o el capítulo 15 de este kit (tabla de decisión de compra, sin enlace comercial).
¿Se necesita ser desarrollador para seguir este kit?
No. El kit parte de la premisa de que sabes instalar una app y arrastrar un archivo — los comandos de Terminal (memoria unificada en el Cap.2, launchd en el Cap.7) se explican la primera vez que aparecen, nunca se asumen conocidos. Algunas secciones van más allá del público general (mlx-lm en la línea de comandos) — siempre presentadas como «para profundizar», nunca como un requisito previo para seguir con el resto.
¿Cuánto tiempo se tarda en obtener un resultado?
Tu primer LLM con la aceleración Metal activada, en menos de una hora, tanto si empiezas desde cero (2 comandos y una referencia al kit IA Local para la instalación completa) como si ya tienes LM Studio/Ollama y solo quieres comprobar que Metal funciona de verdad, sin una ejecución silenciosa en la CPU como alternativa.
¿Cuál es la diferencia con las guías gratuitas para Mac del sitio?
Las guías gratuitas de QuelLLM.fr cubren cada máquina o cada tema por separado (una guía por Mac, MLX vs llama.cpp por un lado, optimización de memoria por otro). El kit reúne el recorrido completo, incluye la tabla de modelos por chip × RAM que ninguna guía aislada ofrece completa y actualizada, los scripts de launchd/Atajos listos para pegar, y se mantiene actualizado de por vida ante un hardware de Apple que cambia dos veces al año: lo que se paga es el conjunto y los recursos, no la información en bruto.
¿Es realmente gratuito una vez instalado?
Sí: el modelo se ejecuta en tu máquina, 0 €/mes, sin cuenta, sin límites. El kit en sí (guía + recursos + espacio en línea de por vida) se adquiere con una compra única.
¿Puedo realmente montar un servidor de IA con mi Mac mini?
Sí, el capítulo 12 cubre exactamente eso: impedir que el Mac entre en reposo, ejecutar Ollama como un verdadero servicio (launchd, cap. 7) que sigue funcionando tras un reinicio y acceder a él desde los demás dispositivos del hogar, con una mención honesta de las opciones de acceso remoto (VPN personal como Tailscale), sin presentarlo como una lista de comprobación de seguridad empresarial.
¿Mis conversaciones y mis modelos permanecen privados en mi Mac?
Es el principio de la ejecución local: nada se envía una vez cargado el modelo. El capítulo 13 va más allá de la lista de comprobación genérica: verifica específicamente que iCloud Drive no sincronice silenciosamente tu carpeta de modelos o conversaciones, y qué indexa Spotlight en esas carpetas y su entorno.
¿Y si no me convence después de la compra?
Si no estás satisfecho, te devolvemos el dinero durante 30 días; basta un correo electrónico, sin necesidad de justificarlo — como en todos los kits de QuelLLM.
¿Cómo se entrega y por cuánto tiempo?
Acceso inmediato tras el pago: tu espacio en línea de por vida (siempre con la última edición) + el PDF y el ZIP de los recursos para descargar, que serán tuyos para siempre. Las actualizaciones futuras (nuevos chips de Apple, nuevos modelos) aparecen en tu espacio sin volver a pagar nada.
¿Puedo obtener una factura?
Sí, automáticamente. En cuanto se realiza el pago (Stripe), recibes por correo electrónico tu recibo de Stripe y tu factura PDF a nombre de Falcon Consulting (editor de QuelLLM), con tus datos — indica tu empresa o tu SIREN en el campo correspondiente en el momento del pago. IVA no aplicable, art. 293 B del CGI.
¿Y si quiero varios kits de QuelLLM?
El paquete «todos los kits, de por vida» agrupa todos los kits actuales y futuros por 49 €. Si ya has comprado un kit por 24 €, la actualización al paquete te cuesta 25 €, no 49 € — el cupón se aplica automáticamente.
¿Qué es MLX en Mac?
MLX es el framework de cálculo de Apple, diseñado desde el principio para la memoria unificada de los chips Apple Silicon, a diferencia de GGUF (llama.cpp/Ollama), que sigue siendo compatible pero no nativo. El kit Mac explica en qué casos MLX aporta una mejora real del rendimiento y cuándo GGUF sigue siendo la opción adecuada (modelo no disponible en MLX, necesidad de usar varios sistemas operativos).
¿Ollama funciona bien en Mac?
Sí, de forma nativa y con la aceleración Metal de la GPU: junto con LM Studio, es una de las dos vías posibles para ejecutar un LLM en Apple Silicon. El kit Mac va más allá de la instalación básica: verificar que Metal funcione realmente (sin recurrir silenciosamente a la CPU) y ejecutar Ollama como un verdadero servicio mediante launchd.
¿Qué modelo de IA elegir en Mac?
Depende de tu chip y de tu memoria unificada, no de una regla única: un Mac de 16 GB no está pensado para el mismo modelo que un Mac Studio de 64 GB. El kit Mac incluye una tabla de referencia que relaciona cada chip (M1 a M5/M6) y cada nivel de RAM con el modelo y el formato (MLX o GGUF) adecuados.
Aprovecha tu Mac al máximo.
La guía de referencia, desde tu primer LLM acelerado con Metal hasta el servidor de IA familiar en tu Mac mini: memoria unificada, MLX, el modelo adecuado para tu chip. Hoy, no «algún día».
Obtener el kit — 24 €