La guía de referencia · 16 capítulos · recursos incluidos · actualizaciones de por vida

Tu Mac, a tope
para la IA local

El kit Mac : LA guía de referencia para aprovechar al máximo la IA local en Apple Silicon — memoria unificada, MLX frente a GGUF, el modelo adecuado para TU chip (M1 a M5/M6), y todo lo que macOS ofrece además. Tanto para un Mac recién comprado como para un Mac de 2020 que nunca se ha aprovechado al máximo.

Obtener el kit — 24 €

24 € · pago único · actualizaciones de por vida incluidas

✓ Acceso inmediato (en línea + PDF) ✓ Pago seguro con Stripe ✓ Garantía de reembolso de 30 días ✓ Edición en constante actualización (actualizaciones de por vida)

Ver los 16 capítulos →

¿Qué es el kit Mac?

El kit para Mac es una guía de referencia de 16 capítulos con 21 archivos de recursos y un espacio en línea de por vida. Está dirigido a usuarios de Mac Apple Silicon (chips M1 a M5/M6, de 8 a 512 GB de memoria unificada), con tres perfiles de referencia que van del MacBook Air de 16 GB al Mac Studio de 64 GB. Resultado: un primer LLM con aceleración Metal en menos de una hora y, después, el máximo aprovechamiento de la memoria unificada y MLX.

  • 16 capítulos y 21 archivos de recursos: tabla maestra, scripts launchd, Atajos.
  • Cubre los chips M1 a M5/M6, con entre 8 y 512 GB de memoria unificada.
  • Perfiles de referencia: MacBook Air M2 16 GB, Mac mini M4 24 GB, Studio 64 GB.
  • Herramientas cubiertas: LM Studio (MLX), Ollama, Open WebUI y mlx-lm.
  • Primer LLM funcionando con la aceleración Metal activa en menos de una hora.
  • 24 € en un pago único, actualizaciones de por vida incluidas y garantía de satisfacción o devolución del dinero durante 30 días.
Portada del kit Mac — Mac

✓ Para ti si…

tienes un Mac Apple Silicon (MacBook Air/Pro, Mac mini, Mac Studio, iMac — chip M1 a M5/M6) y quieres entender y aprovechar sus características propias para la IA local: su memoria unificada, MLX, el modelo adecuado para tu chip concreto y el rendimiento real, tanto si estás empezando como si ya ejecutas Ollama/LM Studio sin estar seguro de sacarles el máximo partido.

✗ No es para ti si…

estás en PC o Linux (es el kit IA Local, para varios sistemas operativos) o buscas un copiloto que programe en tu editor (es el kit Copiloto Local, con una única referencia a Xcode en este kit, nunca un capítulo dedicado).

24 € Pago único · actualizaciones de por vida incluidas Garantía de 30 días — si no te convence, te devolvemos el dinero con un solo correo Exclusivo para Mac — Apple Silicon (M1 a M5/M6), 8 a 512 GB de memoria unificada cubiertos.

¿Por qué puedes confiar en ello?

Esta guía está escrita y mantenida por el equipo de QuelLLM.fr — 250 modelos indexados, 335 guías en francés, actualizados cada mañana — que también opera plataformas de IA en producción todo el año (RegulIA, IAPRO). Cada comando, modelo, versión y precio de esta guía se comprueba con la fuente oficial en la fecha de edición (Apple, Ollama, LM Studio, Hugging Face) y se vuelve a comprobar en cada edición, en los perfiles de equipos que nosotros mismos utilizamos. Lo que lees es conciso, está verificado y va al grano. No es una recopilación de tutoriales encontrados al azar. ¿Quién está detrás de QuelLLM? →

El problema

Un Mac Apple Silicon no es no es solo un PC con un logotipo para la IA local: memoria unificada compartida con la GPU, MLX frente a GGUF, un límite de memoria predeterminado que se puede aumentar si sabes cómo hacerlo: la mayoría de las guías tratan tu Mac como cualquier otra máquina y desaprovechas la mitad de su capacidad.

La información sobre Mac ya está ahí, repartida entre 21 guías gratuitas del sitio — una por máquina, una para MLX, una para la memoria unificada. El kit es EL método de referencia: la tabla de modelos por chip Y por nivel de RAM reunida en un solo lugar, los scripts de launchd y de Atajos listos para pegar, el método para medir tu propio rendimiento; no una recopilación de tutoriales cuya información tengas que contrastar por tu cuenta.

MLX natif vs GGUF en tu Mac

El mismo modelo, dos formatos — la elección peor explicada en las guías gratuitas existentes. La comparativa honesta:

MLX (Apple)GGUF (llama.cpp/Ollama)
Diseñado desde el principio para memoria unificadaSíCompatible, no nativo
Disponibilidad de los modelosUna buena parte, no todoLa práctica totalidad
Compatibilidad multi-OS (PC, Linux)No — solo Apple SiliconSí
Cambiar a LM StudioUn ajuste de interfaz gráficaUn ajuste de interfaz gráfica
Línea de comandos (mlx-lm)Opcional, para profundizarCLI nativa de Ollama

El kit te dice en qué casos MLX aporta una ventaja real y en qué casos GGUF sigue siendo la opción adecuada (modelo no disponible en MLX, necesidad de compatibilidad con varios sistemas operativos): nunca un dogma, sino un método.

Lo que obtienes

Herramientas: LM Studio (MLX), Ollama, Open WebUI, mlx-lm. Mac Apple Silicon exclusivamente, 0 €/mes una vez instalado.

Los 16 capítulos del kit

Desde tu primer LLM 100 % Metal en menos de una hora hasta la tabla de criterios de compra de 2026. No hay nada que saltarse: cada capítulo remite a los siguientes.

Parte 1 — El Mac, una arquitectura aparte para la IA local
  • Tu primer LLM 100 % Metal, en una hora
  • Memoria unificada: qué cambia realmente (y cómo forzar el límite de GPU)
  • MLX o GGUF: ¿cuál elegir y cuándo importa?
  • La tabla de referencia: qué modelo para QUÉ chip y cuánta RAM
Parte 2 — Instalar, configurar, medir
  • Cuantización y contexto largo: calcular tu verdadero presupuesto de memoria
  • Rendimiento real: tokens/segundo, prefill, calor, batería
  • Ollama como servicio: lanzamiento automático, red, logs (launchd)
  • Open WebUI en Mac: Docker Desktop, OrbStack o instalación nativa
Parte 3 — Qué hacemos con ello en un Mac
  • La visión local, acelerada nativamente por Metal
  • Modelos en francés y inglés: lo que funciona realmente bien en Apple Silicon
  • Atajos, Automator, Spotlight: la IA local en macOS
  • Tu Mac mini como servidor IA para toda la casa
Parte 4 — Mejorar la fiabilidad, elegir y mantener a largo plazo
  • Confidencialidad: iCloud, Spotlight, telemetría — lo que realmente permanece en local
  • Cuando falla en Mac: Metal, memoria, swap
  • ¿Qué Mac comprar para la IA local en 2026?
  • Esta edición está obsoleta — y después de eso?

Edición en constante actualización: cada actualización amplía este índice (registro de actualizaciones con fechas, cap. 16): no tendrás que volver a comprar nada cuando salga la próxima versión.

Tu primer LLM 100 % Metal en una hora, paso a paso

Tanto si empiezas desde cero como si ya tienes una herramienta instalada, la guía te acompaña paso a paso hasta obtener un resultado concreto:

1 · LM Studio o Ollama

2 comandos si empiezas desde cero (referencia completa al kit de IA local); si no, pasamos directamente a la siguiente parte.

2 · Verifica que Metal esté funcionando

El Monitor de Actividad (pestaña GPU) debe mostrar la GPU trabajando, sin que se recurra silenciosamente a la CPU.

3 · El modelo adecuado para tu chip

La tabla del Capítulo 4 te dice cuál según tu chip y tu memoria unificada — no necesitas adivinar.

4 · Avanza más

Memoria unificada, MLX, launchd, Atajos — todo está en los capítulos siguientes.

24 €
Pago único · actualizaciones de por vida incluidas
Una sola compra para aprovechar tu Mac al máximo, hoy y con cada nuevo chip de Apple. Después, 0 €/mes para siempre.
Garantía de satisfacción o reembolso de 30 días — basta con un correo electrónico.
  • El espacio en línea de por vida: 16 capítulos siempre actualizados (índice completo más arriba)
  • La guía PDF + los 21 archivos de recursos (tabla maestra, scripts de launchd/Atajos, listas de comprobación) para descargar
  • Los 3 perfiles de referencia (Air, mini, Studio) y el árbol de resolución de problemas de Metal/memoria/swap
  • Todas las ediciones futuras, de por vida — aparecen en tu espacio
  • Acceso inmediato tras el pago, clave de acceso enviada por email
Me llevo el kit — 24 €

Pago seguro mediante Stripe. Factura PDF enviada automáticamente · IVA no aplicable, art. 293 B del CGI.

Me llevo el kit — 24 €

La verdad sin adornos

Un Mac Apple Silicon tiene ventajas reales para la IA local y limitaciones reales que ninguna tabla de chips resuelve. Una guía de referencia debe ofrecerte esta visión honesta:

El Mac ganamemoria unificada compartida con la GPU (sin VRAM separada que haya que sobredimensionar) · silencio y bajo consumo energético · MLX optimizado para la arquitectura · todo macOS disponible (Atajos, launchd, Spotlight)
Dónde se bloqueano todos los modelos están disponibles en MLX · no se puede añadir memoria después de la compra (a diferencia de una tarjeta GPU dedicada) · reducción real del rendimiento por limitaciones térmicas en un MacBook sin ventilador durante la generación continua

Al final, tú sabes hacer

Edición vivante — como todos los kits QuelLLM

«Actualizaciones de por vida» no es un eslogan: el hardware de Apple cambia dos veces al año y MLX evoluciona rápido; el kit se mantiene al día con el ecosistema por ti, sin que tengas que volver a pagar nada.

CHANGELOG.md — incluido en el pack

v2026.09 (edición actual) — primera edición del kit: 16 capítulos, 3 perfiles de referencia (MacBook Air M2 16 GB, Mac mini M4 24 GB, Mac Studio M4 Max 64 GB), 21 archivos de recursos, tabla maestra GB→modelo por chip.

Las próximas ediciones (nuevos chips de Apple, nuevos modelos, evolución de MLX) se añaden aquí, con fecha, y llegan a tu espacio sin que tengas que volver a pagar nada.

Preguntas frecuentes

¿Cuál es la diferencia con el kit de IA local?

El kit de IA local te instala un asistente de IA privado en Mac O en PC y está dirigido al público general que utiliza distintos sistemas operativos; su enfoque se mantiene deliberadamente general. Este kit parte de que ya tienes un Mac y profundiza en todo lo específico de Apple Silicon: la memoria unificada y su límite para la GPU, MLX frente a GGUF, la tabla de modelos por chip Y por nivel de RAM (M1 a M5/M6, 8 a 512 GB), el método para medir tu rendimiento real y lo que macOS ofrece además (Atajos, launchd, Spotlight, Apple Intelligence). Los dos se complementan, no se solapan.

¿Solo funciona en Mac con Apple Silicon?

Sí, exclusivamente: un Mac con chip de M1 a M5/M6 (MacBook Air, MacBook Pro, Mac mini, Mac Studio, iMac). Un Mac Intel no tiene memoria unificada ni MLX; la mayor parte del kit no es aplicable. Si usas un PC (o aún no sabes qué Mac comprar), empieza por el kit IA Local o el capítulo 15 de este kit (tabla de decisión de compra, sin enlace comercial).

¿Se necesita ser desarrollador para seguir este kit?

No. El kit parte de la premisa de que sabes instalar una app y arrastrar un archivo — los comandos de Terminal (memoria unificada en el Cap.2, launchd en el Cap.7) se explican la primera vez que aparecen, nunca se asumen conocidos. Algunas secciones van más allá del público general (mlx-lm en la línea de comandos) — siempre presentadas como «para profundizar», nunca como un requisito previo para seguir con el resto.

¿Cuánto tiempo se tarda en obtener un resultado?

Tu primer LLM con la aceleración Metal activada, en menos de una hora, tanto si empiezas desde cero (2 comandos y una referencia al kit IA Local para la instalación completa) como si ya tienes LM Studio/Ollama y solo quieres comprobar que Metal funciona de verdad, sin una ejecución silenciosa en la CPU como alternativa.

¿Cuál es la diferencia con las guías gratuitas para Mac del sitio?

Las guías gratuitas de QuelLLM.fr cubren cada máquina o cada tema por separado (una guía por Mac, MLX vs llama.cpp por un lado, optimización de memoria por otro). El kit reúne el recorrido completo, incluye la tabla de modelos por chip × RAM que ninguna guía aislada ofrece completa y actualizada, los scripts de launchd/Atajos listos para pegar, y se mantiene actualizado de por vida ante un hardware de Apple que cambia dos veces al año: lo que se paga es el conjunto y los recursos, no la información en bruto.

¿Es realmente gratuito una vez instalado?

Sí: el modelo se ejecuta en tu máquina, 0 €/mes, sin cuenta, sin límites. El kit en sí (guía + recursos + espacio en línea de por vida) se adquiere con una compra única.

¿Puedo realmente montar un servidor de IA con mi Mac mini?

Sí, el capítulo 12 cubre exactamente eso: impedir que el Mac entre en reposo, ejecutar Ollama como un verdadero servicio (launchd, cap. 7) que sigue funcionando tras un reinicio y acceder a él desde los demás dispositivos del hogar, con una mención honesta de las opciones de acceso remoto (VPN personal como Tailscale), sin presentarlo como una lista de comprobación de seguridad empresarial.

¿Mis conversaciones y mis modelos permanecen privados en mi Mac?

Es el principio de la ejecución local: nada se envía una vez cargado el modelo. El capítulo 13 va más allá de la lista de comprobación genérica: verifica específicamente que iCloud Drive no sincronice silenciosamente tu carpeta de modelos o conversaciones, y qué indexa Spotlight en esas carpetas y su entorno.

¿Y si no me convence después de la compra?

Si no estás satisfecho, te devolvemos el dinero durante 30 días; basta un correo electrónico, sin necesidad de justificarlo — como en todos los kits de QuelLLM.

¿Cómo se entrega y por cuánto tiempo?

Acceso inmediato tras el pago: tu espacio en línea de por vida (siempre con la última edición) + el PDF y el ZIP de los recursos para descargar, que serán tuyos para siempre. Las actualizaciones futuras (nuevos chips de Apple, nuevos modelos) aparecen en tu espacio sin volver a pagar nada.

¿Puedo obtener una factura?

Sí, automáticamente. En cuanto se realiza el pago (Stripe), recibes por correo electrónico tu recibo de Stripe y tu factura PDF a nombre de Falcon Consulting (editor de QuelLLM), con tus datos — indica tu empresa o tu SIREN en el campo correspondiente en el momento del pago. IVA no aplicable, art. 293 B del CGI.

¿Y si quiero varios kits de QuelLLM?

El paquete «todos los kits, de por vida» agrupa todos los kits actuales y futuros por 49 €. Si ya has comprado un kit por 24 €, la actualización al paquete te cuesta 25 €, no 49 € — el cupón se aplica automáticamente.

¿Qué es MLX en Mac?

MLX es el framework de cálculo de Apple, diseñado desde el principio para la memoria unificada de los chips Apple Silicon, a diferencia de GGUF (llama.cpp/Ollama), que sigue siendo compatible pero no nativo. El kit Mac explica en qué casos MLX aporta una mejora real del rendimiento y cuándo GGUF sigue siendo la opción adecuada (modelo no disponible en MLX, necesidad de usar varios sistemas operativos).

¿Ollama funciona bien en Mac?

Sí, de forma nativa y con la aceleración Metal de la GPU: junto con LM Studio, es una de las dos vías posibles para ejecutar un LLM en Apple Silicon. El kit Mac va más allá de la instalación básica: verificar que Metal funcione realmente (sin recurrir silenciosamente a la CPU) y ejecutar Ollama como un verdadero servicio mediante launchd.

¿Qué modelo de IA elegir en Mac?

Depende de tu chip y de tu memoria unificada, no de una regla única: un Mac de 16 GB no está pensado para el mismo modelo que un Mac Studio de 64 GB. El kit Mac incluye una tabla de referencia que relaciona cada chip (M1 a M5/M6) y cada nivel de RAM con el modelo y el formato (MLX o GGUF) adecuados.

Aprovecha tu Mac al máximo.

La guía de referencia, desde tu primer LLM acelerado con Metal hasta el servidor de IA familiar en tu Mac mini: memoria unificada, MLX, el modelo adecuado para tu chip. Hoy, no «algún día».

Obtener el kit — 24 €