Intermedio 12 minLM Studio

LM Studio Bionic: ¿qué es y para qué sirve? ?

LM Studio Bionic es la aplicación de agentes que LM Studio separó de su aplicación clásica en julio de 2026. Mientras que el LM Studio «original» sigue centrado en el chat y el servidor de API, Bionic añade proyectos con agentes (Code y Work), análisis de documentos (PDF, hojas de cálculo, Word) y un teclado por voz Voxtral con transcripción 100 % local. Esta guía ofrece un recorrido por la aplicación, explica qué permanece en tu equipo y qué puede enviarse a la nube, y detalla los ajustes más importantes.

Por Mohamed Meguedmi·Actualización 2026-09-05·Probado en Windows, macOS y Linux
i
En resumen
LM Studio Bionic es la aplicación con agente que LM Studio separó de la aplicación clásica en julio de 2026. · Añade proyectos Code (desarrollo) y Work (análisis de documentos PDF, Excel y Word), además de un teclado por voz Voxtral con transcripción 100 % local. · Un modelo de entre 7B y 14B en Q4_K_M basta para controlar el agente (aproximadamente de 5 a 9 GB de VRAM). · El modo device mantiene todo en local; el modo cloud traslada la inferencia a la nube y envía los datos fuera del dispositivo: comprobarlo antes de introducir cualquier contenido sensible.

#¿Qué es LM Studio Bionic?

Bionic es una aplicación independiente, publicada por el mismo equipo que LM Studio. En lugar de acumular funciones de agentes en la aplicación de chat existente, la empresa decidió crear un producto separado, orientado a «hacer cosas» en lugar de «conversar». La idea: un agente local capaz de leer tus archivos, escribir código en un proyecto y mantener un contexto de trabajo persistente, sin enviar tus datos a un servicio de terceros por defecto.

En concreto, la palabra clave lm studio bionic se refiere a esta aplicación de agente: abres un proyecto, le das una tarea (analizar una carpeta de PDF, refactorizar un fragmento de código, resumir una hoja de cálculo), y el modelo local ejecuta una serie de pasos encadenando la lectura de archivos, el razonamiento y la escritura. El motor de inferencia sigue siendo el que conoces de LM Studio (llama.cpp / MLX internamente), con tus modelos GGUF o MLX ya descargados.

i
Aplicación separada, motor compartido
Bionic no reemplaza a LM Studio. Ambas aplicaciones pueden coexistir y comparten el mismo directorio de modelos. Sigues descargando tus GGUF en LM Studio clásico; Bionic los reutiliza para sus tareas de agente.

#Bionic vs LM Studio clásico: ¿cuál es la diferencia?

El kit de Agentes Locales

Acabas de ver un agente funcionando en local. El kit de Agentes Locales te enseña a construir uno que actúe de verdad (cap. 1), a ponerle límites antes de dejarlo actuar sobre tus archivos (cap. 4) y a medir si es fiable o si solo lo parece (cap. 14).

  • Espacio en línea de por vida
  • PDF + archivos
  • Actualizaciones de por vida

La confusión más frecuente es creer que Bionic es simplemente una actualización de LM Studio. Son dos apps con objetivos distintos. Aquí te explicamos cómo elegir entre ellas.

LM Studio clásico
Chat local, gestión y descarga de modelos (GGUF/MLX desde Hugging Face), servidor compatible con OpenAI, soporte MCP. Es tu centro de modelos y tu servidor de inferencia.
Bionic
Aplicación de agentes: proyectos persistentes (Code y Work), análisis de documentos, teclado de voz Voxtral y ejecución de tareas de varios pasos. Orientada a realizar trabajo, no a conversar.
Punto en común
Mismo equipo, mismo motor de inferencia local, misma biblioteca de modelos. Puedes servir un modelo desde LM Studio y trabajar en Bionic.
Cuándo usar cada uno
LM Studio para hablar, probar un modelo o exponer una API. Bionic cuando quieras que un agente lea tus archivos y produzca un resultado concreto.
→
Lo recomendable
Si lo que necesitas es «quiero hacer preguntas a un modelo», quédate con LM Studio clásico. Si es «quiero que trabaje con MIS documentos o MI código», la opción es Bionic.

#Prerrequisitos e instalación

Bionic funciona en las mismas plataformas que LM Studio (Windows, macOS Apple Silicon, Linux). Los requisitos del hardware dependen principalmente del modelo que vayas a ejecutar localmente para controlar al agente.

Modelo recomendado para el agente
Un modelo ajustado para seguir instrucciones de 7B a 14B en Q4_K_M basta para la mayoría de las tareas. Calcula aproximadamente 5 GB de VRAM para un 7B y aproximadamente 9 GB para un 14B.
Para programar en serio
Un modelo de 32B (≈19 GB en Q4) o un MoE como Qwen3 Coder da resultados claramente mejores en el razonamiento que abarca varios archivos.
Hardware de referencia
RTX 3060 12GB o 4070 12GB para los 7B-14B; RTX 4090 24GB o Mac M4 Pro (24-48 GB unificados) para los 32B y más.
Transcripción vocal
El teclado Voxtral funciona localmente mediante un pequeño modelo de voz a texto; prevé entre unos cientos de MB y 1-2 GB adicionales de memoria.
  1. 01
    1. Descargar Bionic
    Visita el sitio oficial de LM Studio (lmstudio.ai) y descarga el instalador Bionic para tu sistema operativo. Es una descarga distinta de la app LM Studio clásica.
  2. 02
    2. Indicar la ubicación de tus modelos
    La primera vez que se inicia, Bionic detecta la carpeta de modelos de LM Studio. Si empiezas desde cero, descarga primero un modelo instruct en la versión clásica de LM Studio y luego vuelve a iniciar Bionic.
  3. 03
    3. Elegir el modelo del agente
    En los ajustes de Bionic, selecciona el modelo local que dirigirá los proyectos. Comienza con un 7B-14B Q4_K_M para verificar que todo funcione antes de pasar a un modelo de gama superior.
  4. 04
    4. Verificar el modo device
    Por defecto, mantén la inferencia en modo device (local) para permanecer 100 % offline. Se detallará device vs cloud más abajo.

#Proyectos Code vs Work

El corazón de Bionic son los proyectos. Un proyecto agrupa un contexto de trabajo persistente: archivos, historial de tareas y el comportamiento del agente adaptado al tipo de trabajo. Bionic distingue dos familias.

Proyecto de código
Diseñado para el desarrollo: el agente lee una base de código, entiende la estructura, escribe y modifica archivos, ejecuta tareas de refactorización o generación. Es el equivalente local de un agente de codificación, sin enviar tu repositorio al cloud.
Proyecto Work
Orientado al trabajo de oficina y al análisis: el agente procesa documentos (PDF, Word, hojas de cálculo), produce resúmenes, extrae datos y redacta síntesis. Ideal para el seguimiento de información, la preparación de expedientes o el análisis documental.
Contexto persistente
Cada proyecto mantiene su historial y sus archivos asociados. Puedes cerrar Bionic y continuar desde donde lo dejaste, sin tener que reenviar el contexto en cada sesión.

La distinción Code/Work no es solo estética: cambia las herramientas que el agente tiene permiso para usar y la forma en que estructura sus respuestas. Un proyecto Code favorece la edición de archivos y la ejecución; un proyecto Work favorece la lectura, la extracción y la redacción.

→
Un proyecto = un objetivo
Evita crear un proyecto que mezcle de todo. Un proyecto por base de código o por carpeta de documentos mantiene el contexto limpio y mejora notablemente la pertinencia del agente, especialmente con un modelo local de tamaño modesto.

#Análisis de documentos, PDF y hojas de cálculo

Es la ventaja de los proyectos Work. Arrastras archivos al proyecto y el agente los lee para responder a tus solicitudes. Bionic admite de forma nativa varios formatos ofimáticos habituales.

PDF
Extracción del texto (y de la estructura cuando está bien definida) para resumir, hacer preguntas sobre varios documentos o compararlos.
Hojas de cálculo
Lectura de hojas Excel/CSV: el agente puede describir las columnas, calcular agregados simples, detectar anomalías o producir un resumen numérico.
Documentos Word / texto
Resúmenes, reescrituras, extracción de información clave, aplicación de formato a las notas.

El procesamiento se realiza a través del modelo local: tus documentos no abandonan la máquina mientras permanezcas en el modo device. Esta es la principal diferencia con un asistente en la nube: un expediente confidencial (contratos, datos de RR. HH., datos de salud) puede analizarse sin exfiltración.

!
Cuidado con la ventana de contexto
Un PDF grande o una hoja de cálculo voluminosa puede superar el contexto de un modelo 7B. Si las respuestas se vuelven incoherentes, divide el documento, aumenta el tamaño del contexto del modelo o pasa a un modelo con una ventana más amplia. La calidad del análisis depende directamente del modelo local elegido.

#Teclado por voz Voxtral: transcripción de voz local

Bionic incluye un teclado de voz basado en Voxtral, un modelo de reconocimiento de voz que se ejecuta localmente. Dictas tu solicitud, esta se transcribe a texto en tu equipo y luego se envía al agente. No se envía ningún audio a un servicio de transcripción en línea.

100 % local
La transcripción se realiza a través del modelo Voxtral cargado en memoria. Tu voz no pasa por ningún servidor, lo que la hace usable para contenido sensible o en entornos desconectados.
Casos de uso
Dictar una instrucción larga al agente, tomar notas de voz en un proyecto Work, describir una tarea de programación sin soltar el teclado físico.
Idiomas
Voxtral gestiona el francés y el inglés, entre otros; la calidad depende del modelo de transcripción instalado y de tu micrófono.
i
Voxtral ≠ el modelo de chat
Voxtral se encarga únicamente de convertir la voz en texto. Después, tu modelo agente (el 7B/14B/32B que has elegido) procesa el texto transcrito. Los dos modelos coexisten en memoria: tenlo en cuenta en tu presupuesto de VRAM.

#Modo dispositivo frente a nube: qué permanece en local

Bionic ofrece dos modos de inferencia, y este es el ajuste más importante que debes entender para mantener el control de tus datos.

Modo device (local)
La inferencia se ejecuta en tu máquina, con tus modelos GGUF/MLX. Nada sale: ni tus archivos, ni tus prompts, ni tu voz. Este es el modo que conviene priorizar para el autoalojamiento en sentido estricto.
Modo cloud
La inferencia se realiza en una máquina remota, lo que resulta útil para ejecutar modelos demasiado grandes para tu hardware. Es práctico, pero tus datos salen de tu máquina: reserva este modo para contenidos no sensibles.
Opciones por proyecto
Puedes mantener un proyecto Work confidencial en modo device y un proyecto Code menos sensible en modo cloud si necesitas un modelo más potente. Revisa el modo activo antes de cargar documentos sensibles.
!
Comprueba el modo antes de trabajar con información sensible
El modo cloud cambia la situación en cuanto a privacidad. Antes de arrastrar un contrato o datos personales a un proyecto, confirma que estás en modo device. Es la única garantía de que nada se envía por Internet.

#Ajustes importantes y huella local

Algunos parámetros marcan la diferencia entre un agente lento y frustrante y uno ágil y fiable.

Modelo de agente
La elección principal. Si es demasiado pequeño, el agente se pierde en las tareas de varios pasos; si es demasiado grande, funciona con lentitud. Un 14B Q4_K_M es un buen punto de equilibrio para empezar.
Tamaño de contexto
Auméntala si analizas documentos largos, pero vigila la VRAM: un contexto más grande consume más memoria.
Quantization
Q4_K_M para un equilibrio entre velocidad y calidad, Q5_K_M o Q8_0 si tienes suficiente VRAM y quieres más precisión en el código.
Offloading a la GPU
Carga tantas capas como sea posible en la GPU para ganar velocidad. Si el modelo no cabe, reduce el nivel de cuantización o el tamaño del modelo en lugar de descargar todo el procesamiento en la CPU.

En cuanto a lo que permanece en local: en modo device, toda la cadena —transcripción con Voxtral, lectura de tus archivos e inferencia del agente— se ejecuta en tu máquina. Bionic mantiene la filosofía de LM Studio: tus modelos, tus datos, tu hardware.


#Solución de problemas

Bionic no ve mis modelos
Asegúrate de que el directorio de modelos apunte al de LM Studio. Descarga al menos un modelo instruct en LM Studio clásico y luego vuelve a iniciar Bionic.
El agente es muy lento
Modelo demasiado grande para tu VRAM: recurre a la CPU mediante offload. Reduce el tamaño del modelo (32B → 14B) o baja un nivel de cuantización (Q8 → Q4_K_M).
Respuestas incoherentes sobre un documento extenso
El documento supera el contexto. Divídelo, aumenta el tamaño de contexto o elige un modelo con ventana más amplia.
El dictado por voz no se inicia
Verifica los permisos del micrófono en el sistema operativo y que el modelo Voxtral esté correctamente instalado. La transcripción local necesita memoria libre además de la que ocupa el modelo del agente.
Duda sobre la privacidad
Abre los ajustes y confirma el modo device. En la nube, los prompts y los archivos se envían a servidores remotos.

#Para ir más allá

Bionic se basa en el ecosistema LM Studio. Estas guías complementan los primeros pasos y te ayudan a elegir el modelo adecuado para controlar tus agentes.

Empezar con buen pie con LM Studio
« LM Studio en 2026: tutorial completo » — instalar la app clásica, descargar modelos y configurar el GPU, base esencial antes de Bionic.
Elegir tu cuantización
«Elegir la cuantización (Q4, Q5, Q8, FP16)» — para ajustar el equilibrio entre velocidad y calidad del modelo de tu agente.
RAG local
«RAG local con LM Studio: hablar con tus documentos» — para profundizar en el análisis documental más allá de los proyectos Work.
¿Esta guía te ha ayudado?

¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.