Principiante 9 minIDE

¿Claude Code gratis? Precios, opciones y modelos locaux

¿Claude Code gratis? No, no en su forma estándar: el agente de programación de Anthropic se instala sin pagar, pero solo funciona con una suscripción de pago o una cuenta de API facturada según el uso. Esta guía detalla qué es gratis y qué no, compara la suscripción y la facturación por token, y repasa las opciones reales para pagar menos, incluida la conexión de un modelo local mediante Ollama. La configuración técnica se trata en un tutorial separado.

Por Thomas P.·Actualización 2026-10-10·Probado en Windows, macOS y Linux

#Claude Code gratis: la respuesta breve

Claude Code es un agente de programación: un programa de línea de comandos, con extensiones para VS Code y los IDE de JetBrains, que lee tu repositorio, modifica archivos, ejecuta comandos y corrige sus errores. El programa se descarga e instala gratis. Pero no hace nada por sí solo: cada acción pasa por un modelo Claude alojado en Anthropic, y lo que se paga es ese acceso al modelo.

El plan gratuito de Claude.ai da acceso al chat web, no a Claude Code. Para usar el agente, necesitas una suscripción de pago (Pro, Max, Team o Enterprise) o una cuenta de API en la consola de Anthropic, facturada según el número de tokens consumidos. No existe una versión gratuita permanente de Claude Code con los modelos Claude.

El software
Gratis. Instalación mediante npm, script o extensiones del editor, sin pagar.
Los modelos Claude
De pago. Incluidos en una suscripción con límites de uso o facturados por token mediante la API.
El plan gratuito de Claude.ai
No cubre Claude Code. Sirve para chatear en el navegador o la aplicación.
Un modelo local en lugar de Claude
Es posible y sin suscripción: Claude Code acepta un servidor compatible, Ollama proporciona uno. La calidad no es la de los modelos Claude.
i
Lo que cubre esta guía
La cuestión del precio y las opciones para reducirlo. La configuración paso a paso de Ollama en Claude Code se encuentra en nuestro tutorial específico, enlazado al final de la página. Esta guía tampoco compara entre sí los agentes de código.

#Qué es gratuito y qué es de pago en Anthropic

El kit Copiloto Local

Esta guía te lleva al modelo. El kit te lleva al copiloto que programa en tu editor.

  • Espacio en línea de por vida
  • PDF + archivos
  • Actualizaciones de por vida

Anthropic vende el acceso a sus modelos de dos maneras distintas, y Claude Code puede utilizar cualquiera de ellas. La diferencia importa, porque la factura adopta una forma completamente distinta según el camino elegido.

Plan gratuito de Claude.ai
Chat limitado en el navegador y la aplicación. Sin acceso a Claude Code ni a la API.
Suscripciones Pro y Max
Tarifa mensual para una persona. Claude Code está incluido, dentro del límite de un volumen de uso que se renueva en ventanas de unas horas, con un tope semanal. Max es un nivel superior de Pro, con un volumen varias veces mayor.
Suscripciones Team y Enterprise
La misma lógica, facturados por puesto, con administración centralizada. Claude Code está disponible según las opciones del contrato.
API a través de la Console de Anthropic
No hay tarifa: pagas por cada millón de tokens leídos y cada millón de tokens generados. La tarifa depende del modelo (los modelos pequeños cuestan menos que los grandes) y los tokens de salida cuestan más que los tokens de entrada.
!
Los importes cambian: lee la página oficial
Deliberadamente no reproducimos aquí las tarifas. Anthropic las modifica, añade niveles y cambia la lista de modelos sin previo aviso. Solo la página de tarifas de Anthropic, enlazada al final de la guía, es la referencia válida el día que tomes la decisión. Como orden de magnitud, ya citado en nuestra guía Ollama + Claude Code: la suscripción inicial ronda los veinte dólares al mes. Los precios se muestran en dólares, sin impuestos; el IVA se añade según tu país.

Un detalle que suele sorprender: con una suscripción, la cuenta es la misma que para Claude.ai. Inicias sesión en Claude Code con tus credenciales de Claude, y el volumen consumido por el agente se comparte con tus conversaciones del chat. Con la API, creas una clave en la Console, añades crédito y cada sesión de Claude Code descuenta ese crédito.

#¿Suscripción o API: cuál cuesta menos?

La respuesta depende del volumen. Un agente de código consume muchos más tokens que un chat: en cada turno, vuelve a enviar al modelo el historial de la conversación, el contenido de los archivos leídos y los resultados de los comandos. En un repositorio de tamaño medio, una sola tarea de refactorización representa fácilmente varios cientos de miles de tokens de entrada. Si se factura por token, este volumen se refleja en la factura; en una suscripción, lo absorbe la tarifa hasta el límite de la ventana.

Uso ocasional
Unas pocas sesiones por semana, en proyectos personales: la suscripción básica suele ser suficiente y su límite protege frente a sorpresas desagradables.
Uso diario intensivo
El agente funciona todo el día: la suscripción sigue siendo predecible, pero los límites de ventana se hacen notar. Max o la API se convierten en las dos opciones que comparar según tu propio volumen.
Equipo
Team o Enterprise para gestionar puestos y centralizar la facturación; la API para herramientas internas compartidas.
Automatización
Scripts, integración continua, Agent SDK: estos usos pasan por la API y una clave, no por una suscripción personal.

Con la API, Claude Code muestra el gasto de la sesión actual. Con una suscripción, muestra el estado de los límites. Estos dos comandos son el primer paso antes de intentar reducir el coste: solo se puede reducir bien lo que se mide.

En una sesión de Claude Code
/cost     # dépense de la session (facturation API)
/usage    # limites restantes de l'abonnement
/compact  # résume la conversation pour alléger le contexte
/model    # change de modèle (un modèle plus petit coûte moins cher)
→
La caché de prompts juega a tu favor
La API de Anthropic cobra menos por los tokens de entrada que ya se han enviado y almacenado en caché. Claude Code aprovecha esto automáticamente con el historial de la sesión. En la práctica, encadenar tareas en una misma sesión cuesta menos que volver a iniciar el agente desde cero con el mismo contexto, siempre que la conversación siga siendo razonable.

#Reducir la factura sin dejar Claude Code

Antes de cambiar de herramienta, varios ajustes reducen el consumo de tokens y, por tanto, el coste de la API o la velocidad a la que una suscripción alcanza su límite. No requieren ninguna instalación.

  1. 01
    Elegir el modelo según la tarea
    Los modelos Claude no cuestan lo mismo. Cambiar nombres de variables, escribir una prueba unitaria o explicar una función no requiere el modelo más caro. Cambia al modelo más pequeño con /model para esas tareas y vuelve al modelo grande para la arquitectura o la depuración difícil.
  2. 02
    Limitar lo que lee el agente
    Cada archivo leído entra en el contexto y permanece allí hasta el final de la sesión. Da instrucciones precisas («modifica únicamente el módulo de pagos»), evita iniciar el agente en un repositorio enorme sin delimitarlo y mantén un archivo CLAUDE.md breve: se inyecta en cada turno.
  3. 03
    Limpiar la sesión
    Ejecuta /clear entre dos tareas sin relación y /compact cuando continúe una conversación larga. Un historial de dos horas reenviado con cada mensaje es el primer gasto importante.
  4. 04
    Preferir la suscripción si el uso es habitual
    Una tarifa limita el gasto. Si ves que la factura mensual de la API supera el precio de una suscripción, cámbiate. Lo contrario también es cierto: un uso poco frecuente sale más barato pagando por token.
  5. 05
    Usar un proveedor cloud con el que ya tengas contrato
    Claude Code funciona oficialmente con los modelos Claude ofrecidos por Amazon Bedrock, Google Vertex AI y Microsoft Foundry. Si tu empresa ya tiene créditos o un compromiso con alguno de ellos, la factura pasa por esa cuenta, según las condiciones del proveedor.
  6. 06
    Delegar parte del trabajo a un modelo local
    Es la opción más radical: cero suscripción para las tareas confiadas al modelo local. Tiene sus límites, que se detallan en la sección siguiente.

#Claude Code con un modelo local: qué cambia

Claude Code se comunica con su modelo mediante la API Messages de Anthropic. Desde sus versiones recientes, Ollama ofrece una API compatible con este formato, y Claude Code acepta una dirección de servidor alternativa mediante la variable ANTHROPIC_BASE_URL. Resultado: conservas la interfaz, los comandos y el funcionamiento de Claude Code, pero el modelo que responde es un modelo de pesos abiertos descargado en tu máquina. No se envía ningún token a Anthropic ni se necesita ninguna suscripción.

Método rápido con un Ollama reciente
ollama launch claude
# Ollama propose un modèle, puis démarre Claude Code branché dessus

La documentación de Ollama también describe el método manual mediante variables de entorno, útil para un script o un alias. Nuestro tutorial Ollama en Claude Code y Cursor lo explica en detalle, junto con la elección del modelo y los ajustes de contexto; no lo repetimos aquí.

!
No es Claude
Un modelo local de 9 a 30 mil millones de parámetros, con cuantización Q4, no alcanza el nivel de los modelos Claude en tareas de agente largas: encadenar diez llamadas a herramientas dependientes, mantener el hilo en un repositorio entero o corregir un error sutil. Se desenvuelve bien en tareas cortas y bien delimitadas. Prometer una equivalencia sería falso; el uso adecuado es híbrido.
Lo que ganas
No hay más suscripción para las tareas confiadas al modelo local, no se envían datos a terceros, funciona sin conexión y no hay límite de ventana.
Lo que pierdes
La calidad de los modelos Claude en el razonamiento prolongado, el contexto de varios cientos de miles de tokens y el conocimiento de las bibliotecas más recientes.
Lo que sigues pagando
El hardware y la electricidad. Una tarjeta gráfica funcionando bajo carga durante horas se nota en la factura energética, aunque el orden de magnitud siga siendo muy inferior al de una suscripción.
El modelo debe gestionar las herramientas
Claude Code se basa en las llamadas a herramientas (leer, editar, ejecutar). Un modelo sin esta capacidad hace que el agente sea inutilizable. Las familias citadas en este sitio para código, Qwen3-Coder, Devstral, gpt-oss y GLM Flash, la admiten.

En cuanto al hardware, se aplican las referencias del sitio: un modelo de 7 mil millones de parámetros en Q4 ocupa aproximadamente 5 GB de memoria de vídeo, uno de 14B unos 9 GB y uno de 32B unos 19 GB, sin contar el contexto. Una RTX 3060 de 12 GB es el mínimo útil para un agente de código; una tarjeta de 16 a 24 GB o un Mac con memoria unificada permiten usar modelos de 24 a 30B, mucho más cómodos en modo agente. Para que un agente lea varios archivos hace falta un contexto amplio, de 32 000 tokens o más; consume memoria adicional a la del modelo.

i
Un modelo «cloud» de Ollama no es local
El selector de Ollama también ofrece modelos cuyo nombre termina en cloud. Se ejecutan en los servidores de Ollama, con un nivel gratuito limitado y después una oferta de pago. Es práctico para probar un modelo muy grande, pero tus datos salen al exterior y el coste vuelve a aparecer. Nuestra guía sobre Ollama Cloud explica sus límites en detalle.

#Proveedores compatibles: pagar menos sin hardware

Entre la suscripción de Anthropic y el modelo local existe una tercera vía: conservar Claude Code, pero conectarlo a otro servidor remoto distinto del de Anthropic. Se presentan tres familias de proveedores, con garantías muy diferentes.

Los servicios cloud admitidos oficialmente
Amazon Bedrock, Google Vertex AI y Microsoft Foundry sirven los modelos Claude reales. Claude Code los admite de forma nativa; la facturación sigue la cuenta de la nube. La misma calidad, otra factura y, en ocasiones, una ubicación de los datos elegida.
Los proveedores de modelos con pesos abiertos
Varios proveedores de modelos abiertos (GLM de Z.ai, Kimi de Moonshot, DeepSeek, MiniMax, entre otros) ofrecen una API con el formato de Anthropic y documentan su uso con Claude Code, por lo general a precios más bajos. Ya no responde Claude: la calidad es la del modelo elegido y los servidores suelen estar fuera de la Unión Europea.
Las pasarelas empresariales
Un proxy como LiteLLM, situado delante de varios proveedores, permite dirigir cada solicitud al modelo más barato que resulte adecuado, con un seguimiento de los costes por equipo. Claude Code se conecta a él como a cualquier servidor compatible.

Antes de confiar tu código a un proveedor compatible, comprueba cinco puntos: la compatibilidad real con la API de Messages y las llamadas a herramientas, el tamaño de contexto aceptado, el país de alojamiento y las condiciones de uso de los datos, el precio por millón de tokens de entrada y de salida, y la existencia de un límite de gasto. Una tarifa baja sin límite sigue siendo un riesgo.

!
Código confidencial: lee las condiciones
Un proveedor más barato puede conservar tus consultas o utilizarlas para entrenar sus modelos. Para código sujeto a un acuerdo de confidencialidad o al RGPD, la única opción sin transferencia de datos es el modelo local; en su defecto, una nube con alojamiento europeo y un contrato claro.

#Alternativas gratuitas a Claude Code

Si el objetivo es un agente de programación sin suscripción, en lugar de Claude Code en particular, algunas herramientas abiertas hacen el mismo trabajo con un modelo local. Son gratuitas en sentido estricto: sin licencia ni tarifa. Queda el hardware.

OpenCode + Ollama
Agente de programación en el terminal, de código abierto y muy similar a Claude Code en el uso. Ollama sabe ejecutarlo directamente con un modelo local. Consulta nuestra guía OpenCode + Ollama.
Cline + Ollama
Agente de programación en VS Code, con modo de planificación y modo de ejecución. Nuestra guía Cline + Ollama detalla la configuración y los modelos adecuados según la memoria de vídeo.
Alternativas locales a Copilot
Para completar código en el editor, Tabby y CodeGeeX complementan Cline. Consulta nuestra guía sobre las alternativas gratuitas a Copilot.
APIs gratuitas con cuotas
Algunos proveedores ofrecen un volumen gratuito, limitado y a veces a cambio de tus datos. Nuestra comparativa de las API de LLM gratuitas explica dónde se detienen y cuándo el uso local se vuelve más conveniente.

La palabra «gratis» requiere una precisión. Un agente local en una tarjeta de 12 GB funciona sin ningún gasto mensual, pero consume electricidad y presupone que ya tienes un ordenador equipado. Si necesitas comprar una tarjeta gráfica, compara su precio con varios años de suscripción antes de decidir; el cálculo no es el mismo para un uso recreativo que para un uso profesional diario.

#Qué opción te conviene: matriz de decisión

¿Quieres probar Claude Code sin pagar?
Instálalo, conéctalo a Ollama con un modelo de programación de 9 a 14B. Descubrirás la interfaz y el funcionamiento de un agente; no estarás evaluando la calidad de Claude.
Desarrollador independiente, uso habitual
Suscripción Pro, y después Max si los límites resultan molestos. Un modelo local en paralelo para las tareas sencillas y el trabajo sin conexión.
Código confidencial o de un cliente sujeto a un acuerdo de confidencialidad
Modelo local para este repositorio, Claude Code u OpenCode a elección. La nube para el resto.
Equipo de varias personas
Team o Enterprise, o una nube ya contratada (Bedrock, Vertex, Foundry) conectada a Claude Code. Una pasarela si quieres hacer un seguimiento de los costes por proyecto.
Presupuesto reducido, tarjeta de 12 GB
Agente local con un modelo de 9B en Q4, aceptando sus limitaciones. Suscripción inicial el mes en que un proyecto exija algo mejor.
Sin tarjeta gráfica
Suscripción o proveedor compatible tras verificar las condiciones. Un modelo local ejecutado solo con el procesador es demasiado lento para un agente de código.

#Preguntas frecuentes

Precio y gratuidad de Claude Code
¿Claude Code es gratis?+
El software sí, el uso no. Claude Code solo funciona con una suscripción de pago de Claude (Pro, Max, Team, Enterprise) o con una cuenta de API facturada por token. El plan gratuito de Claude.ai no da acceso.
¿Se puede probar Claude Code gratis?+
No existe una prueba gratuita permanente documentada para Claude Code con los modelos Claude; las posibles promociones se anuncian en el sitio web de Anthropic. La forma gratuita de probar la interfaz es conectar Claude Code a un modelo local mediante Ollama.
¿Cuánto cuesta Claude Code?+
Depende de la vía: una tarifa mensual con la suscripción o una factura proporcional a los tokens con la API. Los importes cambian; la página de precios de Anthropic es la referencia. Para un uso habitual, la suscripción suele ser más predecible.
Claude Code con Ollama, ¿es realmente gratis?+
Sí, en el sentido de que ya no hay suscripción ni factura por token: Ollama y los modelos de pesos abiertos son gratuitos. Pagas el hardware y la electricidad, y pierdes la calidad de los modelos Claude en las tareas largas.
¿Un modelo local está a la altura de Claude en Claude Code?+
No. Un modelo de 9 a 30B en Q4 resuelve tareas cortas y bien delimitadas, pero no sesiones largas de agente en un repositorio grande. El uso razonable es híbrido: local para el día a día y lo confidencial; Claude para lo difícil.
¿Claude Code funciona sin conexión?+
Solo con un modelo local. Conectado a Ollama, el agente no necesita ninguna conexión. Con una suscripción o la API, cada acción pasa por los servidores de Anthropic.

#Para ir más allá

Ahora ya sabes qué es gratis o de pago y qué opción corresponde a tu situación. El paso lógico siguiente es la configuración, que se trata en las guías siguientes.

Guía redactada el 10 de octubre de 2026. Las reglas de acceso (plan gratuito sin Claude Code, suscripciones o API) corresponden a la documentación de Anthropic; los importes no se reproducen aquí porque cambian, y la página oficial de tarifas es la referencia válida. El método de conexión a Ollama sigue la página de integración de la documentación de Ollama, cuyos comandos cambian de una versión a otra.

¿Esta guía te ha ayudado?

¿Un comentario, un error, una precisión? Avísanos, eso mejora la guía para todos.