El mejor agente de programación del mercado ya no obliga a pagar suscripción de Anthropic. Claude Code con Ollama se convierte en un desarrollador autónomo que lee tu repositorio, edita archivos, ejecuta comandos y hasta se encarga de tareas programadas por su cuenta, apuntando a modelos locales o de la nube. Yo lo uso a diario con kimi-k2.7-code:cloud —con la suscripción Pro de Ollama Cloud—, y esta es la guía que me habría gustado encontrar el primer día: instalación, modelos, coste real y límites honestos.
Por qué usar Claude Code con Ollama
Claude Code es la herramienta de código basada en agentes de Anthropic: una capa que envuelve al modelo y lo transforma en un compañero de desarrollo con manos. Conversa contigo, ejecuta comandos pasando por su flujo de permisos, edita tu proyecto, reparte trabajo entre subagentes, busca en la web, recupera y resume páginas, analiza capturas de pantalla y hasta piensa paso a paso cuando el problema lo exige. De fábrica, sin embargo, solo conversa con los modelos de Anthropic.
La pieza que falta la pone Ollama: su API compatible con Anthropic acepta las conexiones del agente y las redirige al modelo que tú elijas, sea local en tu GPU o en la nube de Ollama. Mismo arnés premium, motor a tu elección. Si quieres verlo frente a las otras once opciones del ecosistema, tengo un ranking completo de arneses para Ollama Cloud donde entra en detalle.
Requisitos previos
La lista es corta: una instalación reciente de Ollama, el CLI de Claude Code y un modelo con ventana de contexto de 64.000 tokens o más —crucial si trabajas con repositorios grandes, donde el agente necesita margen para respirar—. Si vas a usar modelos locales, la VRAM de tu gráfica fija el techo de lo que puedes cargar: mi guía para elegir LLM según tu hardware te dice cuánto aguanta la tuya. Para los modelos de nube basta una cuenta de Ollama con suscripción.
Instalación de Claude Code con Ollama paso a paso

Método rápido: un solo comando
Si ya tienes Ollama, la vía exprés cabe en una línea. Ollama se encarga de los selectores, descarga el modelo si hace falta y arranca el agente apuntando a sus modelos. Sin variables de entorno, sin scripts, sin sorpresas:
ollama launch claudeMétodo manual: variables de entorno
Si prefieres control fino —o tu instalación no usa el lanzador integrado—, el camino clásico es instalar el CLI y declarar tres variables de entorno que redirigen la autenticación y el endpoint hacia Ollama. En macOS y Linux:
curl -fsSL https://claude.ai/install.sh | bash
export ANTHROPIC_AUTH_TOKEN=ollama
export ANTHROPIC_API_KEY=""
export ANTHROPIC_BASE_URL=http://localhost:11434En Windows el instalador cambia por irm https://claude.ai/install.ps1 | iex, pero las variables son idénticas. Con el entorno preparado, arrancas el agente con el modelo que prefieras:
claude --model qwen3.5Y si lo quieres todo en una sola línea, con el modelo de nube que uso a diario:
ANTHROPIC_AUTH_TOKEN=ollama ANTHROPIC_BASE_URL=http://localhost:11434 ANTHROPIC_API_KEY="" claude --model kimi-k2.7-code:cloudUna vez tienes Claude Code con Ollama en marcha, cada arranque posterior es inmediato: el agente queda apuntando a localhost:11434 y tú eliges motor en cada sesión.
Qué modelo usar: local gratis o cloud con suscripción

Aquí viene el matiz que muchas guías pasan por alto, y la razón por la que este título no promete oro. Con modelos locales, el coste es cero: tu GPU pone el hardware y Ollama el resto. Con los modelos cloud de Ollama —como kimi-k2.7-code, el que uso yo— necesitas una suscripción de Ollama Cloud; en mi caso, el plan Pro. Lo que desaparece en ambos casos es la factura de Anthropic: el token ollama sustituye su autenticación por completo.
En local, con 24 GB de VRAM el Qwen 3.6-27B es el todoterreno y Devstral Small 24B el especialista en trabajo multi-archivo; con 16 GB, Qwen3-Coder-Next ofrece lo mejor de ambos mundos gracias a su arquitectura MoE. Y si tu gráfica es más modesta, en la guía de modelos por hardware tienes opciones desde 8 GB. En la nube, kimi-k2.7-code:cloud soporta visión, herramientas y razonamiento a la vez, y está optimizado para tareas largas de código con un 30% menos de tokens de razonamiento que su predecesor. Para experimentar con visión, gemma4:cloud hace perfectamente el apaño.
Mi combinación favorita de Claude Code con Ollama es la nube para el trabajo pesado y un modelo local para sesiones rápidas: cambiar de motor es solo un flag.
Lo que puedes hacer a diario
El valor real no está en el chat, sino en lo que el agente orquesta. Los subagentes reparten el trabajo en paralelo: uno analiza el esquema de la base de datos, otro escribe los tests, otro documenta mientras tú sigues con el código. El comando /loop, por su parte, programa tareas recurrentes dentro de la sesión:
/loop 30m Revisa mis PRs abiertos y resume su estado
/loop 1h Investiga las novedades de IA y prepara un resumen
/loop 15m Mira los issues nuevos de GitHub y clasifícalos por prioridadLa búsqueda web y la recuperación de páginas van por la API de Ollama, así que el agente consulta la web sin salir del flujo de trabajo. La visión te permite enviar capturas de pantalla y pedir cambios señalando lo que ves, algo que se agradece al depurar interfaces. Para scripts, Docker o pipelines de CI existe el modo sin interacción:
ollama launch claude --model gemma4:cloud --yes -- -p "how does this repository work?"Y si quieres pilotarlo desde el móvil, hay plugin oficial de Telegram: creas el bot con @BotFather y lanzas el agente con --channels plugin:telegram@claude-plugins-official, configurando reglas de permisos para que pueda actuar con autonomía.
Limitaciones honestas
Ni todo es oro ni todo es gratis. Los modelos locales todavía no igualan a Claude Opus 5 en los benchmarks de agentes de código: si tu trabajo exige lo máximo, la nube sigue mandando. El contexto fija otro límite real: por debajo de 64k de ventana, los repositorios grandes hacen sufrir al agente. La suscripción de Ollama Cloud es un coste mensual que este título prefiere no esconder. Y el flujo de permisos, aunque agradecido en el día a día, se vuelve pesado en la automatización sin vigilancia: para eso, mejor entornos aislados y reglas claras.
Conclusión: el arnés top, a tu manera
Claude Code con Ollama convierte tu terminal en un equipo de desarrollo completo: el mejor agente del mercado, el modelo que tú decidas y la libertad de no depender de una sola factura. Empieza con ollama launch claude, prueba un modelo local y sube a la nube cuando el trabajo lo pida. Los detalles técnicos están en la documentación oficial de Ollama; el resto es práctica.
Parte de este contenido ha sido generado con IA y revisado por el autor.




