Inicio Noticias Inteligencia Artificial Gadgets Guías y Tutoriales Tutoriales IA Reviews 📬 Newsletter

Ollama: cómo tener tu propia IA gratis y sin límites en tu PC

Hoy te enseño a montar tu propia inteligencia artificial en local. Sin suscripciones, sin enviar tus datos a nadie, sin límites de uso. Ollama ha pasado de herramienta para frikis del terminal a algo que cualquiera instala en cinco minutos.

En resumen

  • Instala Ollama en 5 minutos y olvídate de suscripciones. Te enseño a chatear, programar y crear asistentes con IA 100% local y privada. Casos reales, paso a paso.
  • Aquí está la gracia del asunto. Todo lo que escribes se queda en tu ordenador. Nada de "tus conversaciones pueden ser revisadas por nuestros ingenieros".
  • Eso arranca Claude Code usando modelos locales de Ollama como backend, en vez de la API de pago de Anthropic. Lo mismo con ollama launch codex para Codex.
Ollama: IA local gratis y sin límites

🎬 IA GRATIS: cómo usar Ollama paso a paso — Canal: Fazt Code (24K visualizaciones)

Ollama empezó como un proyecto open source para ejecutar modelos de lenguaje en local sin volverte loco con las dependencias. Hoy acumula 173.000 estrellas en GitHub y 5.403 commits, soporta cientos de modelos, se integra con Claude Code y OpenAI Codex, y acaba de lanzar soporte para OpenJarvis, un framework de agentes de IA personales que corren en tu propio hardware. Todo esto sin pagar un euro.

Si llevas tiempo pagando 20 euros al mes por ChatGPT Plus y solo lo usas para resumir PDFs y redactar correos, tengo buenas noticias. Si te preocupa que tus conversaciones acaben entrenando el siguiente modelo de OpenAI, también. Vamos con cinco casos prácticos para que le saques partido desde el minuto uno.

🧩 Caso 1: Instalar Ollama y tu primer modelo

Esto es absurdamente fácil. Vas a ollama.com, descargas el instalador para macOS, Windows o Linux, y en menos de dos minutos tienes el motor funcionando. Abres el terminal y escribes:

ollama run gemma3

Y ya está. Gemma 3, el modelo abierto de Google, se descarga y empieza a responder. Sin configuraciones raras, sin CUDA, sin pelearte con dependencias de Python.

Si prefieres una interfaz visual, la nueva app de escritorio —lanzada en julio de 2025— te da una ventana de chat como la de ChatGPT pero corriendo en tu máquina. El catálogo de modelos disponibles va desde ligeros de 1-3B para portátiles hasta bestias de 70B o 120B si tienes una GPU con memoria de sobra.

El dato que me flipa: Ollama ahora usa MLX en Apple Silicon, el framework de machine learning de Apple. Si tienes un Mac con chip M, la velocidad se ha duplicado respecto a hace unos meses. En mi MacBook Air M3, Gemma 3:12B genera a unos 25 tokens por segundo. Más que suficiente para una conversación fluida.

Alejavi Rivera lo resumió bien en su vídeo sobre Ollama: "Ahora podemos ejecutar funciones y modelos avanzados de IA de forma abierta, privada e ilimitada". Y recomienda Mammouth AI como interfaz complementaria si quieres aún más potencia visual.

🧩 Caso 2: Chatear y trabajar sin enviar nada a la nube

Aquí está la gracia del asunto. Todo lo que escribes se queda en tu ordenador. Nada de "tus conversaciones pueden ser revisadas por nuestros ingenieros". Nada de límites de 50 mensajes cada 3 horas.

Para tareas de ofimática y consultas generales, modelos como Gemma 3:12B, Llama 3.2 o Qwen 3.5 te dan una calidad comparable a ChatGPT-4o para el 90% de lo que haces a diario: resumir documentos, redactar correos, traducir textos, hacer brainstorming. Todo offline.

Si quieres una interfaz más completa que la app por defecto, instala Open WebUI. Es un clon de ChatGPT que se conecta a tu Ollama local, con historial de chats, subida de documentos y RAG —búsqueda en tus propios PDFs—. Se instala con Docker en un solo comando. En diez minutos tienes tu propio ChatGPT privado.

Xataka incluyó a Ollama como una de las mejores aplicaciones para tener IA local en el móvil o PC, destacando que es "posiblemente una de las aplicaciones más populares para descargar modelos de IA en tu ordenador". Lo mismo opinan en su análisis sobre IA sin conexión: "Ollama es más técnico pero más flexible" que las alternativas visuales.

🧩 Caso 3: Programar con IA gratis usando Ollama + Claude Code

Esto es donde Ollama se ha puesto las pilas de verdad en 2026. Antes necesitabas una suscripción a Claude o ChatGPT para tener un asistente de código que valiera la pena. Ahora Ollama se integra directamente con Claude Code, Codex de OpenAI, OpenCode y Copilot CLI.

El comando mágico:

ollama launch claude

Eso arranca Claude Code usando modelos locales de Ollama como backend, en vez de la API de pago de Anthropic. Lo mismo con ollama launch codex para Codex. El resultado: un asistente de programación que lee tu código, sugiere cambios, escribe tests y hace refactors sin costarte nada.

En enero de 2026 Ollama anunció compatibilidad total con la API de Anthropic Messages. Traducción: cualquier herramienta que funcione con Claude puede usar modelos open source a través de Ollama. Qwen3-Coder-30B, actualizado en octubre de 2025, tiene llamadas a herramientas más rápidas y fiables. DeepSeek Coder V2 también va de maravilla.

Benjamín Cordero probó OpenClaw + Ollama con varios modelos en su canal. Su veredicto: para código del día a día, Qwen Coder 30B local iguala a Claude 3.5 Sonnet en precisión, aunque es más lento. Si tienes una GPU con 24 GB de VRAM, vas sobrado.

El curso completo de Apasoft Training —54 minutos, 13.000 visualizaciones— cubre exactamente este flujo: instalar, descargar modelos para código y conectar Ollama con entornos de desarrollo.

🧩 Caso 4: Modelos que no caben en tu PC (Ollama Cloud)

No todos tenemos una RTX 4090 en casa. Para eso Ollama lanzó Cloud Models en septiembre de 2025. La idea: ejecutas los modelos más pesados en servidores de Ollama pagando solo por lo que usas, pero mantienes tus herramientas y flujos de trabajo locales.

Modelos como Qwen3-Coder-480B, GLM-4.6 o gpt-oss:120B son imposibles de mover en un ordenador doméstico. Con Ollama Cloud los lanzas desde el mismo terminal, con los mismos comandos, pero el cómputo ocurre en servidores externos. La capa gratuita incluye búsquedas web y un número generoso de consultas.

Los planes de pago empiezan en 200 dólares al año para el plan Pro. No es gratis, pero es un 80% menos que una suscripción a ChatGPT Enterprise o Claude Max para uso profesional intensivo. Y tus datos siguen siendo tuyos: los modelos se ejecutan en infraestructura de Ollama, no de Google o Microsoft.

Fazt Code dedicó un capítulo entero de su tutorial a explicar cómo alternar entre modelos locales y cloud sin cambiar de entorno. Mismo comando ollama run, distinto backend.

🧩 Caso 5: OpenJarvis, tu asistente personal siempre disponible

El 28 de mayo de 2026 —hace cuatro días— Ollama anunció soporte para OpenJarvis 1.0. Es un framework open source para construir agentes de IA personales que se ejecutan en tu propio hardware. Piensa en un asistente que lee tus correos, organiza tu calendario, busca información por ti y no filtra nada a terceros.

OpenJarvis usa Ollama como backend y está pensado para funcionar 24/7 en un equipo doméstico. Los modelos más ligeros —7B a 12B— bastan para automatizaciones y agentes sencillos. Si quieres algo más ambicioso, OpenClaw conecta Ollama con WhatsApp, Telegram, Slack y Discord para tener un asistente que te responde desde cualquier app de mensajería. También se lanza con ollama launch openclaw.

El combo Ollama + OpenJarvis + Open WebUI te da algo que ni ChatGPT ni Claude ofrecen hoy: un asistente de IA privado, siempre disponible, que controlas tú al 100%. Sin límites de uso, sin suscripciones, sin que una empresa decida qué puedes preguntar y qué no.

Ollama ha pasado en año y medio de proyecto de nicho a puerta de entrada a la IA local para cualquiera. La instalación es trivial, el catálogo de modelos es enorme, y las integraciones con herramientas de código y asistentes personales lo han sacado del terminal para meterlo en el flujo de trabajo diario.

Lo único que necesitas es un ordenador razonablemente moderno con 16 GB de RAM. Si tienes una GPU con 8 GB de VRAM o más, ya vas sobrado para modelos de 7B-12B. Si tienes un Mac con Apple Silicon, MLX te da un extra de velocidad que se nota.

Instala Ollama, prueba Gemma 3 o Llama 3.2, y dime si echas de menos los límites de ChatGPT.