Imagen ilustrativa: Unsplash
Vídeo: canal Alejavi Rivera en YouTube. Los derechos del vídeo pertenecen a su autor.
Seamos honestos desde la primera línea: no existe ningún asistente de IA en la nube que sea a la vez gratuito, de primer nivel y literalmente sin límites. Sí existen planes gratuitos más generosos de lo que la gente cree, y una vía realmente ilimitada: ejecutar un modelo abierto en tu ordenador. Veamos los datos de cada opción.
Qué significa de verdad sin límites
Cuando un anuncio dice IA gratis y sin límites, conviene preguntar sin límites de qué. Hay cuatro techos distintos y casi nadie los distingue.
- Cupos por ventanas de tiempo. Casi ningún servicio te corta para siempre: te corta unas horas. Google documenta que los límites de las apps de Gemini se renuevan cada cinco horas, hasta un tope semanal. Es un cupo, aunque se recupere solo.
- Ventana de contexto. Es cuánto texto puede tener el modelo en la cabeza a la vez. En los planes gratuitos suele ser muy inferior a la de los de pago. Puedes tener mensajes casi ilimitados y aun así no poder analizar un documento largo.
- Marcas de agua. Las imágenes de planes gratuitos suelen llevar marca visible o marcado invisible tipo SynthID. Irrelevante para uso personal, no tanto si pensabas publicarlas como material propio.
- Licencia comercial. Usar algo gratis no siempre significa poder usarlo en tu negocio: hay diferencia entre una licencia permisiva y una con política de usos prohibidos.
Las opciones gratuitas más generosas hoy
ChatGPT
Probablemente el plan gratuito más amplio en número de mensajes de texto: OpenAI describe su plan Free con chats de texto ilimitados con el modelo ligero, sujetos a salvaguardas contra el abuso. La trampa está en lo demás: imágenes limitadas y más lentas, subida de archivos restringida, investigación profunda y memoria recortadas.
Google Gemini
El plan gratuito da acceso a los modelos de la familia Gemini, incluido el grande con menos usos. Google no publica cifras exactas de prompts diarios y admite que puede ajustar los topes según la demanda. La ventana de contexto reducida limita los trabajos serios.
DeepSeek
Su chat web sigue siendo gratuito y es de las opciones más desahogadas para texto y código. Conviene separar dos cosas que se confunden: el chat es gratis, pero la API es de pago por tokens. Si alguien te dice que la API de DeepSeek es gratis, no es exacto.
Qwen, Kimi, Mistral y Grok
Qwen (Alibaba) y Kimi ofrecen chats gratuitos muy amplios y son las opciones menos conocidas y más aprovechables. Mistral documenta en su plan gratuito un máximo diario de búsquedas web, generaciones de imagen, subidas de documentos y usos del intérprete de código. Grok mantiene un nivel gratuito con cuotas bastante ajustadas. Todos son útiles, ninguno es ilimitado.
La vía que sí es ilimitada: tu propio ordenador
Aquí la promesa del titular se cumple. Si descargas un modelo abierto y lo ejecutas en tu máquina no hay cupos, ni ventanas de cinco horas, ni tope semanal, ni necesidad de conexión. El único límite es tu hardware.
Cuánta memoria necesitas
La regla práctica: necesitas al menos tanta RAM (o memoria de la tarjeta gráfica) como ocupa el archivo del modelo, más 2 o 3 GB de margen. LM Studio recomienda oficialmente 16 GB de RAM, indica que con 8 GB solo funcionan modelos pequeños y sugiere al menos 4 GB de memoria de vídeo dedicada.
Qué modelos caben según tu equipo
- 8 GB de RAM: modelos de 3.000 a 4.000 millones de parámetros, que ocupan en torno a 2,5 GB. Sirven para redactar, resumir y traducir.
- 16 GB de RAM: el punto dulce. Entran modelos de 8.000 millones (unos 5 GB) y, con algo de ajuste, los de 12.000 a 14.000 millones (entre 7 y 10 GB).
- 32 GB de RAM o tarjeta gráfica potente: modelos de 30.000 millones de parámetros (unos 20 GB). Calidad muy cercana a la nube en tareas de texto.
Un detalle de licencias: fíjate en si el modelo se publica bajo Apache 2.0 o MIT, que son licencias abiertas homologadas y comercialmente permisivas, o bajo términos propios con política de usos prohibidos. Si vas a usarlo en tu empresa, importa.
Instalación con Ollama, paso a paso
- Entra en ollama.com/download y descarga el instalador de Windows, macOS o Linux.
- Instálalo con doble clic. En Linux basta una orden de terminal que la propia web te muestra.
- Abre una terminal y escribe
ollama run qwen3:4bpara un equipo modesto, oollama run qwen3:8bsi tienes 16 GB. - La primera vez descargará el modelo (varios GB). Las siguientes arranca en segundos.
- Ya puedes escribir en la terminal. Para salir, escribe
/bye.
Instalación con LM Studio
Si prefieres no tocar la terminal: descargas la aplicación desde lmstudio.ai, buscas el modelo en su catálogo interno, pulsas descargar y chateas en una interfaz parecida a la de ChatGPT. Además te avisa de si un modelo cabe en tu equipo antes de bajarlo.
Qué calidad puedes esperar en local frente a la nube
Un modelo de 8.000 millones de parámetros en tu portátil no iguala a los modelos frontera de la nube. En redacción, resúmenes, traducción, extracción de datos y programación sencilla la diferencia es hoy pequeña y a menudo imperceptible. En razonamiento complejo, matemáticas difíciles y tareas de varios pasos, la nube sigue ganando con claridad. Sin tarjeta gráfica dedicada, además, las respuestas salen a un ritmo lento pero legible.
La privacidad como ventaja real
Es la ventaja del uso local que no aparece en los titulares y probablemente la más valiosa. Cuando el modelo corre en tu ordenador, tus conversaciones no salen de tu disco duro: no hay servidor que las almacene, ni política de retención que leer, ni posibilidad de que se usen para entrenar nada. Para un abogado con expedientes o un periodista con fuentes, no es un extra: es el requisito.
Recomendación final según tu perfil
- Uso general y ocasional: ChatGPT gratis para texto, con Gemini de apoyo cuando necesites el modelo grande.
- Texto y código intensivos sin pagar: combina DeepSeek y Qwen. Cuando uno te limite, sigue en el otro.
- Documentos largos: ninguna opción gratuita en la nube sirve bien por la ventana de contexto. Aquí gana un modelo local con contexto amplio.
- Privacidad o trabajo sin conexión: Ollama o LM Studio, sin dudarlo.
- Uso comercial: revisa la licencia. Apache 2.0 o MIT te dejan tranquilo.
La conclusión honesta: sí, se puede tener IA gratis y casi sin límites, pero desbloquear no describe ningún truco secreto. Describe algo más aburrido y mucho más sólido: descargar un modelo abierto y ejecutarlo en tu propia máquina.
Fuentes: límites de uso de las apps de Gemini, planes y precios de ChatGPT, precios de la API de DeepSeek, requisitos de sistema de LM Studio y descarga de Ollama.
Relacionado: el límite gratuito que más sorprende es el de las APIs, porque no avisa: la aplicación se apaga. En error 429 en la API de Gemini está cómo distinguir un límite por minuto de una cuota diaria agotada.
No te pierdas lo próximo que publiquemos
Cada día, las noticias y guías de inteligencia artificial que importan, directas a tu correo.
Es gratis. Sin spam. Puedes darte de baja cuando quieras.