No necesitas una suscripción para construir flujos de trabajo de producción. Dedica tres meses a probar todos los niveles gratuitos que existen, y te darás cuenta de que la mayoría funcionan mejor que las versiones de pago para tareas específicas; simplemente son peores en las cosas por las que la gente paga.
Esta no es una lista de «20 alternativas gratuitas a ChatGPT». Son 20 herramientas donde el nivel gratuito no es una demo limitada. Puedes lanzar proyectos con ellas.
Generación de Texto y Código
Claude (Claude.ai, nivel gratuito). Anthropic te da 5 mensajes cada 8 horas en Claude 3.5 Sonnet a través de la interfaz web. No es suficiente para producción, pero es perfecto para probar antes de gastar dinero en la API. La restricción fuerza la eficiencia: escribes indicaciones (prompts) más concisas. Prueba tu idea aquí primero.
ChatGPT (gratis, GPT-4o mini). OpenAI cambió su nivel gratuito a gpt-4o-mini a finales de 2024. Obtienes 3 horas de GPT-4o cada 3 días, más gpt-4o-mini ilimitado. Para extracción estructurada, clasificación y resúmenes cortos, gpt-4o-mini cierra el 90% de la brecha con el GPT-4o completo a un costo un 95% menor. Empieza aquí antes de actualizar al modelo 4o.
Llama 2 y 3 (Meta, varias plataformas). Descárgalo gratis. Ejecútalo localmente con 16 GB de RAM usando llama.cpp u Ollama. Sin costos de API, sin seguimiento de uso, sin límites de tasa. Para herramientas internas y experimentos, esto elimina la pregunta de si actualizar a un nivel de pago: no hay nivel. La latencia importa más que la velocidad aquí; las respuestas tardan de 10 a 30 segundos localmente frente a 1-2 segundos en la API en la nube. El compromiso es real.
Mistral 7B (gratis, Hugging Face). Inferencia más rápida que Llama 3 en el mismo hardware. Mejor en salida estructurada y llamadas a funciones de lo que esperarías de un modelo de 7B. El nivel gratuito en la API de Mistral te da tokens limitados, pero la versión de Hugging Face no tiene restricciones. Si necesitas extracción rápida, local y confiable, este modelo supera a modelos más grandes en la relación velocidad-precisión.
Kits de Herramientas de Prompts e Iteración
Prueba de Prompts (plantillas de PromptAndLearn). Este sitio publica plantillas de prompts para tareas comunes: extracción, resumen, clasificación, anclaje. No es una herramienta, sino una biblioteca. Copia la plantilla, adáptala a tu dominio, pruébala en el nivel gratuito de Claude o ChatGPT antes de escalar a producción.
LangChain (código abierto). Framework para encadenar llamadas a LLM con recuperación, memoria y herramientas externas. Gratis. Autoalojado. La curva de aprendizaje es pronunciada, pero una vez que entiendes el patrón de cadena de pensamiento que permite, dejas de pensar en el LLM como una caja independiente y empiezas a pensar en él como un componente de un sistema más grande.
LlamaIndex (código abierto). Más simple que LangChain para una tarea específica: conectar un LLM a tus datos. Si estás construyendo RAG (generación aumentada por recuperación) y no quieres codificar manualmente la lógica de fragmentación, incrustación y recuperación, LlamaIndex se encarga de ello. Gratis. Funciona con modelos locales o APIs en la nube.
Embeddings y Búsqueda Vectorial
Sentence Transformers (código abierto). Genera embeddings localmente gratis. Modelos como all-MiniLM-L6-v2 se ejecutan en CPU y convierten texto en vectores de 384 dimensiones. Combinado con el nivel gratuito de Chroma o Pinecone, tienes una base de datos vectorial funcional sin pagar por los embeddings. El compromiso: los embeddings de modelos abiertos se clasifican ligeramente por debajo de los de OpenAI o Cohere en benchmarks de similitud semántica, pero la diferencia de costo lo justifica para la mayoría de los usos internos.
Chroma (código abierto, autoalojado). Base de datos vectorial en memoria. Gratis. Sin dependencias externas. Carga tus embeddings, hazles consultas. Ideal para prototipar pipelines RAG antes de comprometerte con Pinecone o Weaviate. Se ejecuta en tu portátil.
Pinecone (nivel gratuito, en la nube). 1 pod, 100K vectores, dimensiones limitadas. Suficiente para probar si la búsqueda vectorial resuelve tu problema antes de actualizar. Paga cuando sepas que lo necesitas.
Transcripción y Audio
Whisper (código abierto, OpenAI). Descárgalo. Ejecútalo localmente. Transcribe archivos de audio y video gratis. La precisión es lo suficientemente buena para trabajos de producción, más rápido y preciso que la mayoría de las alternativas comerciales. El nivel gratuito no tiene límites de uso. La transcripción por CPU lleva tiempo (5 minutos de audio tardan ~1-2 minutos en procesarse), pero nunca pagas por la inferencia.
Xtreme Audio (nivel gratuito). Texto a voz en más de 100 idiomas. 10 minutos al mes gratis. Limitado, pero funcional para probar flujos de trabajo de voz antes de actualizar a eleven-labs o similar.
Generación de Imágenes y Visión
Stable Diffusion (código abierto, autoalojado). Genera imágenes gratis. Ejecútalo localmente con Automatic1111 WebUI o a través de Hugging Face spaces. Sin límites de tasa, sin costo, sin seguimiento. La calidad de la imagen está por detrás de DALL-E 3 o Midjourney, pero la brecha se reduce cada mes. Para maquetas internas, arte conceptual y pruebas, es suficiente.
CLIP (código abierto, OpenAI). Embeddings de visión a texto. Entiende lo que hay en una imagen sin enviarla a una API externa. Gratis. Código abierto. Se ejecuta localmente. Úsalo para clasificación de imágenes o para buscar bibliotecas de imágenes por significado semántico.
Ajuste Fino y Entrenamiento de Modelos
Unsloth (código abierto). Ajusta modelos abiertos 2-5 veces más rápido con un 80% menos de memoria. Framework gratuito. Combínalo con un modelo local y puedes ajustar modelos en hardware que de otro modo sería demasiado lento o caro. Compromiso real: el ajuste fino tarda horas en lugar de minutos, y los resultados dependen en gran medida de la calidad de tus datos de entrenamiento.
Gestión de Datos y Conocimiento
Obsidian (gratis para uso local). No es una herramienta de IA, sino diseñada para trabajar con IA. Conéctala a LLMs locales o APIs. Úsala para alimentar tus propias notas en sistemas RAG. La visualización del gráfico te ayuda a detectar lagunas en tu conocimiento antes de dárselo al modelo.
Notion AI (nivel gratuito, limitado). Genera resúmenes y esquemas a partir de tus propias páginas de Notion. El nivel gratuito tiene un límite de tokens, pero es útil para trabajos rápidos de resumen sin salir de tu base de conocimiento.
Tareas Especializadas
Hugging Face (plataforma, muchos modelos gratuitos). Aloja tus propios modelos abiertos a través de su API. El nivel gratuito es generoso: la inferencia se ejecuta lentamente pero de forma fiable. Sube tu propio modelo ajustado. Los modelos de la comunidad están disponibles de inmediato.
Replicate (nivel gratuito con créditos). Ejecuta modelos abiertos a través de una API en lugar de gestionar tu propia infraestructura. Los créditos gratuitos cubren una cantidad sorprendente de trabajo de prueba.
Qué Usar Primero
Si empiezas hoy: usa el nivel gratuito de Claude para escribir y probar tus prompts. Usa Llama 3 localmente a través de Ollama para ver si tus prompts funcionan en un modelo abierto. Usa Sentence Transformers + Chroma si necesitas recuperación. Usa Whisper si manejas audio. Prueba el enfoque antes de pagar.
La restricción del nivel gratuito fuerza la claridad. Escribes el prompt tres veces antes de enviarlo porque solo tienes cinco mensajes. Diseñas el flujo de trabajo correctamente la primera vez porque no estás lanzando tokens a una API costosa. Pasa a la versión de pago cuando el nivel gratuito se convierta en un cuello de botella, no antes.