Cada modelo que puedes usar gratis.
Elige un modelo y mira qué proveedores te lo dan a costo cero.
- Modelos
- 34
- Pesos abiertos
- 25
- Proveedores
- 23
Qwen 3La familia de Alibaba, desde el 0.6B que corre en un portátil hasta los gigantes MoE. Las APIs alojadas nombran el peso exacto; esta página es la familia.
Llama 3.3 70BEl modelo abierto clásico de Meta. Casi todos los proveedores gratuitos de aquí lo sirven: la apuesta por defecto más segura.
GPT-OSS 120BLa versión open-weights de OpenAI. Corre en tu hardware o gratis en Groq. Cerebras lo sirve con el crédito de registro de $5.
DeepSeek V4La familia DeepSeek actual: V4 Flash y V4 Pro, 1M de contexto, el razonamiento como interruptor y no como segundo modelo.
Nemotron 3 UltraEl 550B Ultra de NVIDIA, afinado para agentes y llamadas a funciones. Gratis en NIM, OpenRouter (`:free`) y Requesty.
DeepSeek V4 FlashEl caballo de batalla actual de DeepSeek: 1M de contexto, razonamiento como interruptor. id oficial deepseek-v4-flash; AMD sirve DeepSeek-V4-Flash-0731.GLM 5.2El buque insignia actual de Z.ai. Excelente en código y llamadas a herramientas. Gratis en OpenRouter (`z-ai/glm-5.2:free`); en Z.ai mismo, GLM-5 se factura por token.
Qwen CoderLa rama de código de Qwen. Lo bastante pequeño para local, lo bastante bueno para alimentar el autocompletado del editor.
Qwen 3.8 27BEl 27B actual de Alibaba: thinking o instruct en una sola id, imágenes incluidas. Groq lo sirve a 131K; la ventana gratuita de Cloudflare llega a 262K.Mixtral 8x7BEl mixture-of-experts que demostró que el MoE funcionaba en abierto. Retirado de la API de Mistral; sigue siendo una gran elección local.
Laguna XSEl pequeño modelo de código de Poolside. El id gratuito de OpenRouter es poolside/laguna-xs-2.1; Requesty sirve poolside/laguna-xs.2 a 33K.
Gemini 3.7 FlashEl caballo de batalla Flash actual de Google: código, agentes y entrada multimodal, 1M de contexto, gratis para probar en AI Studio.
Kimi K3El MoE abierto actual de Moonshot. Fuerte en uso de herramientas agéntico y código. Gratis en NVIDIA NIM; Groq retiró los antiguos ids K2.
DeepSeek R1El razonador de 2025 que abrió el chain-of-thought. Fuera de la API de DeepSeek; aún gratis en algunos hosts y como pesos locales.
Qwen3.8-Flash-NextEl checkpoint Flash-Next 3.8. AMD Radeon Cloud sirve exactamente este id dentro de la cuota Token Factory de $10/día.Gemma 4 31BEl 31B abierto de Google. Cerebras sirve gemma-4-31b con el crédito de registro de $5; Requesty lista google/gemma-4-31b-it a $0.
Nemotron 3 SuperEl 120B Super. El ejemplo de la documentación de Requesty y un id a $0 de esa pasarela; también `:free` en OpenRouter.Gemini 3.5 Flash LiteEl Gemini actual más barato. Pensado para clasificación, extracción y todo lo que ejecutas miles de veces al día.
GPT-OSS 20BEl GPT-OSS pequeño. Más rápido que el 120B en Groq, misma ventana de 131K y 1.000 peticiones al día.
GPT-OSS Safeguard 20BEl clasificador de seguridad de la línea GPT-OSS. Groq lo sirve con la misma cuota gratuita de chat que los demás 20B.
DeepSeek V3.1La generación anterior de DeepSeek. Retirada de la API oficial; SambaNova sigue hospedando V3.1 gratis.GLM 4.7 FlashLa línea gratuita permanente de Z.ai. 200K de contexto. glm-4.7, glm-5 y glm-5.2 se facturan por token en ese host.
Qwen 3.6 27BEl 27B anterior, aún en la lista gratuita de Groq. Misma ventana de 131K y 30 peticiones por minuto que el 3.8.
Qwen 3.7 PlusEl id plus actual de Alibaba Model Studio (Singapur / internacional). 1M de contexto, 1M de tokens gratis durante 90 días. qwen3-plus ya no es un id válido.
Qwen 3 30B-A3BEl MoE de 30B (3B activos). Cloudflare sirve @cf/qwen/qwen3-30b-a3b-fp8 en el pool gratuito de Workers AI.
Qwen 3.5 397BEl Qwen 3.5 de 397B-A17B. El id Qwen actual de Ollama Cloud es qwen3.5:397b.
Qwen 3 8BEl instruct 8B de Qwen 3. El id de ejemplo del nivel gratuito de SiliconFlow; lo bastante pequeño para correr en local.Mistral SmallLa línea small actual de Mistral. El Free mode de La Plateforme usa este id; los modelos Labs (prefijo labs-) también son gratis.
Command AEl modelo empresarial de Cohere, construido para RAG y citas. La clave de prueba no caduca nunca.
Jamba 1.5 LargeUn Mamba-Transformer híbrido. Inusualmente barato en documentos largos gracias a su arquitectura.Groq CompoundNo es un modelo sino un sistema: Groq enruta tu petición entre modelos y herramientas integradas como la búsqueda web.
Groq Compound MiniEl sistema Compound ligero de Groq. Misma idea de enrutado de herramientas, pila por defecto más pequeña.
Mistral Medium 3.5El modelo equilibrado de Mistral: alojamiento europeo y 256K de contexto. De pago en La Plateforme; no es la estrella del gratuito.
Phi-4El modelo pequeño de Microsoft que rinde muy por encima de su tamaño en benchmarks de razonamiento.