Chaque modèle que vous pouvez utiliser gratuitement.
Choisissez un modèle et voyez quels fournisseurs vous le donnent à coût nul.
- Modèles
- 34
- Poids ouverts
- 25
- Fournisseurs
- 23
Qwen 3La famille d’Alibaba, du 0.6B qui tourne sur un laptop aux géants MoE. Les API hébergées nomment le poids exact ; cette page est la page famille.
Llama 3.3 70BLe modèle ouvert classique de Meta. Presque tous les fournisseurs gratuits ici le proposent — le choix par défaut le plus sûr.
GPT-OSS 120BLa sortie open-weights d’OpenAI. Tourne sur votre matériel, ou gratuitement sur Groq. Cerebras le sert toujours avec le crédit d’inscription de 5 $.
DeepSeek V4La famille DeepSeek actuelle : V4 Flash et V4 Pro, 1M de contexte, le raisonnement en interrupteur plutôt qu’en second modèle.
Nemotron 3 UltraLe 550B Ultra de NVIDIA, réglé pour les agents et l’appel de fonctions. Gratuit sur NIM, OpenRouter (`:free`) et Requesty.
DeepSeek V4 FlashLe cheval de bataille DeepSeek actuel : 1M de contexte, raisonnement en interrupteur. id officiel deepseek-v4-flash ; AMD sert DeepSeek-V4-Flash-0731.GLM 5.2Le vaisseau amiral actuel de Z.ai. Excellent en code et appels d’outils. Gratuit sur OpenRouter (`z-ai/glm-5.2:free`) ; chez Z.ai même, GLM-5 se facture au token.
Qwen CoderLa branche code de Qwen. Assez petit pour tourner en local, assez bon pour alimenter l’autocomplétion d’un éditeur.
Qwen 3.8 27BLe 27B actuel d’Alibaba : thinking ou instruct dans une seule id, images acceptées. Groq le sert à 131K ; la fenêtre gratuite de Cloudflare monte à 262K.Mixtral 8x7BLe modèle mixture-of-experts qui a prouvé que le MoE marchait en ouvert. Retiré de l’API de Mistral ; reste un excellent choix local.
Laguna XSLe petit modèle de code de Poolside. L’id gratuite d’OpenRouter est poolside/laguna-xs-2.1 ; Requesty sert poolside/laguna-xs.2 à 33K.
Gemini 3.7 FlashLe cheval de bataille Flash actuel de Google — code, agents et entrées multimodales, 1M de contexte, gratuit à l’essai dans AI Studio.
Kimi K3Le MoE ouvert actuel de Moonshot. Fort en usage d’outils agentique et en code. Gratuit sur NVIDIA NIM ; Groq a retiré les anciennes ids K2.
DeepSeek R1Le raisonneur de 2025 qui a ouvert le chain-of-thought. Parti de l’API de DeepSeek ; encore gratuit chez quelques hôtes et en poids locaux.
Qwen3.8-Flash-NextLe checkpoint Flash-Next 3.8. AMD Radeon Cloud sert exactement cette id dans le quota Token Factory de 10 $/jour.Gemma 4 31BLe 31B ouvert de Google. Cerebras sert gemma-4-31b avec le crédit d’inscription de 5 $ ; Requesty liste google/gemma-4-31b-it à 0 $.
Nemotron 3 SuperLe 120B Super. L’exemple de la doc Requesty et une id à 0 $ de cette passerelle ; aussi `:free` sur OpenRouter.Gemini 3.5 Flash LiteLe Gemini actuel le moins cher. Conçu pour la classification, l’extraction et tout ce qu’on lance des milliers de fois par jour.
GPT-OSS 20BLe plus petit GPT-OSS open-weights. Plus rapide que le 120B sur Groq, même fenêtre de 131K et 1 000 requêtes par jour.
GPT-OSS Safeguard 20BLe classifieur de sécurité de la gamme GPT-OSS. Groq le sert dans le même quota de chat gratuit que les autres 20B.
DeepSeek V3.1La génération DeepSeek précédente. Retirée de l’API officielle ; SambaNova héberge toujours V3.1 gratuitement.GLM 4.7 FlashLa ligne gratuite permanente de Z.ai. 200K de contexte. glm-4.7, glm-5 et glm-5.2 y sont facturés au token.
Qwen 3.6 27BLe 27B précédent, toujours sur la liste gratuite de Groq. Même fenêtre de 131K et 30 requêtes par minute que le 3.8.
Qwen 3.7 PlusL’id plus actuelle d’Alibaba Model Studio (Singapour / international). 1M de contexte, 1M de tokens gratuits pendant 90 jours. qwen3-plus n’est plus une id valide.
Qwen 3 30B-A3BLe MoE 30B (3B actifs). Cloudflare sert @cf/qwen/qwen3-30b-a3b-fp8 dans le pool gratuit Workers AI.
Qwen 3.5 397BLe Qwen 3.5 397B-A17B. L’id Qwen actuelle d’Ollama Cloud est qwen3.5:397b.
Qwen 3 8BL’instruct 8B de Qwen 3. L’id d’exemple du niveau gratuit de SiliconFlow ; assez petit pour tourner en local.Mistral SmallLa ligne small actuelle de Mistral. Le Free mode de La Plateforme utilise cette id ; les modèles Labs (préfixe labs-) sont gratuits aussi.
Command ALe modèle entreprise de Cohere, pensé pour le RAG et les citations. La clé d’essai n’expire jamais.
Jamba 1.5 LargeUn Mamba-Transformer hybride. Étonnamment bon marché sur les longs documents grâce à son architecture.Groq CompoundPas un modèle mais un système : Groq route votre requête à travers des modèles et des outils intégrés comme la recherche web.
Groq Compound MiniLe système Compound allégé de Groq. Même idée de routage d’outils, pile par défaut plus petite.
Mistral Medium 3.5Le modèle équilibré de Mistral : hébergement européen et 256K de contexte. Payant sur La Plateforme ; pas la vedette du gratuit.
Phi-4Le petit modèle de Microsoft qui frappe bien au-dessus de sa taille sur les benchmarks de raisonnement.