Ogni modello che puoi usare gratis.
Scegli un modello e scopri quali provider te lo danno a costo zero.
- Modelli
- 34
- Pesi aperti
- 25
- Vendor
- 23
Qwen 3La famiglia di Alibaba, dal 0.6B che gira su un laptop ai giganti MoE. Le API ospitate nominano il peso esatto; questa pagina è la famiglia.
Llama 3.3 70BIl modello aperto classico di Meta. Quasi tutti i provider gratuiti qui lo servono: la scelta predefinita più sicura.
GPT-OSS 120BIl rilascio open-weights di OpenAI. Gira sul tuo hardware, o gratis su Groq. Cerebras lo serve con il credito di $5 alla registrazione.
DeepSeek V4La famiglia DeepSeek attuale: V4 Flash e V4 Pro, 1M di contesto, il thinking come interruttore e non come secondo modello.
Nemotron 3 UltraIl 550B Ultra di NVIDIA, tarato per agenti e function calling. Gratis su NIM, OpenRouter (`:free`) e Requesty.
DeepSeek V4 FlashIl cavallo di battaglia attuale di DeepSeek: 1M di contesto, thinking a interruttore. id ufficiale deepseek-v4-flash; AMD serve DeepSeek-V4-Flash-0731.GLM 5.2L’ammiraglia attuale di Z.ai. Eccellente su coding e chiamate di strumenti. Gratis su OpenRouter (`z-ai/glm-5.2:free`); su Z.ai stessa GLM-5 si paga a token.
Qwen CoderIl ramo coding di Qwen. Piccolo abbastanza da girare in locale, buono abbastanza da alimentare l’autocompletamento dell’editor.
Qwen 3.8 27BIl 27B attuale di Alibaba: thinking o instruct in un solo id, immagini incluse. Groq lo serve a 131K; la finestra gratuita di Cloudflare arriva a 262K.Mixtral 8x7BIl mixture-of-experts che ha dimostrato che il MoE funziona nel mondo aperto. Ritirato dall’API di Mistral; resta un’ottima scelta locale.
Laguna XSIl piccolo modello di coding di Poolside. L’id gratuito di OpenRouter è poolside/laguna-xs-2.1; Requesty serve poolside/laguna-xs.2 a 33K.
Gemini 3.7 FlashIl cavallo di battaglia Flash attuale di Google: coding, agenti e input multimodali, 1M di contesto, gratis da provare in AI Studio.
Kimi K3Il MoE aperto attuale di Moonshot. Forte su uso di strumenti agentico e coding. Gratis su NVIDIA NIM; Groq ha ritirato i vecchi id K2.
DeepSeek R1Il reasoner del 2025 che ha aperto il chain-of-thought. Uscito dall’API di DeepSeek; ancora gratis su alcuni host e come pesi locali.
Qwen3.8-Flash-NextIl checkpoint Flash-Next 3.8. AMD Radeon Cloud serve esattamente questo id nella quota Token Factory da $10/giorno.Gemma 4 31BIl 31B aperto di Google. Cerebras serve gemma-4-31b con il credito di $5 alla registrazione; Requesty elenca google/gemma-4-31b-it a $0.
Nemotron 3 SuperIl 120B Super. L’esempio della documentazione di Requesty e un id a $0 di quel gateway; anche `:free` su OpenRouter.Gemini 3.5 Flash LiteIl Gemini attuale più economico. Pensato per classificazione, estrazione e tutto ciò che fai girare migliaia di volte al giorno.
GPT-OSS 20BIl GPT-OSS più piccolo. Su Groq è più veloce del 120B, stessa finestra da 131K e 1.000 richieste al giorno.
GPT-OSS Safeguard 20BIl classificatore di sicurezza della linea GPT-OSS. Groq lo serve con la stessa quota chat gratuita degli altri 20B.
DeepSeek V3.1La generazione DeepSeek precedente. Ritirata dall’API ufficiale; SambaNova continua a ospitare V3.1 gratis.GLM 4.7 FlashLa linea gratuita permanente di Z.ai. 200K di contesto. glm-4.7, glm-5 e glm-5.2 su quell’host si pagano a token.
Qwen 3.6 27BIl 27B precedente, ancora nella lista gratuita di Groq. Stessa finestra da 131K e 30 richieste al minuto del 3.8.
Qwen 3.7 PlusL’id plus attuale di Alibaba Model Studio (Singapore / internazionale). 1M di contesto, 1M di token gratuiti per 90 giorni. qwen3-plus non è un id attuale.
Qwen 3 30B-A3BIl MoE da 30B (3B attivi). Cloudflare serve @cf/qwen/qwen3-30b-a3b-fp8 nel pool gratuito di Workers AI.
Qwen 3.5 397BIl Qwen 3.5 da 397B-A17B. L’id Qwen attuale di Ollama Cloud è qwen3.5:397b.
Qwen 3 8BL’instruct 8B di Qwen 3. L’id di esempio del livello gratuito di SiliconFlow; piccolo abbastanza da girare anche in locale.Mistral SmallLa linea small attuale di Mistral. Il Free mode di La Plateforme usa questo id; i modelli Labs (prefisso labs-) sono gratuiti pure loro.
Command AIl modello enterprise di Cohere, costruito per RAG e citazioni. La chiave di prova non scade mai.
Jamba 1.5 LargeUn Mamba-Transformer ibrido. Inusualmente economico sui documenti lunghi grazie all’architettura.Groq CompoundNon un modello ma un sistema: Groq instrada la tua richiesta tra modelli e strumenti integrati come la ricerca web.
Groq Compound MiniIl sistema Compound leggero di Groq. Stessa idea di instradamento degli strumenti, stack predefinito più piccolo.
Mistral Medium 3.5Il modello equilibrato di Mistral: hosting europeo e 256K di contesto. A pagamento su La Plateforme; non è la stella del gratuito.
Phi-4Il modello piccolo di Microsoft che rende molto sopra la sua taglia nei benchmark di ragionamento.