Jedes Modell, das Sie kostenlos nutzen können.
Wählen Sie ein Modell und sehen Sie, welche Provider es zum Nulltarif bereitstellen.
- Modelle
- 34
- Offene Gewichte
- 25
- Anbieter
- 23
Qwen 3Alibabas Familie, vom 0.6B auf dem Laptop bis zum MoE-Riesen. Gehostete APIs benennen das exakte Gewicht; diese Seite ist die Familienseite.
Llama 3.3 70BMetas klassisches offenes Modell. Fast jeder kostenlose Anbieter hier führt es — der sicherste Standard.
GPT-OSS 120BOpenAIs Open-Weight-Release. Läuft auf der eigenen Hardware oder gratis auf Groq. Cerebras reicht der $5-Signup-Credit.
DeepSeek V4Die aktuelle DeepSeek-Familie: V4 Flash und V4 Pro, 1M Kontext, Thinking als Schalter statt als zweites Modell.
Nemotron 3 UltraNVIDIAs 550B Ultra, abgestimmt auf Agents und Function Calling. Kostenlos auf NIM, OpenRouter (`:free`) und Requesty.
DeepSeek V4 FlashDeepSeeks aktuelles Arbeitstier: 1M Kontext, Thinking per Schalter. Offizielle id deepseek-v4-flash; AMD liefert DeepSeek-V4-Flash-0731.GLM 5.2Z.ais aktueller Flaggschiff. Stark beim Coding und Tool-Aufrufen. Kostenlos auf OpenRouter (`z-ai/glm-5.2:free`); bei Z.ai selbst wird GLM-5 per Token abgerechnet.
Qwen CoderDer Coding-Zweig von Qwen. Klein genug für lokal, gut genug für Editor-Autocomplete.
Qwen 3.8 27BAlibabas aktuelles 27B: Thinking oder Instruct in einer id, Bilder rein. Groq liefert 131K; Cloudflares kostenloses Fenster reicht bis 262K.Mixtral 8x7BDas Mixture-of-Experts-Modell, das bewies, dass MoE offen funktioniert. Aus Mistralss eigener API retired; lokal weiterhin eine gute Wahl.
Laguna XSPoolsidea kleines Coding-Modell. OpenRouters Gratis-id ist poolside/laguna-xs-2.1; Requesty liefert poolside/laguna-xs.2 mit 33K.
Gemini 3.7 FlashGoogles aktuelles Flash-Arbeitspferd — Coding, Agents und multimodale Eingaben, 1M Kontext, im AI Studio kostenlos testbar.
Kimi K3Moonshots aktuelles offenes MoE. Stark bei agentischen Tool-Aufrufen und Coding. Kostenlos auf NVIDIA NIM; Groq hat die alten K2-ids eingestellt.
DeepSeek R1Der Reasoner von 2025, der Chain-of-Thought öffnete. Aus DeepSeeks eigener API verschwunden; auf einigen Hosts weiterhin gratis und als lokale Gewichte.
Qwen3.8-Flash-NextDer Flash-Next-3.8-Checkpoint. AMD Radeon Cloud liefert genau diese id im $10/Tag-Token-Factory-Kontingent.Gemma 4 31BGoogles offenes 31B. Cerebras liefert gemma-4-31b über den $5-Signup-Credit; Requesty listet google/gemma-4-31b-it für $0.
Nemotron 3 SuperDer 120B Super. Requestys Dokumentationsbeispiel und eine $0-id dieses Gateways; auch `:free` auf OpenRouter.Gemini 3.5 Flash LiteDas aktuell günstigste Gemini. Gebaut für Klassifikation, Extraktion und alles, was man tausendmal am Tag laufen lässt.
GPT-OSS 20BDas kleinere GPT-OSS. Auf Groq schneller als 120B, gleiches 131K-Fenster und 1.000 Anfragen pro Tag.
GPT-OSS Safeguard 20BDer Sicherheitsklassifikator der GPT-OSS-Linie. Groq liefert ihn im selben kostenlosen Chat-Kontingent wie die anderen 20B.
DeepSeek V3.1Die vorherige DeepSeek-Generation. Aus der offiziellen API retired; SambaNova hostet V3.1 weiter im kostenlosen Tier.GLM 4.7 FlashDie dauerhaft kostenlose Linie bei Z.ai. 200K Kontext. glm-4.7, glm-5 und glm-5.2 werden dort per Token abgerechnet.
Qwen 3.6 27BDas vorherige 27B, weiterhin auf Groqs Gratisliste. Gleiche 131K-Fenster und 30 Anfragen pro Minute wie 3.8.
Qwen 3.7 PlusDie aktuelle plus-id im Alibaba Model Studio (Singapur/International). 1M Kontext, 1M kostenlose Token für 90 Tage. qwen3-plus ist keine gültige id.
Qwen 3 30B-A3BDas 30B-MoE (3B aktiv). Cloudflare liefert @cf/qwen/qwen3-30b-a3b-fp8 im kostenlosen Workers-AI-Pool.
Qwen 3.5 397BDas 397B-A17B Qwen 3.5. Ollama Clouds aktuelle Qwen-id ist qwen3.5:397b.
Qwen 3 8BDas 8B Qwen-3-Instruct. SiliconFlows Beispiel-id im Gratis-Tier; klein genug, um es lokal zu betreiben.Mistral SmallMistralss aktuelle Small-Linie. Der Free mode von La Plateforme nutzt diese id; Labs-Modelle (labs-Präfix) sind ebenfalls kostenlos.
Command ACoheres Enterprise-Modell, um RAG und Zitate gebaut. Der Testkey läuft nie ab.
Jamba 1.5 LargeEin hybrider Mamba-Transformer. Dank Architektur ungewöhnlich günstig bei langen Dokumenten.Groq CompoundKein einzelnes Modell, sondern ein System: Groq routet die Anfrage über Modelle und eingebaute Werkzeuge wie Websuche.
Groq Compound MiniDas leichtere Compound-System bei Groq. Gleiche Tool-Routing-Idee, kleinerer Standardstack.
Mistral Medium 3.5Mistralss ausgewogenes Modell: europäisches Hosting und 256K Kontext. Auf La Plateforme kostenpflichtig; nicht der Gratis-Chip.
Phi-4Microsofts kleines Modell, das bei Reasoning-Benchmarks weit über seiner Größe schlägt.