Groq
Groq betreibt offene Modelle auf eigenen LPU-Chips — deshalb kommen die Token schneller zurück als fast überall sonst. Eine E-Mail genügt für den Key, keine Karte. Die kostenlose Chat-Liste ist GPT-OSS, Qwen 3.6/3.8 und Compound — Llama, Kimi und DeepSeek sind gegangen.
Groq betreibt offene Modelle auf eigenen LPU-Chips — deshalb kommen die Token schneller zurück als fast überall sonst. Eine E-Mail genügt für den Key, keine Karte. Die kostenlose Chat-Liste ist GPT-OSS, Qwen 3.6/3.8 und Compound — Llama, Kimi und DeepSeek sind gegangen.
Die Limits gelten pro Modell: 30 Anfragen pro Minute und 1.000 pro Tag bei den Chat-ids, 250 pro Tag bei Compound. Die alte 14.400 gilt nur für die Prompt-Guard-Klassifikatoren. OpenAI-kompatibel unter api.groq.com/openai/v1; ein eigenes SDK gibt es obendrauf.
- Kostenlose Modelle
- 7
- Max. Kontext
- 131K
- Gratis-Tarif
- 1.000 Anfragen/Tag
- Anforderung
- E-Mail-Konto, keine Karte
Endpunkt
https://api.groq.com/openai/v1GROQ_API_KEY30 requests/minute, 1,000 requests/day- OpenAI-kompatibel
- Eigenes SDK: Groq SDK
- Text
- Bild
- Reasoning
Codebeispiele
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.groq.com/openai/v1',
apiKey: process.env.GROQ_API_KEY
})
const response = await client.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key=os.environ["GROQ_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $GROQ_API_KEY" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install groq-sdkimport Groq from 'groq-sdk'
const groq = new Groq({ apiKey: process.env.GROQ_API_KEY })
const response = await groq.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install groqimport os
from groq import Groq
client = Groq(api_key=os.environ["GROQ_API_KEY"])
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Wissenswert
- Rate-Limits gelten pro Modell: Chat-Modelle liegen bei 1.000 Anfragen/Tag, Compound bei 250. Die 14.400 gelten nur für die Prompt-Guard-Klassifikatoren.
- Llama 3.3, Kimi K2 und DeepSeek sind aus der Gratisliste raus — Enterprise-only oder eingestellt.
Modelle, die Sie gratis bekommen7
- GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - GPT-OSS Safeguard 20B
openai/gpt-oss-safeguard-20b - Qwen 3.8 27B
qwen/qwen3.8-27b - Qwen 3.6 27B
qwen/qwen3.6-27b - Groq Compound
groq/compound - Groq Compound Mini
groq/compound-mini