Groq
A Groq roda modelos abertos nos próprios chips LPU, e é por isso que os tokens voltam mais rápido que quase qualquer outra pessoa entrega. Um e-mail te dá a chave. Sem cartão. A lista gratuita de chat é GPT-OSS, Qwen 3.6/3.8 e Compound — Llama, Kimi e DeepSeek partiram.
A Groq roda modelos abertos nos próprios chips LPU, e é por isso que os tokens voltam mais rápido que quase qualquer outra pessoa entrega. Um e-mail te dá a chave. Sem cartão. A lista gratuita de chat é GPT-OSS, Qwen 3.6/3.8 e Compound — Llama, Kimi e DeepSeek partiram.
Os limites são por modelo: 30 requisições por minuto e 1.000 por dia nos ids de chat, 250 por dia no Compound. O antigo número de 14.400 vale só para os classificadores prompt-guard. Compatível com OpenAI em api.groq.com/openai/v1; também têm um SDK próprio.
- Modelos gratuitos
- 7
- Contexto máximo
- 131K
- Nível gratuito
- 1.000 requisições por dia
- Requisito
- Conta de e-mail, sem cartão
Endpoint
https://api.groq.com/openai/v1GROQ_API_KEY30 requests/minute, 1,000 requests/day- Compatível com OpenAI
- SDK nativo: Groq SDK
- texto
- imagem
- raciocínio
Exemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.groq.com/openai/v1',
apiKey: process.env.GROQ_API_KEY
})
const response = await client.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key=os.environ["GROQ_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $GROQ_API_KEY" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install groq-sdkimport Groq from 'groq-sdk'
const groq = new Groq({ apiKey: process.env.GROQ_API_KEY })
const response = await groq.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install groqimport os
from groq import Groq
client = Groq(api_key=os.environ["GROQ_API_KEY"])
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale saber
- Os limites são por modelo: os de chat ficam em 1.000 requisições/dia; o Compound em 250. O número de 14.400 vale só para os classificadores prompt-guard.
- Llama 3.3, Kimi K2 e DeepSeek saíram da lista gratuita — só Enterprise ou aposentados.
Modelos que você obtém de graça7
- GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - GPT-OSS Safeguard 20B
openai/gpt-oss-safeguard-20b - Qwen 3.8 27B
qwen/qwen3.8-27b - Qwen 3.6 27B
qwen/qwen3.6-27b - Groq Compound
groq/compound - Groq Compound Mini
groq/compound-mini