Groq
Groq ejecuta modelos abiertos en sus propias chips LPU, por eso los tokens vuelven más rápido que casi en cualquier otro sitio. Un correo te da la clave. Sin tarjeta. La lista de chat gratuita es GPT-OSS, Qwen 3.6/3.8 y Compound — Llama, Kimi y DeepSeek se fueron.
Groq ejecuta modelos abiertos en sus propias chips LPU, por eso los tokens vuelven más rápido que casi en cualquier otro sitio. Un correo te da la clave. Sin tarjeta. La lista de chat gratuita es GPT-OSS, Qwen 3.6/3.8 y Compound — Llama, Kimi y DeepSeek se fueron.
Los límites son por modelo: 30 peticiones por minuto y 1.000 al día en los ids de chat, 250 al día en Compound. La vieja cifra de 14.400 es solo para los clasificadores prompt-guard. Compatible con OpenAI en api.groq.com/openai/v1; también ofrecen un SDK propio.
- Modelos gratuitos
- 7
- Contexto máximo
- 131K
- Nivel gratuito
- 1.000 peticiones al día
- Requisito
- Cuenta de correo, sin tarjeta
Punto de conexión
https://api.groq.com/openai/v1GROQ_API_KEY30 requests/minute, 1,000 requests/day- Compatible con OpenAI
- SDK nativo: Groq SDK
- texto
- imagen
- razonamiento
Ejemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.groq.com/openai/v1',
apiKey: process.env.GROQ_API_KEY
})
const response = await client.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.groq.com/openai/v1",
api_key=os.environ["GROQ_API_KEY"],
)
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.groq.com/openai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $GROQ_API_KEY" \
-d '{
"model": "openai/gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install groq-sdkimport Groq from 'groq-sdk'
const groq = new Groq({ apiKey: process.env.GROQ_API_KEY })
const response = await groq.chat.completions.create({
model: 'openai/gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install groqimport os
from groq import Groq
client = Groq(api_key=os.environ["GROQ_API_KEY"])
response = client.chat.completions.create(
model="openai/gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale la pena saber
- Los límites son por modelo: los de chat están en 1.000 peticiones/día; Compound en 250. La cifra de 14.400 es solo para los clasificadores prompt-guard.
- Llama 3.3, Kimi K2 y DeepSeek han salido de la lista gratuita: solo Enterprise o retirados.
Modelos que obtienes gratis7
- GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - GPT-OSS Safeguard 20B
openai/gpt-oss-safeguard-20b - Qwen 3.8 27B
qwen/qwen3.8-27b - Qwen 3.6 27B
qwen/qwen3.6-27b - Groq Compound
groq/compound - Groq Compound Mini
groq/compound-mini