it's free*.ai

Groq

Groq fait tourner des modèles ouverts sur ses propres puces LPU, d’où des tokens qui reviennent plus vite que presque partout ailleurs. Un e-mail donne la clé. Pas de carte. La liste de chat gratuite est GPT-OSS, Qwen 3.6/3.8 et Compound — Llama, Kimi et DeepSeek sont partis.

Groq fait tourner des modèles ouverts sur ses propres puces LPU, d’où des tokens qui reviennent plus vite que presque partout ailleurs. Un e-mail donne la clé. Pas de carte. La liste de chat gratuite est GPT-OSS, Qwen 3.6/3.8 et Compound — Llama, Kimi et DeepSeek sont partis.

Les limites sont par modèle : 30 requêtes par minute et 1 000 par jour sur les ids de chat, 250 par jour sur Compound. L’ancien chiffre de 14 400 ne vaut que pour les classifieurs prompt-guard. Compatible OpenAI à api.groq.com/openai/v1 ; un SDK natif existe aussi.

Modèles gratuits
7
Contexte max
131K
Offre gratuite
1 000 requêtes/jour
Exigence
Compte e-mail, sans carte

Point de terminaison

URL de basehttps://api.groq.com/openai/v1
Variable d’environnementGROQ_API_KEY
Limite de débit30 requests/minute, 1,000 requests/day

Exemples de code

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://api.groq.com/openai/v1',
  apiKey: process.env.GROQ_API_KEY
})

const response = await client.chat.completions.create({
  model: 'openai/gpt-oss-120b',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Bon à savoir

Modèles que vous obtenez gratuitement7