it's free*.ai

Cerebras

Cerebras Cloud sert des modèles depuis des puces à l’échelle du wafer — c’est pourquoi GPT-OSS 120B revient à des milliers de tokens par seconde. Le catalogue public compte deux modèles : gpt-oss-120b et gemma-4-31b.

Cerebras Cloud sert des modèles depuis des puces à l’échelle du wafer — c’est pourquoi GPT-OSS 120B revient à des milliers de tokens par seconde. Le catalogue public compte deux modèles : gpt-oss-120b et gemma-4-31b.

L’inscription accorde 5 $ une fois. Une méthode de paiement débloque le crédit ; ce n’est pas un niveau gratuit permanent. Après les cinq dollars, on achète. Le plafond est de 5 requêtes par minute, 30K tokens par minute, un million de tokens par jour, et la fenêtre gratuite de 65K. Regroupez le travail plutôt que de tirer en boucle. Compatible OpenAI à api.cerebras.ai/v1.

Modèles gratuits
2
Contexte max
65K
Offre gratuite
Crédit unique de 5 $
Exigence
Carte bancaire requise

Point de terminaison

URL de basehttps://api.cerebras.ai/v1
Variable d’environnementCEREBRAS_API_KEY
Limite de débit5 requests/minute, 30K tokens/minute, 1M tokens/day

Exemples de code

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://api.cerebras.ai/v1',
  apiKey: process.env.CEREBRAS_API_KEY
})

const response = await client.chat.completions.create({
  model: 'gpt-oss-120b',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Bon à savoir

Modèles que vous obtenez gratuitement2