Cerebras
Cerebras Cloud sert des modèles depuis des puces à l’échelle du wafer — c’est pourquoi GPT-OSS 120B revient à des milliers de tokens par seconde. Le catalogue public compte deux modèles : gpt-oss-120b et gemma-4-31b.
Cerebras Cloud sert des modèles depuis des puces à l’échelle du wafer — c’est pourquoi GPT-OSS 120B revient à des milliers de tokens par seconde. Le catalogue public compte deux modèles : gpt-oss-120b et gemma-4-31b.
L’inscription accorde 5 $ une fois. Une méthode de paiement débloque le crédit ; ce n’est pas un niveau gratuit permanent. Après les cinq dollars, on achète. Le plafond est de 5 requêtes par minute, 30K tokens par minute, un million de tokens par jour, et la fenêtre gratuite de 65K. Regroupez le travail plutôt que de tirer en boucle. Compatible OpenAI à api.cerebras.ai/v1.
- Modèles gratuits
- 2
- Contexte max
- 65K
- Offre gratuite
- Crédit unique de 5 $
- Exigence
- Carte bancaire requise
Point de terminaison
https://api.cerebras.ai/v1CEREBRAS_API_KEY5 requests/minute, 30K tokens/minute, 1M tokens/day- Compatible OpenAI
- SDK natif : Cerebras Cloud SDK
- texte
- image
- raisonnement
Exemples de code
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.cerebras.ai/v1',
apiKey: process.env.CEREBRAS_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key=os.environ["CEREBRAS_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $CEREBRAS_API_KEY" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install @cerebras/cerebras_cloud_sdkimport Cerebras from '@cerebras/cerebras_cloud_sdk'
const client = new Cerebras({ apiKey: process.env.CEREBRAS_API_KEY })
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install cerebras_cloud_sdkimport os
from cerebras.cloud.sdk import Cerebras
client = Cerebras(api_key=os.environ["CEREBRAS_API_KEY"])
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Bon à savoir
- Le catalogue public compte deux modèles : gpt-oss-120b et gemma-4-31b. Llama, Qwen et DeepSeek sont partis.
- L’inscription accorde 5 $ une seule fois. Une méthode de paiement débloque le crédit ; après les cinq dollars, on achète.
- 5 requêtes/minute, c’est peu — regroupez le travail plutôt que de tirer en boucle.
Modèles que vous obtenez gratuitement2
- GPT-OSS 120B
gpt-oss-120b - Gemma 4 31B
gemma-4-31b