Cerebras
Cerebras Cloud serve modelli da chip a scala wafer — per questo GPT-OSS 120B torna a migliaia di token al secondo. Il catalogo pubblico sono due modelli: gpt-oss-120b e gemma-4-31b.
Cerebras Cloud serve modelli da chip a scala wafer — per questo GPT-OSS 120B torna a migliaia di token al secondo. Il catalogo pubblico sono due modelli: gpt-oss-120b e gemma-4-31b.
La registrazione regala $5 una volta. Un metodo di pagamento sblocca il credito; non è un livello gratuito permanente. Dopo i cinque dollari si ricompra. Il tetto è 5 richieste al minuto, 30K token al minuto, un milione di token al giorno, e la finestra gratuita è 65K. Raggruppa il lavoro invece di sparare in loop. Compatibile OpenAI su api.cerebras.ai/v1.
- Modelli gratuiti
- 2
- Contesto massimo
- 65K
- Piano gratuito
- Credito una tantum di $5
- Requisito
- Carta di credito richiesta
Endpoint
URL base
https://api.cerebras.ai/v1Variabile ambiente
CEREBRAS_API_KEYLimite di velocità
5 requests/minute, 30K tokens/minute, 1M tokens/day- Compatibile OpenAI
- SDK nativo: Cerebras Cloud SDK
- testo
- immagine
- ragionamento
Esempi di codice
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.cerebras.ai/v1',
apiKey: process.env.CEREBRAS_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key=os.environ["CEREBRAS_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $CEREBRAS_API_KEY" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install @cerebras/cerebras_cloud_sdkimport Cerebras from '@cerebras/cerebras_cloud_sdk'
const client = new Cerebras({ apiKey: process.env.CEREBRAS_API_KEY })
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install cerebras_cloud_sdkimport os
from cerebras.cloud.sdk import Cerebras
client = Cerebras(api_key=os.environ["CEREBRAS_API_KEY"])
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale la pena sapere
- Il catalogo pubblico sono due modelli: gpt-oss-120b e gemma-4-31b. Llama, Qwen e DeepSeek se ne sono andati.
- La registrazione regala $5 una volta. Un metodo di pagamento sblocca il credito; dopo i cinque dollari si ricompra.
- 5 richieste/minuto sono poche — raggruppa il lavoro invece di sparare in loop.
Modelli che ottieni gratis2
- GPT-OSS 120B
gpt-oss-120b - Gemma 4 31B
gemma-4-31b