Cerebras
A Cerebras Cloud serve modelos de chips em escala de wafer — por isso o GPT-OSS 120B volta a milhares de tokens por segundo. O catálogo público são dois modelos: gpt-oss-120b e gemma-4-31b.
A Cerebras Cloud serve modelos de chips em escala de wafer — por isso o GPT-OSS 120B volta a milhares de tokens por segundo. O catálogo público são dois modelos: gpt-oss-120b e gemma-4-31b.
O cadastro dá $5 uma vez. Uma forma de pagamento destrava o crédito; não é um nível gratuito permanente. Depois dos cinco dólares, compra-se mais. O teto é de 5 requisições por minuto, 30K tokens por minuto, um milhão de tokens por dia, e a janela gratuita de 65K. Agrupe o trabalho em vez de atirar em loop. Compatível com OpenAI em api.cerebras.ai/v1.
- Modelos gratuitos
- 2
- Contexto máximo
- 65K
- Nível gratuito
- Crédito único de $5
- Requisito
- Cartão de crédito obrigatório
Endpoint
URL base
https://api.cerebras.ai/v1Variável de ambiente
CEREBRAS_API_KEYLimite de taxa
5 requests/minute, 30K tokens/minute, 1M tokens/day- Compatível com OpenAI
- SDK nativo: Cerebras Cloud SDK
- texto
- imagem
- raciocínio
Exemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.cerebras.ai/v1',
apiKey: process.env.CEREBRAS_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key=os.environ["CEREBRAS_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $CEREBRAS_API_KEY" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install @cerebras/cerebras_cloud_sdkimport Cerebras from '@cerebras/cerebras_cloud_sdk'
const client = new Cerebras({ apiKey: process.env.CEREBRAS_API_KEY })
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install cerebras_cloud_sdkimport os
from cerebras.cloud.sdk import Cerebras
client = Cerebras(api_key=os.environ["CEREBRAS_API_KEY"])
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale saber
- O catálogo público são dois modelos: gpt-oss-120b e gemma-4-31b. Llama, Qwen e DeepSeek partiram.
- O cadastro dá $5 uma vez. Uma forma de pagamento destrava o crédito; depois dos cinco dólares, compra-se mais.
- 5 requisições/minuto é pouco — agrupe o trabalho em vez de atirar em loop.
Modelos que você obtém de graça2
- GPT-OSS 120B
gpt-oss-120b - Gemma 4 31B
gemma-4-31b