Cerebras
Cerebras Cloud sirve modelos desde chips a escala de wafer: por eso GPT-OSS 120B vuelve a miles de tokens por segundo. El catálogo público son dos modelos: gpt-oss-120b y gemma-4-31b.
Cerebras Cloud sirve modelos desde chips a escala de wafer: por eso GPT-OSS 120B vuelve a miles de tokens por segundo. El catálogo público son dos modelos: gpt-oss-120b y gemma-4-31b.
El registro regala $5 una vez. Una forma de pago desbloquea el crédito; no es un plan gratuito permanente. Tras los cinco dólares, compras más. El tope es de 5 peticiones por minuto, 30K tokens por minuto, un millón de tokens al día, y la ventana gratuita de 65K. Agrupa el trabajo en vez de disparar en bucle. Compatible con OpenAI en api.cerebras.ai/v1.
- Modelos gratuitos
- 2
- Contexto máximo
- 65K
- Nivel gratuito
- Crédito único de $5
- Requisito
- Se requiere tarjeta de crédito
Punto de conexión
URL base
https://api.cerebras.ai/v1Variable de entorno
CEREBRAS_API_KEYLímite de tasa
5 requests/minute, 30K tokens/minute, 1M tokens/day- Compatible con OpenAI
- SDK nativo: Cerebras Cloud SDK
- texto
- imagen
- razonamiento
Ejemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.cerebras.ai/v1',
apiKey: process.env.CEREBRAS_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.cerebras.ai/v1",
api_key=os.environ["CEREBRAS_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.cerebras.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $CEREBRAS_API_KEY" \
-d '{
"model": "gpt-oss-120b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install @cerebras/cerebras_cloud_sdkimport Cerebras from '@cerebras/cerebras_cloud_sdk'
const client = new Cerebras({ apiKey: process.env.CEREBRAS_API_KEY })
const response = await client.chat.completions.create({
model: 'gpt-oss-120b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install cerebras_cloud_sdkimport os
from cerebras.cloud.sdk import Cerebras
client = Cerebras(api_key=os.environ["CEREBRAS_API_KEY"])
response = client.chat.completions.create(
model="gpt-oss-120b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)Vale la pena saber
- El catálogo público son dos modelos: gpt-oss-120b y gemma-4-31b. Llama, Qwen y DeepSeek se fueron.
- El registro regala $5 una vez. Una forma de pago desbloquea el crédito; tras los cinco dólares, compras más.
- 5 peticiones/minuto es poco — agrupa el trabajo en lugar de disparar en bucle.
Modelos que obtienes gratis2
- GPT-OSS 120B
gpt-oss-120b - Gemma 4 31B
gemma-4-31b