Requesty
A Requesty é um gateway compatível com OpenAI: uma chave em app.requesty.ai/api-keys, URL base router.requesty.ai/v1. A fatia gratuita são 12 modelos a $0 — Nemotron 3 Ultra, Super, Nano e Lightning, Laguna XS e M, Gemma 4 31B, Leanstral 1.5, Muse Glimmer e Ling 3.0 Tiny. Super, Ultra e Lightning vão até 1M de contexto.
A Requesty é um gateway compatível com OpenAI: uma chave em app.requesty.ai/api-keys, URL base router.requesty.ai/v1. A fatia gratuita são 12 modelos a $0 — Nemotron 3 Ultra, Super, Nano e Lightning, Laguna XS e M, Gemma 4 31B, Leanstral 1.5, Muse Glimmer e Ling 3.0 Tiny. Super, Ultra e Lightning vão até 1M de contexto.
Organizações novas ganham 200 requisições por dia e 20 por minuto, compartilhadas entre todos os modelos gratuitos, reset diário, sem cartão. Organizações pagantes sobem para 1.000 por dia. O resto dos 600+ do catálogo é pré-pago com 5%. Tráfego da UE pode usar router.eu.requesty.ai/v1.
- Modelos gratuitos
- 12
- Contexto máximo
- 1M
- Nível gratuito
- 200 requisições por dia
- Requisito
- Conta de e-mail, sem cartão
Endpoint
https://router.requesty.ai/v1REQUESTY_API_KEY20 requests/minute, 200 requests/day- Compatível com OpenAI
- texto
- imagem
- visão
- raciocínio
Exemplos de código
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://router.requesty.ai/v1',
apiKey: process.env.REQUESTY_API_KEY
})
const response = await client.chat.completions.create({
model: 'nvidia/nemotron-3-super-120b-a12b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://router.requesty.ai/v1",
api_key=os.environ["REQUESTY_API_KEY"],
)
response = client.chat.completions.create(
model="nvidia/nemotron-3-super-120b-a12b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://router.requesty.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $REQUESTY_API_KEY" \
-d '{
"model": "nvidia/nemotron-3-super-120b-a12b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'Vale saber
- Só os ids a $0 são grátis. O resto dos 600+ do catálogo é pré-pago com mais 5%.
- Os limites de 200 requisições/dia e 20/minuto são compartilhados entre todos os modelos gratuitos. Organizações pagantes sobem para 1.000/dia e 60/minuto.
- A tabela da doc lista 9 ids gratuitas; o /v1/models ao vivo tem 12 a $0. Laguna aqui é 33K, não a janela de 256K da NIM. nemotron-3.5-content-safety é um classificador.
Modelos que você obtém de graça12
- Laguna M.1
poolside/laguna-m.1 - Laguna XS.2
poolside/laguna-xs.2 - Ling 3.0 Tiny
novita/inclusionai/ling-3.0-tiny - Gemma 4 31B
google/gemma-4-31b-it - Leanstral 1.5
mistral/leanstral-1-5 - Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b - Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning - Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b - Nemotron 3.5 Content Safety
nvidia/nemotron-3.5-content-safety - Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b - Muse Glimmer 30B
nvidia/muse-glimmer-30b - Nemotron 3.5 Lightning 30B A3B
nvidia/nemotron-3.5-lightning-30b-a3b