Requesty
Requesty est une passerelle compatible OpenAI : une clé sur app.requesty.ai/api-keys, URL de base router.requesty.ai/v1. La part gratuite est de 12 modèles à 0 $ — Nemotron 3 Ultra, Super, Nano et Lightning, Laguna XS et M, Gemma 4 31B, Leanstral 1.5, Muse Glimmer et Ling 3.0 Tiny. Super, Ultra et Lightning montent à 1M de contexte.
Requesty est une passerelle compatible OpenAI : une clé sur app.requesty.ai/api-keys, URL de base router.requesty.ai/v1. La part gratuite est de 12 modèles à 0 $ — Nemotron 3 Ultra, Super, Nano et Lightning, Laguna XS et M, Gemma 4 31B, Leanstral 1.5, Muse Glimmer et Ling 3.0 Tiny. Super, Ultra et Lightning montent à 1M de contexte.
Les nouvelles organisations reçoivent 200 requêtes par jour et 20 par minute, partagées entre tous les modèles gratuits, remise quotidienne, sans carte. Les organisations payantes passent à 1 000 par jour. Le reste des 600+ du catalogue est payant à l’usage plus 5 %. Le trafic UE peut passer par router.eu.requesty.ai/v1.
- Modèles gratuits
- 12
- Contexte max
- 1M
- Offre gratuite
- 200 requêtes/jour
- Exigence
- Compte e-mail, sans carte
Point de terminaison
https://router.requesty.ai/v1REQUESTY_API_KEY20 requests/minute, 200 requests/day- Compatible OpenAI
- texte
- image
- vision
- raisonnement
Exemples de code
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://router.requesty.ai/v1',
apiKey: process.env.REQUESTY_API_KEY
})
const response = await client.chat.completions.create({
model: 'nvidia/nemotron-3-super-120b-a12b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://router.requesty.ai/v1",
api_key=os.environ["REQUESTY_API_KEY"],
)
response = client.chat.completions.create(
model="nvidia/nemotron-3-super-120b-a12b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://router.requesty.ai/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $REQUESTY_API_KEY" \
-d '{
"model": "nvidia/nemotron-3-super-120b-a12b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'Bon à savoir
- Seules les ids à $0 sont gratuites. Le reste des 600+ du catalogue est payant à l’usage, plus 5 %.
- Les 200 requêtes/jour et 20/minute sont partagées entre tous les modèles gratuits. Les organisations payantes passent à 1 000/jour et 60/minute.
- La table de la doc liste 9 ids gratuites ; le /v1/models en direct en compte 12 à 0 $. Laguna y est à 33K, pas à la fenêtre 256K de NIM. nemotron-3.5-content-safety est un classifieur.
Modèles que vous obtenez gratuitement12
- Laguna M.1
poolside/laguna-m.1 - Laguna XS.2
poolside/laguna-xs.2 - Ling 3.0 Tiny
novita/inclusionai/ling-3.0-tiny - Gemma 4 31B
google/gemma-4-31b-it - Leanstral 1.5
mistral/leanstral-1-5 - Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b - Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning - Nemotron 3 Nano 30B A3B
nvidia/nemotron-3-nano-30b-a3b - Nemotron 3.5 Content Safety
nvidia/nemotron-3.5-content-safety - Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b - Muse Glimmer 30B
nvidia/muse-glimmer-30b - Nemotron 3.5 Lightning 30B A3B
nvidia/nemotron-3.5-lightning-30b-a3b