NVIDIA NIM
NVIDIA NIM sur build.nvidia.com est le point d’accès d’évaluation des microservices NIM : une API au format OpenAI devant le catalogue gratuit le plus large de la liste. La liste /v1/models en direct compte 82 ids — DeepSeek V4 Flash, Nemotron 3 Ultra, Laguna XS, Kimi K3, MiniMax M3.
NVIDIA NIM sur build.nvidia.com est le point d’accès d’évaluation des microservices NIM : une API au format OpenAI devant le catalogue gratuit le plus large de la liste. La liste /v1/models en direct compte 82 ids — DeepSeek V4 Flash, Nemotron 3 Ultra, Laguna XS, Kimi K3, MiniMax M3.
Un numéro de téléphone, jamais une carte. Jusqu’à 40 requêtes par minute et un million de tokens de contexte sur les longs modèles. GLM 5.2 n’est pas sur la liste actuelle. NVIDIA le dit lui-même : évaluation, pas trafic de production — traitez la clé en conséquence.
- Modèles gratuits
- 82
- Contexte max
- 1M
- Offre gratuite
- 40 requêtes/minute
- Exigence
- Vérification par téléphone, sans carte
Point de terminaison
https://integrate.api.nvidia.com/v1NVIDIA_API_KEYUp to 40 requests/minute- Compatible OpenAI
- texte
- image
- audio
- vidéo
- vision
- embeddings
- rerank
- raisonnement
Exemples de code
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://integrate.api.nvidia.com/v1',
apiKey: process.env.NVIDIA_API_KEY
})
const response = await client.chat.completions.create({
model: 'deepseek-ai/deepseek-v4-flash-0731',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://integrate.api.nvidia.com/v1",
api_key=os.environ["NVIDIA_API_KEY"],
)
response = client.chat.completions.create(
model="deepseek-ai/deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://integrate.api.nvidia.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $NVIDIA_API_KEY" \
-d '{
"model": "deepseek-ai/deepseek-v4-flash-0731",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'Bon à savoir
- La vérification par téléphone est requise, mais pas de carte bancaire.
- Prévu pour l’évaluation, pas pour du trafic de production.
- La liste /v1/models en direct compte 82 ids ; GLM 5.2 n’en fait pas partie.
Modèles que vous obtenez gratuitement82
- Yi Large
01-ai/yi-large - Fuyu 8B
adept/fuyu-8b - Jamba 1.5 Large
ai21labs/jamba-1.5-large-instruct - Sea Lion 7B
aisingapore/sea-lion-7b-instruct - Starcoder 2 15B
bigcode/starcoder2-15b - Dbrx
databricks/dbrx-instruct - DeepSeek Coder 6.7B
deepseek-ai/deepseek-coder-6.7b-instruct - DeepSeek V4 Flash 0731
deepseek-ai/deepseek-v4-flash-0731 - DeepSeek V4 Pro 0813
deepseek-ai/deepseek-v4-pro-0813 - Codegemma 1.1 7B
google/codegemma-1.1-7b - Codegemma 7B
google/codegemma-7b - Deplot
google/deplot - Diffusiongemma 26B A4B
google/diffusiongemma-26b-a4b-it - Gemma 2B
google/gemma-2b - Gemma 3 12B
google/gemma-3-12b-it - Gemma 3 4B
google/gemma-3-4b-it - Gemma 4 31B
google/gemma-4-31b-it - Recurrentgemma 2B
google/recurrentgemma-2b - Granite 3.0 3B A800m
ibm/granite-3.0-3b-a800m-instruct - Granite 3.0 8B
ibm/granite-3.0-8b-instruct - Granite 34B Code
ibm/granite-34b-code-instruct - Granite 8B Code
ibm/granite-8b-code-instruct - Codellama 70B
meta/codellama-70b - Llama 3.2 11B Vision
meta/llama-3.2-11b-vision-instruct - Llama 3.2 90B Vision
meta/llama-3.2-90b-vision-instruct - Llama Guard 4 12B
meta/llama-guard-4-12b - Llama 2 70B
meta/llama2-70b - Muse Glimmer 30B
meta/muse-glimmer-30b - Kosmos 2
microsoft/kosmos-2 - Phi 3 Vision 128k
microsoft/phi-3-vision-128k-instruct - Phi 3.5 MoE
microsoft/phi-3.5-moe-instruct - MiniMax M3
minimaxai/minimax-m3 - Codestral 22B V0.1
mistralai/codestral-22b-instruct-v0.1 - Mistral 7B V0.3
mistralai/mistral-7b-instruct-v0.3 - Mistral Large
mistralai/mistral-large - Mistral Large 2
mistralai/mistral-large-2-instruct - Mistral Nemotron
mistralai/mistral-nemotron - Mixtral 8x22B V0.1
mistralai/mixtral-8x22b-v0.1 - Kimi K2.6
moonshotai/kimi-k2.6 - Kimi K3
moonshotai/kimi-k3 - Mistral Nemo 12B
nv-mistralai/mistral-nemo-12b-instruct - Ai Synthetic Video Detector
nvidia/ai-synthetic-video-detector - Cosmos Reason 2 8B
nvidia/cosmos-reason2-8b - Embed Qa 4
nvidia/embed-qa-4 - Ising Calibration 1.5 31B
nvidia/ising-calibration-1.5-31b - Llama 3.1 Nemoguard 8B Content Safety
nvidia/llama-3.1-nemoguard-8b-content-safety - Llama 3.1 Nemoguard 8B Topic Control
nvidia/llama-3.1-nemoguard-8b-topic-control - Llama 3.1 Nemotron 51B
nvidia/llama-3.1-nemotron-51b-instruct - Llama 3.1 Nemotron 70B
nvidia/llama-3.1-nemotron-70b-instruct - Llama 3.1 Nemotron Safety Guard 8B V3
nvidia/llama-3.1-nemotron-safety-guard-8b-v3 - Llama 3.1 Nemotron Ultra 253B V1
nvidia/llama-3.1-nemotron-ultra-253b-v1 - Llama 3.2 Nemoretriever 1B Vlm Embed V1
nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1 - Llama 3.2 Nv Embedqa 1B V1
nvidia/llama-3.2-nv-embedqa-1b-v1 - Llama Nemotron Embed VL 1B V2
nvidia/llama-nemotron-embed-vl-1b-v2 - Llama 3 Chatqa 1.5 70B
nvidia/llama3-chatqa-1.5-70b - Mistral Nemo Minitron 8B 8k
nvidia/mistral-nemo-minitron-8b-8k-instruct - Nemotron 3 Embed 1B
nvidia/nemotron-3-embed-1b - Nemotron 3 Nano Omni 30B A3B Reasoning
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning - Nemotron 3 Super 120B A12B
nvidia/nemotron-3-super-120b-a12b - Nemotron 3 Ultra 550B A55B
nvidia/nemotron-3-ultra-550b-a55b - Nemotron 3.5 Content Safety
nvidia/nemotron-3.5-content-safety - Nemotron 3.5 Lightning 30B A3B
nvidia/nemotron-3.5-lightning-30b-a3b - Nemotron 4 340B
nvidia/nemotron-4-340b-instruct - Nemotron 4 340B Reward
nvidia/nemotron-4-340b-reward - Nemotron Nano 3 30B A3B
nvidia/nemotron-nano-3-30b-a3b - Nemotron Parse
nvidia/nemotron-parse - Neva 22B
nvidia/neva-22b - Nv Embedqa Mistral 7B V2
nvidia/nv-embedqa-mistral-7b-v2 - Nvclip
nvidia/nvclip - Riva Translate 4B
nvidia/riva-translate-4b-instruct - Riva Translate 4B V1.1
nvidia/riva-translate-4b-instruct-v1.1 - Riva Translate 4B V2
nvidia/riva-translate-4b-instruct-v2 - Vila
nvidia/vila - GPT-OSS 120B
openai/gpt-oss-120b - GPT-OSS 20B
openai/gpt-oss-20b - Laguna XS 2.1
poolside/laguna-xs-2.1 - Arctic Embed L
snowflake/arctic-embed-l - Palmyra Creative 122B
writer/palmyra-creative-122b - Palmyra Fin 70B 32k
writer/palmyra-fin-70b-32k - Palmyra Med 70B
writer/palmyra-med-70b - Palmyra Med 70B 32k
writer/palmyra-med-70b-32k - Zamba 2 7B
zyphra/zamba2-7b-instruct