it's free*.ai

OVHcloud AI Endpoints

OVHcloud AI Endpoints est de l’inférence serverless européenne, hébergée en France. Le catalogue public sur ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ liste 19 modèles en direct. Sept y sont à 0 € : NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B et 8B, et Stable Diffusion XL.

OVHcloud AI Endpoints est de l’inférence serverless européenne, hébergée en France. Le catalogue public sur ovhcloud.com/en/public-cloud/ai-endpoints/catalog/ liste 19 modèles en direct. Sept y sont à 0 € : NVIDIA Riva TTS (EN/DE/ES/IT), Qwen3Guard-Gen 0.6B et 8B, et Stable Diffusion XL.

Llama 3.3 70B, GPT-OSS 20B/120B et Qwen 3.5/3.6 passent au pay-as-you-go avec une clé — sans clé, ils restent appelables à 2 requêtes par minute. Un projet Public Cloud enregistré saute à 400 par minute et commence à coûter. Compatible OpenAI à oai.endpoints.kepler.ai.cloud.ovh.net/v1. Ils affirment que les prompts ne servent pas à l’entraînement.

Modèles gratuits
7
Contexte max
262K
Offre gratuite
7 modèles à 0 €
Exigence
Rien — pas de compte

Point de terminaison

URL de basehttps://oai.endpoints.kepler.ai.cloud.ovh.net/v1
Variable d’environnementOVH_AI_ENDPOINTS_ACCESS_TOKEN
Limite de débit2 requests/minute anonymous; 400 requests/minute with a key

Exemples de code

npm install openai
import OpenAI from 'openai'

const client = new OpenAI({
  baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
  apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})

const response = await client.chat.completions.create({
  model: 'Meta-Llama-3_3-70B-Instruct',
  messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})

console.log(response.choices[0].message.content)

Bon à savoir

Modèles que vous obtenez gratuitement7