OVHcloud AI Endpoints
OVHcloud AI Endpoints는 프랑스에 호스팅된 유럽 서버리스 추론입니다. ovhcloud.com/en/public-cloud/ai-endpoints/catalog/의 공개 카탈로그에는 19개 라이브 모델이 있고 그중 7개가 €0입니다: NVIDIA Riva TTS(영/독/서/이), Qwen3Guard-Gen 0.6B와 8B, 그리고 Stable Diffusion XL.
OVHcloud AI Endpoints는 프랑스에 호스팅된 유럽 서버리스 추론입니다. ovhcloud.com/en/public-cloud/ai-endpoints/catalog/의 공개 카탈로그에는 19개 라이브 모델이 있고 그중 7개가 €0입니다: NVIDIA Riva TTS(영/독/서/이), Qwen3Guard-Gen 0.6B와 8B, 그리고 Stable Diffusion XL.
Llama 3.3 70B, GPT-OSS 20B/120B, Qwen 3.5/3.6은 키를 받으면 종량 과금이지만, 키 없이도 분당 2회로 호출할 수 있습니다. Public Cloud 프로젝트를 등록하면 분당 400회로 오르고 과금이 시작됩니다. OpenAI 호환 주소는 oai.endpoints.kepler.ai.cloud.ovh.net/v1. 프롬프트는 학습에 쓰지 않는다고 밝히고 있습니다.
- 무료 모델
- 7
- 최대 컨텍스트
- 262K
- 무료 요금제
- 7개 모델 €0
- 요구사항
- 아무것도 없음 — 계정 불필요
엔드포인트
기본 URL
https://oai.endpoints.kepler.ai.cloud.ovh.net/v1환경 변수
OVH_AI_ENDPOINTS_ACCESS_TOKEN속도 제한
2 requests/minute anonymous; 400 requests/minute with a key- OpenAI 호환
- 텍스트
- 이미지
- 오디오
- 음성
- 코드
코드 예시
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://oai.endpoints.kepler.ai.cloud.ovh.net/v1',
apiKey: process.env.OVH_AI_ENDPOINTS_ACCESS_TOKEN
})
const response = await client.chat.completions.create({
model: 'Meta-Llama-3_3-70B-Instruct',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://oai.endpoints.kepler.ai.cloud.ovh.net/v1",
api_key=os.environ["OVH_AI_ENDPOINTS_ACCESS_TOKEN"],
)
response = client.chat.completions.create(
model="Meta-Llama-3_3-70B-Instruct",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://oai.endpoints.kepler.ai.cloud.ovh.net/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OVH_AI_ENDPOINTS_ACCESS_TOKEN" \
-d '{
"model": "Meta-Llama-3_3-70B-Instruct",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'알아두면 좋은 점
- 카탈로그에서 €0인 건 7개 모델: NVIDIA Riva TTS 4종, Qwen3Guard-Gen 0.6B와 8B, 그리고 Stable Diffusion XL.
- 채팅 모델(Llama 3.3 70B, GPT-OSS, Qwen 3.5/3.6)은 키를 받으면 종량 과금. 키 없이도 분당 2회로 호출할 수 있습니다.
- 카탈로그의 5개 id가 이용 불가 표기: Mistral 7B, Mistral Nemo, Mistral Small 3.2, Qwen3-32B, Qwen3-Coder-30B.
무료로 받는 모델7
- Riva TTS English
nvr-tts-en-us - Riva TTS German
nvr-tts-de-de - Riva TTS Spanish
nvr-tts-es-es - Riva TTS Italian
nvr-tts-it-it - Qwen 3Guard Gen 0.6B
qwen-guard-gen-06b - Qwen 3Guard Gen 8B
qwen-guard-gen-8b - Stable Diffusion XL
stable-diffusion-xl