Ollama Cloud
Ollama Cloud, ce sont les mêmes noms de modèles et le même client qu’en local, pointés vers le GPU de quelqu’un d’autre. ollama run gpt-oss:120b-cloud après ollama signin, ou api.ollama.com/v1 avec une clé.
Ollama Cloud, ce sont les mêmes noms de modèles et le même client qu’en local, pointés vers le GPU de quelqu’un d’autre. ollama run gpt-oss:120b-cloud après ollama signin, ou api.ollama.com/v1 avec une clé.
Dix-neuf modèles sur la liste en direct, dont DeepSeek V4, MiniMax M3, GLM 5.x et Kimi K3. La part gratuite est un crédit mensuel de démarrage sur les modèles starter, une requête concurrente — les plafonds de session et hebdomadaires ont disparu. Venir du local ne change que l’hôte.
- Modèles gratuits
- 19
- Contexte max
- 1M
- Offre gratuite
- Crédits de démarrage mensuels
- Exigence
- Compte e-mail, sans carte
Point de terminaison
URL de base
https://api.ollama.com/v1Variable d’environnement
OLLAMA_API_KEYLimite de débit
Monthly starter credits, 1 concurrent request- Compatible OpenAI
- SDK natif : Ollama SDK
- texte
- image
- vidéo
- code
- vision
- raisonnement
Exemples de code
npm install openaiimport OpenAI from 'openai'
const client = new OpenAI({
baseURL: 'https://api.ollama.com/v1',
apiKey: process.env.OLLAMA_API_KEY
})
const response = await client.chat.completions.create({
model: 'gpt-oss:20b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.choices[0].message.content)pip install openaiimport os
from openai import OpenAI
client = OpenAI(
base_url="https://api.ollama.com/v1",
api_key=os.environ["OLLAMA_API_KEY"],
)
response = client.chat.completions.create(
model="gpt-oss:20b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response.choices[0].message.content)curl https://api.ollama.com/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $OLLAMA_API_KEY" \
-d '{
"model": "gpt-oss:20b",
"messages": [{"role": "user", "content": "Explain closures in one paragraph."}]
}'npm install ollamaimport { Ollama } from 'ollama'
const ollama = new Ollama({ host: 'https://api.ollama.com' })
const response = await ollama.chat({
model: 'gpt-oss:20b',
messages: [{ role: 'user', content: 'Explain closures in one paragraph.' }]
})
console.log(response.message.content)pip install ollamafrom ollama import Client
client = Client(host="https://api.ollama.com")
response = client.chat(
model="gpt-oss:20b",
messages=[{"role": "user", "content": "Explain closures in one paragraph."}],
)
print(response["message"]["content"])Bon à savoir
- Mêmes noms de modèles qu’Ollama en local : changer de seul l’hôte suffit à basculer.
- Les plafonds de session et hebdomadaires ont disparu ; la part gratuite est un crédit mensuel de démarrage sur les modèles starter.
Modèles que vous obtenez gratuitement19
- GLM 5.2
glm-5.2 - Kimi K2.6
kimi-k2.6 - Kimi K3
kimi-k3 - DeepSeek V4 Pro 0813
deepseek-v4-pro:0813 - MiniMax M3
minimax-m3 - GLM 5.1
glm-5.1 - GLM 5.3
glm-5.3 - DeepSeek V4 Flash 0731
deepseek-v4-flash:0731 - GPT-OSS 20B
gpt-oss:20b - GPT-OSS 120B
gpt-oss:120b - MiniMax M2.7
minimax-m2.7 - Mistral Large 3 675B
mistral-large-3:675b - Nemotron 3 Super
nemotron-3-super - Nemotron 3 Nano 30B
nemotron-3-nano:30b - Gemma 4 31B
gemma4:31b - Qwen 3.5 397B
qwen3.5:397b - Nemotron 3 Ultra
nemotron-3-ultra - GLM 5.3 Flash
glm-5.3-flash - Kimi K2.7 Code
kimi-k2.7-code