Groq
Recommandé par midudev↗L'inférence la plus rapide du marché. Sans carte bancaire.
1 000 requêtes/jour131K context
Alibaba
La famille d’Alibaba, du 0.6B qui tourne sur un laptop aux géants MoE. Les API hébergées nomment le poids exact ; cette page est la page famille.
L'inférence la plus rapide du marché. Sans carte bancaire.
1 000 requêtes/jour131K context
Une clé, des centaines de modèles, 5 $ de crédits chaque mois. Aucune majoration sur les tokens.
5 $ de crédits/mois1M context
Le Token Factory d’AMD : cinq API gratuites partagées et 10 $ d’utilisation par jour, remis à minuit.
10 $ d’utilisation/jour1M context
Des modèles à la périphérie, à un fetch de votre Worker.
10 000 neurones/jour262K context
Inference Providers : des milliers de modèles ouverts avec des crédits mensuels.
0,10 $ de crédit/mois131K context
Le hub d’Alibaba : 50 modèles gratuits via API, dont beaucoup de pointures chinoises.
2 000 requêtes/jour50 models
Les mêmes modèles et commandes qu’Ollama en local, mais sur le GPU de quelqu’un d’autre.
Crédits de démarrage mensuels1M context
Qwen à la source, avec un niveau à 1M de contexte et un quota gratuit pour démarrer.
1M tokens par modèle, 90 jours1M context
Modèles ouverts chinois avec un niveau gratuit permanent, distillations comprises.
Plafonds par modèle après KYC131K context
Des milliers de démos de modèles ouverts à essayer dans le navigateur.
Accès gratuitCommunity demos