Introduction
OpenMulti est une passerelle LLM compatible OpenAI : une seule URL, une seule clé, et l'accès à des centaines de modèles de tous les fournisseurs. Vous exprimez une intention (model: "auto", un niveau de qualité/prix), et le routeur choisit en continu le meilleur modèle — sur les coûts et la fiabilité réellement observés.
Compatible avec votre code existant
Tout client ou SDK OpenAI fonctionne tel quel : changez la base_url et la clé, gardez le reste.
from openai import OpenAI
client = OpenAI(
base_url="https://api.openmulti.ai/v1",
api_key="sk_...",
)
Deux modes d'utilisation, au choix par requête :
- Proxy transparent — vous passez un id concret (
vendor/model) et aucune extension : OpenMulti transmet la requête telle quelle et vous renvoie la réponse du fournisseur strictement identique, sans champ ajouté. Zéro régression par rapport à un appel direct. - Routage par intention — vous passez
model: "auto"(ouauto:economy/auto:balanced/auto:quality) et, si besoin, le blocopenmulti: OpenMulti choisit le modèle et vous explique son choix (openmulti.reason).
Les concepts
| Concept | Ce que c'est |
|---|---|
| Projet | L'unité de facturation. Votre solde, vos plafonds et votre usage sont comptés par projet. |
| Clé API | sk_<projet>_<secret> — l'accès Bearer à l'API. Un projet peut avoir plusieurs clés ; elles partagent le même solde. |
| Tier | Le niveau qualité/prix visé : economy, balanced ou quality. |
| Purpose | La nature de la tâche (generation, light, agent, …) : affine le choix du modèle dans le tier. |
usage.cost |
Le coût exact de la requête en USD, présent dans chaque réponse. C'est le montant débité de votre solde. |
Ce qui est garanti
- Le streaming, les outils (
tools), les sorties structurées (response_format) et les messagesrole: "tool"passent intacts vers le modèle — verrouillé par des tests de contrat, pas seulement constaté. - Chaque réponse porte son coût exact (
usage.cost) : pas d'abonnement, pas de minimum, vous créditez et vous consommez. - Un id de modèle concret est honoré tel quel : OpenMulti ne substitue jamais un modèle silencieusement.
URL de base
https://api.openmulti.ai/v1
Vérifiez la disponibilité du service à tout moment : GET https://api.openmulti.ai/health.
Prêt ? Suivez le démarrage rapide : premier appel en cinq minutes.