

Guide OpenRouter API : une API pour l'IA de pointe
Bien démarrer avec l'API OpenRouter : clés, première requête, slugs et variantes de modèles, streaming, limites et fallbacks, plus les options multimodales.
Une clé API, un endpoint, des centaines de modèles de langage. C'est la promesse de l'API OpenRouter — et comme elle parle le schéma OpenAI, la plupart des applications peuvent l'adopter en changeant simplement la base URL. Ce guide vous emmène de zéro jusqu'à des appels prêts pour la production.
Ce que vous allez apprendre :
-
Créer une clé et envoyer votre première requête avec curl, Python et TypeScript
-
Lire les slugs de modèles (
vendor/model) et utiliser des variantes comme:free,:nitroet:floor -
Gérer le streaming, les limites de débit et les fallbacks multi-modèles
-
Savoir ce que coûte la plateforme — et quand une passerelle multimodale est un meilleur choix

Comment fonctionne OpenRouter
Le catalogue de modèles
OpenRouter référence des centaines de modèles d'OpenAI, Anthropic, Google, Meta, Mistral, DeepSeek, Qwen et d'autres, chacun avec sa tarification au token et ses spécifications de contexte sur sa page modèle [1].
Le parcours d'une requête
Votre requête atteint l'endpoint unifié, le routeur choisit un fournisseur upstream pour ce modèle (beaucoup en ont plusieurs), l'exécute, puis normalise la réponse au format OpenAI. Par défaut, la sélection du fournisseur équilibre prix et disponibilité [2].
Ce que ça coûte
L'inférence est facturée au prix catalogue du fournisseur sans majoration ; la plateforme prélève 5.5% (min. $0.80) à l'achat de crédits, et les modèles gratuits sont plafonnés à 50 requêtes/jour (1,000/jour dès que vous avez acheté $10+ de crédits) [3].
Démarrage rapide
1. Créer un compte et une clé
Inscrivez-vous, achetez un petit pack de crédits (cela débloque aussi la limite gratuite supérieure) et générez une clé depuis le dashboard. Les clés sont des bearer tokens — gardez-les côté serveur.
2. Première requête avec curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "openai/gpt-5.2",
"messages": [{"role": "user", "content": "Hello from the unified API"}]
}'
3. Python et TypeScript
Les SDK officiels OpenAI fonctionnent tels quels :
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="sk-or-...",
)
resp = client.chat.completions.create(
model="google/gemini-2.5-pro",
messages=[{"role": "user", "content": "Three taglines for a coffee app"}],
)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
Slugs de modèles et variantes
Lire un slug
Les ID de modèles suivent le format vendor/model-name, par exemple anthropic/claude-sonnet-4.5 ou deepseek/deepseek-chat. La chaîne exacte affichée sur la page du modèle est exactement celle que l'API attend.
Les variantes en suffixe
| Variante | Effet |
|---|---|
:free | Capacité gratuite, plafonds journaliers stricts, pas de SLA |
:nitro | Trie les fournisseurs par débit — payez pour la vitesse |
:floor | Trie les fournisseurs par prix — le moins cher d'abord |
Les variantes sont des indications de routage, pas des poids différents — même modèle, sélection de fournisseur différente [2].
Choisir un modèle
Filtrez le catalogue par prix, fenêtre de contexte et modalité, puis évaluez sur votre propre tâche. L'échelle pragmatique : prototyper sur une variante :free, lancer sur un modèle de milieu de gamme, garder un modèle frontier pour les 10% de requêtes les plus difficiles.
Enjeux de production
Streaming
Passez "stream": true et consommez les server-sent events — identique au contrat de streaming d'OpenAI, votre code d'UI de streaming existant fonctionne donc sans modification.
Limites de débit et retries
Les limites évoluent avec votre solde de crédits plutôt que par paliers fixes ; les 429 doivent déclencher un backoff exponentiel. Pour les modèles gratuits, prévoyez autour des plafonds de 50/1,000 par jour [3].
Fallbacks
Passez un tableau models classé par priorité et le routeur réessaie le modèle suivant côté serveur en cas d'erreur ou de limite de débit [4] :
{
"model": "openai/gpt-5.2",
"models": ["anthropic/claude-sonnet-4.5", "deepseek/deepseek-chat"],
"messages": [{ "role": "user", "content": "..." }]
}
Quand il vous faut plus que des modèles de langage
OpenRouter unifie le texte. Dès que votre roadmap dit « générer une image produit » ou « ajouter un clip vidéo », vous revenez aux intégrations par fournisseur — sauf si votre passerelle couvre nativement ces modalités.
Une API unifiée qui inclut les modèles média
APIMart applique le même principe d'une clé unique à 500+ modèles : chat, image (GPT-Image-2), vidéo (Sora 2, Kling, Veo) et audio (Suno).
Des prix sous le tarif officiel, pas au tarif officiel
Les modèles sont proposés environ 20% sous les prix officiels, avec les tarifs d'origine et remisés de chaque modèle publiés sur la page de tarifs — aucun calcul de frais séparé n'est nécessaire.
Compatible avec le même code
Les endpoints sont compatibles OpenAI : le démarrage rapide ci-dessus fonctionne avec une autre base URL et une autre clé. Votre registre de modèles et votre logique de fallback se transfèrent sans rien toucher.
Accédez à 500+ modèles d'IA avec une seule clé API
Modèles de chat, d'image, de vidéo et d'audio derrière une seule API compatible OpenAI — tarification pay-as-you-go transparente, environ 20% sous les prix officiels.
Commencer à créerRécapitulatif
Pointez un SDK OpenAI vers l'endpoint unifié, référencez les modèles par leur slug vendor/model, utilisez :floor ou :nitro quand le coût ou la vitesse compte, ajoutez un tableau de fallback models avant la production, et rappelez-vous que le coût réel est le prix catalogue plus les 5.5% de frais de rechargement [3]. Si votre application a aussi besoin d'images, de vidéo ou d'audio, partez d'une passerelle qui les couvre déjà.
Choisissez le modèle qui vous convient dans le marketplace
Essayez les modèles de chat, image et vidéo sur le marketplace APIMart, puis découvrez rapidement leurs capacités avec une API unifiée.
