A qui s'adresse ce guide ? Developpeurs, studios creatifs et independants qui comparent GPT, Claude et Gemini dans une meme pipeline — design, video, code agentique — sans gerer trois comptes API. Conclusion : OpenRouter unifie l'acces via un endpoint OpenAI-compatible ; le changement de modele se limite au parametre model. Contenu : six points de friction, mecanisme de routing, tableau OpenRouter vs API directe, cinq atouts et limites, exemples curl/Python/Node/SDK/streaming/fallback, tarifs, SEO multilingue, runbook en six etapes, trois chiffres cles, FAQ.
Dans un workflow creatif 2026 — script Final Cut, plugin Figma, agent de montage — ces obstacles reviennent systematiquement :
Documentation : openrouter.ai/docs. Deux decisions independantes pilotent chaque requete.
| Couche | Parametre | Role |
|---|---|---|
| Routing modele | model ou openrouter/auto | Choisit quel LLM repond |
| Routing fournisseur | provider | Selectionne l'instance qui heberge ce modele (prix/stabilite) |
| Failover | models[] + route: fallback | Bascule sequentielle sans code client |
| Endpoint | /v1/chat/completions | Format OpenAI ; auth Bearer |
| Identifiant | fournisseur/modele | Ex. google/gemini-2.5-pro, anthropic/claude-3.5-sonnet |
| Critere | OpenRouter | API directe |
|---|---|---|
| Cles API | Une cle, 400+ modeles | Une cle par editeur |
| Migration SDK | Changer base_url suffit | SDK natifs, fonctions avancees |
| Prix token | Pas de markup | Tarif editeur |
| Frais gateway | 5,5 % au rechargement | Aucun |
| Failover | Integre | A implementer |
| Workflow Apple | Ideal pour A/B rapide sur Mac | Meilleur pour contrats enterprise |
| APIs speciales | Chat completions | Batch, Assistants, caching Anthropic |
1. Une cle pour tout tester — comparez Claude pour la redaction, GPT pour le code, Gemini pour le multimodal dans la meme app Swift ou Node.
2. Failover integre — vos sessions creatives survivent aux rate limits.
3. Dashboard unifie — couts et latence TTFT au meme endroit ; voir aussi notre matrice de routing OpenRouter.
4. Pas de markup token — 5,5 % seulement au rechargement ; BYOK : 1 M req/mois gratuites.
5. 25+ modeles gratuits — prototypage sans facture immediate.
Pour un studio : OpenRouter excelle en phase d'exploration creatif (storyboards IA, variantes copy, scripts automation). La production 24/7 merite un Mac mini dedie qui ne dort jamais.
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "anthropic/claude-3.5-sonnet",
"messages": [{"role": "user", "content": "Resume OpenRouter en une phrase"}]
}'
from openai import OpenAI
import os
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key=os.environ["OPENROUTER_API_KEY"],
)
completion = client.chat.completions.create(
model="google/gemini-2.5-pro",
messages=[{"role": "user", "content": "Idees de storyboard pour une pub 30s"}],
extra_headers={"HTTP-Referer": "https://maccome.com", "X-Title": "Studio Demo"},
)
print(completion.choices[0].message.content)
import OpenAI from "openai";
const openai = new OpenAI({
baseURL: "https://openrouter.ai/api/v1",
apiKey: process.env.OPENROUTER_API_KEY,
});
const stream = await openai.chat.completions.create({
model: "openai/gpt-4o",
messages: [{ role: "user", content: "Script voix-off pour motion design" }],
stream: true,
});
for await (const chunk of stream) {
process.stdout.write(chunk.choices[0]?.delta?.content ?? "");
}
{
"model": "anthropic/claude-3.5-sonnet",
"models": ["anthropic/claude-3.5-sonnet", "openai/gpt-4o", "google/gemini-2.5-pro"],
"route": "fallback",
"messages": [{"role": "user", "content": "Hello"}]
}
Liste des modeles : GET /api/v1/models. Integration OpenClaw : checklist multi-fournisseur.
| Element | Valeur | Condition |
|---|---|---|
| Prix token | Tarif fournisseur, sans markup | FAQ OpenRouter |
| Rechargement | 5,5 % (min. 0,80 USD) | A l'achat de credits |
| BYOK | 0 USD jusqu'a 1 M req/mois | Puis 5 % |
| Modeles gratuits | 25+ | ~50 req/jour sans credit |
| Après 10 USD credits | ~1000 req/jour, 20/min | Quota free elargi |
Pour un blog en huit langues, priorisez :
/en/ vs /fr/ ; zero impression = probleme d'indexation.base_url + cle ; zero changement de prompts.OpenRouter simplifie l'acces multi-modele pour les workflows creatifs Apple Silicon. Il ne remplace pas un Mac qui reste eveille pour vos agents de montage, de code ou de design generatif.
Trois limites du MacBook local : veille = perte d'etat agent, pas de charge continue pour tester le failover, et pas de CI reproductible pour OpenClaw. Pour une prod stable, un MACCOME Mac mini M4 / M4 Pro dedie — meme config routing, hote toujours actif — est le complement naturel. Tarifs : tarifs de location ; aide : centre d'aide.
Mise a jour : 24 juillet 2026 | Sources : OpenRouter Docs, FAQ
FAQ
Qu'est-ce qu'OpenRouter ?
Passerelle LLM compatible OpenAI. Endpoint https://openrouter.ai/api/v1, une cle pour GPT, Claude, Gemini et 400+ modeles.
OpenRouter facture-t-il un markup sur les tokens ?
Non. Frais de 5,5 % uniquement au rechargement de credits (min. 0,80 USD).
Convient-il aux workflows creatifs sur Mac ?
Oui pour prototyper et comparer modeles. Pour 24/7, hebergez le gateway sur Mac mini dedie sans veille.
Comment configurer le fallback ?
Tableau models + route: "fallback" — bascule automatique en cas d'erreur.
Quels modeles gratuits existent ?
25+ modeles ; ~50 req/jour sans credit, ~1000/jour apres 10 USD de credits.
Ou heberger un agent OpenRouter en continu ?
MACCOME Mac mini M4/M4 Pro — tarifs, centre d'aide.