Classements OpenRouter juillet 2026 : 46 % pour les modeles chinois — qui gagne la course aux tokens ?

Environ 20 min de lecture · MACCOME · Derniere mise a jour : 27 juillet 2026

Public cible : developpeurs et responsables techniques qui choisissent leurs modeles via les classements OpenRouter, et non via des slides de benchmarks. Constat cle (donnees au 25 juillet 2026) : le Mimo V2.5 de Xiaomi mene avec 1,4T tokens/jour ; les laboratoires chinois representent environ 46 % du volume de la plateforme ; les Etats-Unis sont passes de ~70 % a 30–36 % en un an. Ce que vous obtenez : tableau Top 12, parts fournisseurs et applications, comparaison tarifaire, analyse volume vs qualite, previsions aout, exemple Python de routage et runbook en six etapes. Suite logique de notre analyse de juin et du guide API OpenRouter.

insights

Synthese — 30 secondes

  • #1 quotidien (25/07) : Mimo V2.5 (Xiaomi) a 1,4T tokens/jour. DeepSeek V4 Flash second (943,9B). Neuf des douze premiers modeles sont d'origine chinoise.
  • Fournisseur stable #1 : DeepSeek conserve 16–18 % de part hebdomadaire ; le « modele du mois » continue de tourner au sein du camp chinois.
  • Marche en barbell : les modeles open bon marche captent le volume ; Claude et GPT conservent les taches difficiles. Opus 5 (24/07) defend le segment premium a 5/25 USD par million de tokens.
  • Moitie cachee : Hermes Agent (~45 % des apps) canalise un volume que les rapports enterprise ignorent souvent.

Six erreurs de lecture face aux classements de juillet

  1. Confondre le #1 quotidien et le meilleur modele. Mimo V2.5 domine le volume grace au prix ; sur la classification difficile, Claude Sonnet 4.6 et Opus 4.7 partagent la tete avec 13,5 % chacun.
  2. Sous-estimer l'inversion structurelle en douze mois. Les modeles americains sont passes de ~70 % a 30–36 % ; la Chine atteint ~46 % — resultat d'une guerre des prix et d'un ecosysteme open-weight, pas d'un changement d'opinion.
  3. Ne regarder que le classement modeles. Hermes Agent represente ~45 % du trafic applicatif ; Kilo Code ~13 %. Votre framework route souvent avant votre choix manuel.
  4. Comparer uniquement le prix d'entree. DeepSeek V4 Flash : 0,05–0,14 USD en entree, 0,24–0,28 USD en sortie par million ; Kimi K3 : ~3/15 USD. En agent, la sortie depasse souvent l'entree par un facteur 3 a 10.
  5. Hardcoder un seul fournisseur. Mimo V2.5 n'existait pas en juin ; Kimi K3 est l'entree la plus rapide — le #1 mensuel tourne.
  6. Faire tourner des agents sur un portable. Sommeil, instabilite reseau et cles API dispersees sont des couts caches ; les sessions longues exigent un noeud dedie.

Classement modeles juillet 2026 : Top 12 par volume quotidien

Source : OpenRouter, au 25 juillet 2026. Les classements evoluent chaque jour — verifiez avant de les citer en production.

RangModeleFournisseurTokens/jourTotal 30 jNote
1Mimo V2.5Xiaomi1,4T31,2TLeader volume
2DeepSeek V4 FlashDeepSeek943,9B23,6TReference prix-performance
3Hy3Tencent590B23,4TVolume 30 j proche de DeepSeek
4Nemotron 3 Ultra (free)NVIDIA428,6B9TTier gratuit comme aimant
5DeepSeek V4 ProDeepSeek413,7B11,6TBranche Pro
6GLM 5.2Z.ai316,7B13,3T
7MiniMax M3MiniMax262,5B15,1T
8Step 3.7 FlashStepFun204,8B5,9T
9Kimi K3Moonshot AI157,6B1,6TEntree la plus rapide
10Ling 3.0 FlashInclusionAI128,3B417,3B
11Gemini 3 Flash PreviewGoogle106,3B4TRepresentant US
12Claude Sonnet 5Anthropic99,5B3,6TAncre qualite

Lecture : neuf places sur douze reviennent a des modeles chinois. Nemotron 3 Ultra (free) demontre la force du prix zero — a reserver aux experiences non sensibles en production.

Parts fournisseurs et volume vs qualite

Fenetre glissante de sept jours. La part de marche et la depense sur taches difficiles racontent deux histoires distinctes.

FournisseurOriginePart (approx.)Fait cle de juillet
DeepSeekChine16–18 %V4 Flash + V4 Pro dans le Top 5
XiaomiChine8–18 %Mimo V2.5 en tete
AnthropicEtats-Unis10–15 %Claude Opus 5 (24/07)
TencentChine8–13 %Hy3 stable Top 3
GoogleEtats-Unis8–13 %Gemini 3 Flash au Top 12
Z.aiChine4–7 %GLM 5.2 regulier
OpenAIEtats-Unis6–8 %GPT-5.5 sur taches lourdes
NVIDIAEtats-Unis~5 %Nemotron tier gratuit
MiniMaxChine4–8 %M3 long contexte
Moonshot AIChine3–4 %Explosion Kimi K3
Alibaba QwenChine1–4 %Tiers Flash en concurrence
Chine total ~46 % · Etats-Unis total 30–36 % (il y a un an ~70 %)

Structure des depenses par type de tache

  • Dialogue general : 35,7 %
  • Workflows agentiques : 30,4 %
  • Code : 26,5 %
  • Traitement de donnees : 7,5 %

Classification difficile : Claude Sonnet 4.6 et Opus 4.7 a 13,5 % chacun ; GPT-5.5 a 11,6 %. Les leaders de volume y sont quasi absents.

Couche applicative : les frameworks agents comme distributeurs de trafic

Le classement modeles indique quel cerveau est appele. Le tableau applications montre qui ecrit le prompt.

RangApplicationTypePart (approx.)
1Hermes AgentAgent CLI (Nous Research)~45 %
2Kilo CodeAgent de code~13 %
3OpenClawGateway multi-modeles~9 %
4Claude CodeAgent code (Anthropic)~6 %
5DescriptProduction de contenu~4,5 %
6piAgent~3,3 %
7LemonadeCompanion / gaming~2,1 %
8ISEKAI ZERORoleplay~2,0 %
9Janitor AIRoleplay / dialogue~1,8 %
10ClineAgent code IDE~1,7 %

La lignee Cline → Roo Code → Kilo Code illustre la vitesse d'iteration des outils open source. Si vous utilisez Kilo Code ou OpenClaw, auditez le modele par defaut — voir le guide des outils CLI OpenRouter.

Comparaison tarifaire : leaders de volume vs leaders de qualite

ModeleEntree / 1MSortie / 1MContextePositionnement
DeepSeek V4 Flash~0,05–0,14 USD~0,24–0,28 USD1MAPI bulk la moins chere pour le code
Nemotron 3 Ultra0,42 USD (free dispo)2,61 USDOpen-weight US
MiniMax M30,10 USD1,21 USDLongMultimodal budget
GLM 5.20,45 USD3,31 USDPlanning open-weight renforce
Kimi K3~3 USD~15 USD1M1,4TB de poids ouverts ; plus forte hausse
Claude Opus 55 USD (10 fast)25 USD (50 fast)1MFrontier fermee

Exemple : 1M entree + 3M sortie dans une boucle agent — DeepSeek V4 Flash environ 0,90–1,50 USD, Kimi K3 environ 48 USD, Claude Opus 5 environ 80 USD. Le routage par paliers est la reponse rationnelle, pas le choix d'un seul « meilleur LLM ».

Previsions aout, runbook et routage Python

Cinq variables a suivre en aout 2026

  1. La part chinoise combinee pourrait depasser 50 % sans baisse de prix majeure cote americain.
  2. Le #1 mensuel continuera de tourner — DeepSeek en juin, Xiaomi en juillet ; l'elasticite architecturale prime sur les paris sur un modele.
  3. Anthropic pourrait lancer un tier volume moins cher apres Opus 5.
  4. Quantisation communautaire de Kimi K3 dans les 2–4 semaines suivant la release des poids 1,4TB ; voir analyse Opus 5 / K3.
  5. Securite et gouvernance (sandbox escape, AI Kill Switch Act, cadre White House) entrent dans les grilles d'achat enterprise.

Runbook en six etapes apres les donnees de juillet

  1. Exporter la table de routage : tableau de bord OpenRouter, Top 3 modeles sur 30 jours et couts unitaires ; comparer a la baseline de juin.
  2. Stratifier par type de tache : dialogue, agent, code, donnees — defauts Mimo V2.5 ou DeepSeek V4 Flash ; critique Opus 5 ou GPT-5.5.
  3. Auditer les defauts des frameworks agents : Hermes Agent, Kilo Code, OpenClaw — ~45 % du trafic passe par Hermes.
  4. Poser des alertes de cout : ecart Kimi K3 vs Flash de 20 a 60x ; une session longue mal routee peut absorber le budget hebdomadaire.
  5. Configurer les chaines de fallback : IDs de modeles en configuration, pas en constantes ; 429/timeout : Flash → Pro → frontier.
  6. Deployer un noeud 24h/24 : Gateway sur Mac cloud dedie ; cles API par environnement. Tarifs : location Mac mini MACCOME.
python
# Routage OpenRouter par paliers — leaderboard juillet 2026
import os
from openai import OpenAI

client = OpenAI(
    base_url="https://openrouter.ai/api/v1",
    api_key=os.environ["OPENROUTER_API_KEY"],
)

ROUTES = {
    "bulk": {
        "model": "deepseek/deepseek-v4-flash",
        "fallback": ["xiaomi/mimo-v2.5", "tencent/hy3"],
    },
    "code": {
        "model": "deepseek/deepseek-v4-flash",
        "fallback": ["z-ai/glm-5.2", "anthropic/claude-sonnet-5"],
    },
    "agent": {
        "model": "moonshotai/kimi-k3",
        "fallback": ["deepseek/deepseek-v4-pro", "minimax/minimax-m3"],
    },
    "critical": {
        "model": "anthropic/claude-opus-5",
        "fallback": ["google/gemini-3-flash-preview"],
    },
}

def chat(task: str, messages: list) -> str:
    route = ROUTES[task]
    models = [route["model"], *route["fallback"]]
    resp = client.chat.completions.create(
        model=models[0],
        extra_body={"models": models},
        messages=messages,
    )
    return resp.choices[0].message.content
warning

Production : externalisez la table de routage (JSON ou variables d'environnement) et bloquez les tiers gratuits sur les chemins critiques contenant des donnees sensibles.

Trois chiffres pour la revue technique

  • 46 % Chine, bond en 12 mois : de moins de 2 % a ~46 % ; Etats-Unis de ~70 % a 30–36 %.
  • Ecart volume 14x : Mimo V2.5 (1,4T/jour) vs Claude Sonnet 5 (99,5B/jour).
  • Concentration applicative 45 % : Hermes Agent seul ; Top 3 apps ~67 %.

Juillet 2026 n'est pas un recit « la Chine gagne tout », mais une compression des marges sur la couche volume tandis que les labs frontier defendent le premium. Hermes, Kilo Code ou OpenClaw sur un portable imposent sommeil et instabilite. Les noeuds Mac cloud MACCOME offrent un macOS reel, transfert SSH et isolation d'environnement pour un routage stable 24h/24 — tarifs et configuration.

Sources : classements et leaderboard applications OpenRouter, release Anthropic Opus 5. Chiffres au 25 juillet 2026 sauf mention contraire.

FAQ

Quel modele domine OpenRouter en juillet 2026 ?

Au 25/07 : Xiaomi Mimo V2.5 (1,4T/jour), puis DeepSeek V4 Flash (943,9B) et Tencent Hy3 (590B). Sur sept jours, DeepSeek reste le fournisseur le plus stable a 16–18 %. Donnees live : openrouter.ai/rankings.

Que signifie 46 % de part pour les modeles chinois ?

Les laboratoires chinois representent ~46 % du volume identifie ; les americains 30–36 %. Il y a un an : ~70 % pour les Etats-Unis. Volume et depense premium sur taches difficiles divergent.

Quelle est l'API LLM la moins chere pour le code ?

DeepSeek V4 Flash a environ 0,05–0,14 USD en entree et 0,24–0,28 USD en sortie par million de tokens, 1M de contexte. Pour un planning plus solide : GLM 5.2 ; escalade : Claude Opus 5 uniquement si les paliers inferieurs echouent.

Les classements OpenRouter mesurent-ils la qualite ?

Non. Ils classent le debit de tokens payes. Pour le meilleur LLM sur taches difficiles, regardez la depense en classification (Sonnet 4.6, Opus 4.7, GPT-5.5) et les benchmarks frontier, pas le volume seul.

Comment deployer un routage 24h/24 en production ?

Deployez un Gateway avec primaires et fallbacks tagues par tache sur un Mac cloud dedie. Voir les tarifs de location Mac mini MACCOME pour les noeuds M4/M4 Pro.

Qu'est-ce qui a change depuis juin ?

Mimo V2.5 a depasse DeepSeek V4 Flash en #1 quotidien ; Kimi K3 avec la plus forte hausse sur 30 jours ; Claude Opus 5 le 24/07. Comparaison : analyse juin 2026.