OpenRouter : ce que ça coûte vraiment face à l'API directe
Combien OpenRouter ajoute-t-il au prix de l'API directe ?
OpenRouter ne majore pas le prix des tokens : sa FAQ affirme facturer l'inférence au même tarif que le fournisseur d'origine. Le surcoût se paie ailleurs, à l'achat de crédits : 5,5 % par carte, avec un minimum de 0,80 $, et 5 % en crypto.
Ma chaîne de production d'articles appelle des modèles par OpenRouter à chaque étape. La question « combien de plus qu'en direct ? » s'est donc posée chez moi avant de se poser chez vous.
Le principe tient en une phrase. Une API unifiée (un seul point d'accès pour tous les fournisseurs), une clé API, plus de 400 modèles.
Claude, GPT, Gemini, Llama, Mistral : tout passe par la même porte.
Attention à un chiffre qui circule. Decrypt écrit qu'OpenRouter prélève « environ 5 % » de l'usage.
La FAQ d'OpenRouter décrit autre chose : pas de marge par token, un frais sur les crédits achetés. Pour votre budget, c'est ce frais qui compte.
Le calcul sur Claude Sonnet 5.5, prix relevés le 29 septembre 2026
J'ai relevé les prix dans le catalogue public d'OpenRouter (/api/v1/models) le 29 septembre 2026. Claude Sonnet 5.5 y coûte 2 $ par million de tokens en entrée et 10 $ en sortie. La page de tarifs d'Anthropic affiche exactement les mêmes chiffres. Même constat pour Claude Opus 5.5 : 4 $ et 20 $ des deux côtés.
Prenons un volume mensuel hypothétique, pour illustrer : 100 millions de tokens en entrée, 20 millions en sortie.
- En direct chez Anthropic : 200 $ + 200 $ = 400 $.
- Via OpenRouter : les mêmes 400 $ de crédits, plus 22 $ de frais (5,5 %), soit 422 $.
Sur un petit achat, le minimum pèse plus lourd. Dix dollars de crédits coûtent 0,80 $ de frais, soit 8 %.
OpenRouter ne fait donc pas économiser sur un modèle donné. Il ajoute un frais fixe en échange d'une clé unique.
Deux réserves. Le prix peut varier selon le fournisseur vers lequel la requête est routée. Et ces chiffres ne valent que pour ces deux modèles, à cette date.
Une dernière précaution. Anthropic indique que ses modèles à partir de Claude 4.7 découpent un même texte en davantage de tokens que les précédents. Comparer le prix au million de tokens entre un modèle antérieur à Claude 4.7 et un modèle plus récent trompe donc sur le coût réel.
OpenRouter est-il gratuit ?
Oui pour essayer, non pour la production. Le 29 septembre 2026, le catalogue comptait 464 entrées, dont 16 modèles gratuits (suffixe :free).
Leur usage est plafonné. Sans crédit acheté, la limite est de 50 requêtes par jour. Avec au moins 10 $ de crédits, elle passe à 1 000 requêtes par jour.
De quoi brancher un prototype et valider une intégration. Pas de quoi faire tourner une charge réelle.
Routage, repli automatique et confidentialité des prompts
Le routage d'OpenRouter ne choisit pas « le meilleur modèle ». Il choisit un fournisseur pour le modèle que vous demandez.
Par défaut, il répartit la charge en privilégiant les fournisseurs les moins chers. Il écarte ceux qui ont connu une panne sérieuse dans les 30 dernières secondes.
Le paramètre models déclare une liste de modèles de repli (failover), et allow_fallbacks est activé par défaut. Les options sort ou order imposent votre propre ordre et coupent cet équilibrage.
Côté données, les prompts et les réponses ne sont pas journalisés par défaut. Accepter la journalisation donne 1 % de remise.
Vous avez déjà vos clés chez les fournisseurs ? Le BYOK (utiliser vos propres clés via OpenRouter) est sans frais jusqu'à 25 000 $ par mois en paiement à l'usage. Au-delà, OpenRouter prend 5 % du coût normal du modèle.
Brancher OpenRouter : l'intégration côté Spring AI et côté pipeline du blog
Mon orchestrateur d'articles passe par le SDK Vercel AI et son provider OpenRouter. La clé est lue dans une variable d'environnement, OPENROUTER_API_KEY. Chaque réponse renvoie son coût, que le script additionne étape par étape pour stopper net au-delà d'un plafond de dépense.
Le routage m'a aussi appris une chose. Un même modèle n'est pas servi partout avec la même quantification (la précision numérique des calculs). Sur un hébergeur en basse précision, un modèle de mon pipeline tournait en boucle sans jamais écrire son fichier. En précision plus haute, la même étape aboutissait.
Depuis, le script filtre les hébergeurs par quantification. Ce pipeline fait partie des outils d'IA pour le SEO que j'utilise au quotidien.
Côté Java, OpenRouter parle le format de l'API OpenAI. Spring AI documente trois propriétés pour viser un serveur compatible OpenAI :
spring.ai.openai.base-url=https://openrouter.ai/api/v1
spring.ai.openai.api-key=${OPENROUTER_API_KEY}
spring.ai.openai.chat.model=anthropic/claude-sonnet-5.5
Cette configuration est à vérifier sur votre version. La doc Spring AI 2.0.1 ne cite pas OpenRouter. Elle précise qu'il faut parfois ajouter /v1 à l'URL de base, selon ce qu'attend le serveur.
Testez un premier appel avant de câbler le reste. L'identifiant du modèle se copie depuis le catalogue d'OpenRouter.
Le rachat par Stripe et les alternatives
Stripe a annoncé en août 2026 le rachat d'OpenRouter pour plus de 7 milliards de dollars selon Bloomberg et Forrester. Reuters parle d'un peu plus de 8 milliards.
Qu'est-ce que ça change pour votre code ? Dans son annonce du 19 août 2026, OpenRouter affirme que rien ne change pour les intégrations existantes : même produit, même feuille de route. Une promesse d'éditeur reste une promesse.
Ma recommandation : gardez l'URL de base et la clé en configuration, jamais en dur. Basculer vers l'API directe ou vers une autre passerelle se fera alors sans toucher au code.
Des alternatives existent, comme LiteLLM ou Vercel AI Gateway. Je ne les ai pas comparées, je ne les classerai donc pas.
Vous intégrez un LLM dans une application Java / Spring Boot ? Je développe sur cette stack depuis 2015. Réserver un appel découverte de 30 minutes.