Stripe a accepté d’acquérir OpenRouter, une plateforme de routage de modèles d’IA qui permet aux développeurs d’accéder à des centaines de modèles via une interface unique. L’accord ajoute la sélection et le routage de modèles au travail existant de Stripe autour de l’utilisation de l’IA et de la facturation basée sur les jetons.
OpenRouter prend en charge plus de 400 modèles provenant de plus de 80 fournisseurs, selon Stripe. Plutôt que d’exiger des intégrations distinctes avec chaque fournisseur de modèles, les développeurs peuvent utiliser OpenRouter pour envoyer des requêtes via une seule API.
Routage au-delà du choix du modèle
La plateforme évalue les demandes en fonction de facteurs tels que la complexité des tâches, le prix, la rapidité et la fiabilité. Il peut alors orienter chaque demande vers un modèle adapté à ces exigences.
OpenRouter gère également une deuxième couche de routage entre les fournisseurs servant le même modèle. Sa documentation indique que les clients peuvent hiérarchiser les points finaux en fonction du prix, du débit ou de la latence, tout en définissant des exigences telles que des prix maximaux ou des niveaux de performances minimaux.
La plateforme mesure la latence et le débit pour les combinaisons modèle-fournisseur individuelles à l’aide de données de performances glissantes. Cela permet à une requête d’être acheminée vers un point de terminaison qui répond à des critères de coût ou de performances spécifiés plutôt que de dépendre d’un fournisseur fixe.
Cela sépare deux décisions de routage : quel modèle gère une demande et quel point de terminaison du fournisseur la sert.
Le choix du fournisseur peut également affecter les coûts d’inférence même lorsque le modèle sous-jacent reste le même. Dans un exemple de juin 2026, OpenRouter a répertorié le prix d’entrée de Llama 3.3 70B à 0,10 $ par million de jetons via DeepInfra et 1,04 $ via Together, tandis que le prix de sortie variait de 0,32 $ à 1,04 $ par million de jetons parmi les fournisseurs indiqués.
Le routage peut assurer le basculement lorsqu’un point de terminaison devient indisponible. OpenRouter affirme que son système peut déplacer les demandes vers des fournisseurs ou des modèles alternatifs lorsqu’il rencontre des problèmes, notamment des pannes de fournisseur, des limites de débit, des erreurs de longueur de contexte ou des refus de modération.
Les exigences en matière de traitement des données peuvent également faire partie de la sélection du fournisseur. OpenRouter permet aux utilisateurs de restreindre les requêtes aux points de terminaison Zero Data Retention et d’empêcher le routage vers des fournisseurs qui collectent des données ou s’entraînent sur les invites, tandis que les entreprises clientes peuvent demander un traitement dans la région aux États-Unis ou dans l’UE.
Les critères de routage peuvent donc inclure la capacité du modèle, la disponibilité du fournisseur, l’emplacement de traitement, la latence, le débit et le coût.
L’infrastructure multimodèle se développe
Les environnements multimodèles sont déjà courants parmi les organisations interrogées. Le rapport 2026 State of Application Strategy de F5, basé sur les réponses de plus de 1 100 décideurs informatiques, a révélé que 52 % des organisations enchaînaient ou orchestraient plusieurs modèles d’IA, les personnes interrogées utilisant en moyenne sept modèles.
Menlo Ventures, un investisseur d’OpenRouter, a rapporté une mesure différente du comportement des fournisseurs dans son enquête de mi-année 2025. L’étude a révélé que 66 % des constructeurs ont mis à niveau leurs modèles tout en restant chez leur fournisseur existant, tandis que 11 % ont changé de fournisseur.
OpenRouter est également l’un des nombreux fournisseurs d’infrastructure à ajouter un modèle de routage. Snowflake a annoncé le 18 août le routage de modèles dynamiques pour Cortex AI Gateway, la fonctionnalité devant entrer en version préliminaire privée.
Snowflake a déclaré que le système attribuerait les demandes en fonction de facteurs tels que la qualité, la vitesse, les préférences du client et le coût. Cloudflare propose le routage dynamique en version bêta via AI Gateway, avec des règles couvrant la sélection du modèle, les quotas et les solutions de secours.
AWS fournit un routage d’invites intelligent via Bedrock, tandis que Microsoft Foundry propose des profils de routage qui équilibrent la qualité et le prix du modèle. AWS et Snowflake décrivent tous deux des systèmes capables de diriger des charges de travail moins exigeantes vers des modèles plus petits ou moins coûteux tout en réservant d’autres modèles aux tâches nécessitant une qualité de réponse plus élevée ou un raisonnement plus complexe.
Le routage ajoute également des exigences opérationnelles. Le centre d’architecture Azure de Microsoft note que la sélection dynamique de modèles peut compliquer la prévision des coûts, le débogage et l’analyse des performances lorsque différentes demandes sont traitées par différents modèles.
Stripe et OpenRouter travaillaient déjà ensemble avant l’acquisition. En janvier 2026, Stripe a déclaré que les développeurs utilisant OpenRouter pouvaient acheminer les demandes de modèles via la plate-forme pendant que Stripe suivait l’utilisation, appliquait les prix et gérait la facturation.
L’accord associait la couche de routage d’OpenRouter aux systèmes de mesure de l’utilisation et de facturation de Stripe avant l’accord d’acquisition.
L’utilisation des jetons répond à la facturation
Stripe a également développé des outils de facturation basés sur des jetons pour les applications d’IA. Son service de facturation de jetons LLM, que Stripe répertorie actuellement comme étant en version préliminaire privée, peut mesurer la consommation en fonction du modèle et du type de jeton, y compris les jetons d’entrée, de sortie et en cache lorsqu’ils sont pris en charge.
La documentation de Stripe indique que les entreprises peuvent utiliser le système pour une tarification par jeton, des crédits prépayés, des frais fixes avec utilisation incluse ou une combinaison de ces approches. La société peut également mettre à jour les prix des modèles pris en charge lorsque les fournisseurs modifient leurs prix sous-jacents.
OpenRouter produit déjà une grande partie des données d’utilisation impliquées dans ces calculs de facturation. Son API rapporte le nombre d’invites, d’achèvement, de raisonnement et de jetons mis en cache avec les réponses individuelles, ainsi que le coût de la demande.
Il enregistre également le coût d’inférence sous-jacent facturé par le fournisseur séparément du montant facturé sur un compte OpenRouter. Le nombre de jetons est calculé à l’aide du tokeniseur natif de chaque modèle plutôt que d’appliquer une méthode de comptage unique sur tous les modèles.
Le PDG de Stripe, Patrick Collison, a lié l’acquisition au rôle des jetons et des ressources informatiques dans les applications d’IA. Collison a déclaré que les jetons constituent une unité centrale pour les entreprises qui construisent avec l’IA et qu’ils lient leur utilisation économique à la manière dont les entreprises gèrent les ressources informatiques disponibles.
La consommation de jetons d’entreprise atteint déjà des volumes importants. Deloitte a interrogé 515 décideurs commerciaux et technologiques basés aux États-Unis fin 2025, tous issus d’organisations générant au moins 500 millions de dollars de chiffre d’affaires annuel.
L’enquête a révélé que 37 % des personnes interrogées consommaient entre un milliard et 10 milliards de jetons d’IA par mois, tandis que 30 % en consommaient plus de 10 milliards. D’ici 2028, 61 % s’attendent à ce que la consommation mensuelle dépasse les 10 milliards de tokens.
Deloitte a déclaré qu’une grande partie de l’augmentation proviendrait de charges de travail dépassant 100 milliards de jetons par mois, l’utilisation des jetons dans cette fourchette devant tripler de 2026 à 2028.
La société a averti qu’une consommation plus élevée de jetons n’indique pas nécessairement une adoption plus efficace de l’IA. Deloitte a identifié des invites surdimensionnées, une mauvaise gestion du contexte et une réutilisation limitée comme facteurs pouvant augmenter la consommation de jetons.
Le coût de traitement de ces jetons peut également différer selon le modèle et, dans certains cas, selon le fournisseur desservant le même modèle.
OpenRouter affirme traiter plus de 10 000 milliards de jetons par jour au sein d’une communauté de plus de 10 millions de développeurs et d’entreprises. Les chiffres antérieurs publiés par OpenRouter donnent une idée de l’évolution de son trafic avant l’acquisition.
En mai, la société a déclaré que son volume hebdomadaire était passé de cinq mille milliards à 25 mille milliards de jetons au cours des six mois précédents. À l’époque, OpenRouter déclarait servir plus de huit millions de développeurs sur plus de 400 modèles.
OpenRouter a été fondée en 2023 et a levé des fonds auprès d’investisseurs tels que Menlo Ventures et Andreessen Horowitz. Son cycle de financement de série B de 113 millions de dollars en mai a été mené par CapitalG, le fonds de croissance indépendant d’Alphabet, avec la participation d’investisseurs tels que NVentures, ServiceNow Ventures, MongoDB Ventures, Snowflake Ventures et Databricks Ventures.
Stripe et OpenRouter n’ont pas divulgué les conditions financières de l’acquisition. Reuters a rapporté que la transaction valait un peu plus de 8 milliards de dollars, citant une personne proche du dossier qui a demandé l’anonymat car les informations étaient confidentielles.
(Photo par appshunter.io)