OpenRouter
Accéder et comparer les plateformes API de plusieurs grands modèles via une interface unifiée
Étiquettes :Modèle d’entraînement d’IAQu’est-ce que OpenRouter ?
OpenRouter est une plateforme unifiée qui combine une API de modèle d’IA et des plateformes de routage de fournisseurs. Les développeurs n’ont qu’à créer un compte et une clé API pour pouvoir appeler, via une interface relativement uniforme, des modèles de texte, de raisonnement, visuels, d’images, audio et d’Embedding provenant de différents fabricants, tout en consultant dans la même console la consommation, les coûts, les délais et les erreurs.
OpenRouter n’est pas lui-même un grand modèle, et il ne garantit pas que chaque modèle soit exécuté par la même infrastructure. Il met en relation les modèles avec plusieurs fournisseurs d’inférence et sélectionne les endpoints en fonction du prix, du débit, des délais, de la disponibilité, de la politique de confidentialité et de l’ordre spécifié par l’utilisateur.
Les capacités spécifiques, le contexte, la politique de contenu, la disponibilité régionale et le prix unitaire varient en fonction du modèle et du fournisseur.
Fonctionnalités principales d’OpenRouter
API unifiée multi-modèles
OpenRouter propose des interfaces telles que Chat Completions, Responses et Embeddings dans le style d’OpenAI, et prend également en charge le format Anthropic Messages. De nombreuses applications existantes peuvent y être intégrées en modifiant simplement l’URL de base, la clé API et l’ID du modèle.
Les officiels fournissent également des SDK et des exemples pour Python, TypeScript, Go, etc., mais les différents modèles ne prennent pas en charge exactement les mêmes outils, images, audio, paramètres de raisonnement et sorties structurées.
Aggregation de modèles et de fournisseurs
Le même modèle peut offrir des capacités de raisonnement par plusieurs fournisseurs. Le routage par défaut équilibre la fiabilité et les performances entre les points d’extrémité disponibles, et permet de basculer vers d’autres fournisseurs en cas de limitation de bande passante ou de panne.
Les développeurs peuvent également spécifier l’ordre des fournisseurs, interdire le recours à des solutions de secours, limiter le niveau de quantification, ou choisir des endpoints en fonction du prix, du débit et du retard.
Le recul peut améliorer le taux de réussite, mais il peut modifier les délais, les parties traitant les données, la région et les détails de sortie. Pour les applications exigeant une conformité ou une cohérence des résultats élevées, il convient de fixer les fournisseurs et paramètres autorisés, ainsi que d’enregistrer le modèle, l’endpoint réellement utilisé et l’ID généré.
Routeur de modèle et sélection automatique
OpenRouter offre un routage automatique, un routage par modèle et des préréglages, permettant de choisir un modèle en fonction du contenu entré ou de la disponibilité. Il convient pour tester rapidement parmi de nombreux modèles, tout en utilisant des modèles à faible coût pour les demandes simples et en réservant des modèles plus puissants aux tâches complexes.
Le choix automatique ne signifie pas nécessairement la meilleure qualité ; le système de production doit encore valider la précision, la stabilité et le coût à l’aide d’un ensemble d’évaluation.
BYOK intègre une clé fournisseur.
BYOK permet aux utilisateurs d’ajouter leurs propres clés provenant de fournisseurs tels que OpenAI, Anthropic, Google, AWS, tout en continuant à utiliser l’interface unifiée et le routage d’OpenRouter. Les clés sont stockées de manière chiffrée et peuvent être configurées pour être utilisées en priorité ou uniquement en cas d’échec de la capacité partagée en tant que solution de secours.
Par défaut, il est possible d’utiliser le solde d’OpenRouter même en cas d’échec de la clé intégrée ; pour éviter complètement ce recours, il faut activer la restriction correspondante.
Les frais de modèle BYOK sont facturés depuis le compte du fournisseur initial, et OpenRouter percevra également des frais de plateforme conformément aux règles officielles. Le montant gratuit est calculé en fonction du coût de traitement indiqué pour le modèle correspondant sur OpenRouter, et non simplement en fonction du nombre de demandes.
Contrôle du budget et de la consommation
La console permet de consulter les requêtes, les tokens, les frais, les délais et les erreurs, ainsi que de définir des limites de budget et de dépenses pour la clé API ou l’équipe. La clé API de gestion peut être utilisée pour créer et gérer automatiquement des sous-clés.
Un environnement formel doit attribuer des clés distinctes aux projets et aux développeurs, définir des quotas, autoriser des sources et mettre en place des stratégies de rotation, afin d’éviter le partage de la clé maîtresse.
Acheminement de la politique de confidentialité et de données
Chaque fournisseur de raisonnement dispose de ses propres politiques de journalisation, de conservation et d’entraînement. OpenRouter affiche la politique de données des endpoints ; les utilisateurs peuvent interdire le routage vers des fournisseurs qui pourraient utiliser des prompts pour l’entraînement au niveau de leur compte ou de leur requête, ou encore demander des endpoints compatibles avec Zero Data Retention.
Cette configuration ne contrôle que les fournisseurs sélectionnables et ne remplace pas la lecture des conditions propres à OpenRouter ainsi que celles des fournisseurs de modèles.
Les clients entreprises peuvent demander une routage dans la région des États-Unis ou de l’UE, afin que les requêtes soient traitées dans la région choisie. Cette fonctionnalité régionale n’est pas disponible par défaut pour tous les comptes ou modèles ; il est nécessaire que l’entreprise l’active et consulte la liste des modèles disponibles.
Cache et optimisation des coûts
La plateforme prend en charge le cache de prompts au niveau du fournisseur, ainsi que le même cache de réponses au niveau d’OpenRouter. Une fois le cache de réponses activé, les requêtes réussies correspondant à la même clé API, modèle, point de terminaison, mode streaming et corps de requête peuvent retourner directement les résultats en mémoire, sans frais pour les accès en cache.
Le temps de cache par défaut est court et peut être ajusté selon la demande ou par défaut.
Le cache renverra les résultats originaux, ce qui n’est pas adapté aux scénarios où du contenu nouveau doit être généré à chaque fois. Lorsque la politique de zéro conservation des données au niveau du compte est activée, le cache de réponse n’est pas disponible, car le cache a besoin de conserver temporairement les données renvoyées.
Essai gratuit de Chat et de modèles
Le chat en version web peut être utilisé pour comparer les modèles, tester les prompts et les capacités de fichiers joints. Les modèles gratuits peuvent être essayés directement, mais il existe des limites de requêtes par jour ainsi que des variations dans la capacité et la disponibilité du fournisseur.
Les modèles gratuits sont plus adaptés à l’expérimentation et à la validation du développement, et ne peuvent pas être considérés par défaut comme offrant les mêmes engagements en termes de SLA, de débit ou de confidentialité que les modèles payants.
Comparaison des forfaits et des tarifs d’OpenRouter
OpenRouter est actuellement divisé en Free, Pay-as-you-go et Enterprise. Le modèle lui-même est facturé en fonction des entrées, sorties, images, audio, recherches ou prix par demande affichés sur la page correspondante à chaque modèle ;
Les frais de plateforme et les règles BYOK sont facturés séparément.
Le prix du modèle dynamique ne doit pas être indiqué comme un prix fixe permanent ; le prix actuel peut être consulté avant l’appel via l’API du modèle ou la console.
| Plan | Frais de plateforme | Modèle et plafond | Adéquat pour les utilisateurs |
|---|---|---|---|
| Free | Aucun | 25+ modèles gratuits, 4 fournisseurs gratuits, 50 requêtes/jour | Modèle d’expérience, apprentissage de l’API et tests légers |
| Pay-as-you-go | 5.5% | 400+ modèles, 70+ fournisseurs, pas de minimum d’achat, selon la consommation réelle du modèle | Développeurs individuels, équipes d’applications et startups |
| Enterprise | Des remises peuvent être négociées selon le volume promis. | Conformément aux contrats et aux volumes définis par le modèle, prend en charge les factures, la gestion des stratégies, SSO/SAML ainsi que les SLA. | Organisations à grande échelle, soumises à des réglementations strictes et nécessitant un soutien dédié |
Comparaison des coûts d’OpenRouter BYOK
| Plan | Volume de raisonnement tarifé BYOK sans frais de plateforme mensuels | Frais supplémentaires après dépassement | Explication |
|---|---|---|---|
| Pay-as-you-go | 25 000 dollars | 5% | La facture du modèle est toujours facturée par le fournisseur correspondant avec sa propre clé. |
| Enterprise | 200 000 dollars | 5% | Peut être associé à des contrats d’entreprise, des politiques et des plafonds exclusifs |
Les 25 000 ou 200 000 dollars mentionnés ici ne représentent pas un solde offert, mais plutôt le volume de calcul BYOK sans frais de plateforme, calculé sur la base du prix indiqué pour le même modèle/fournisseur sur OpenRouter. Au-delà de ce seuil, un frais de 5 % est déduit des crédits OpenRouter ; par conséquent, les utilisateurs BYOK doivent toujours conserver un solde de plateforme suffisant.
Guide d’intégration de l’API OpenRouter
- S’inscrire et créer une clé :Générez une clé API spécifique au projet dans la console ; ne mettez pas cette clé dans le code front-end, dans un dépôt public ou dans des captures d’écran.
- Recharger ou choisir un modèle gratuit :Pendant la phase de test, des modèles gratuits peuvent être utilisés ; pour une utilisation en production, il est nécessaire d’acheter des crédits et de définir un plafond de budget.
- Lire la liste des modèles :Vérifiez l’ID du modèle, les types d’entrée/sortie, le contexte, les capacités de l’outil et le prix actuel ; ne vous fiez pas uniquement au nom du modèle.
- Modifier la configuration du client :Lors de l’utilisation d’un SDK compatible, pointez l’URL de base vers OpenRouter et fournissez la clé ainsi que l’ID complet du modèle.
- Envoyer une demande de test :Testez d’abord le texte et la sortie en flux, puis vérifiez un par un les outils, les images, le JSON Schema et les paramètres de raisonnement.
- Définir la stratégie de routage :Spécifier les fournisseurs en fonction des exigences métier, déterminer s’il y a retour en arrière, trier par prix ou performance, ainsi que les conditions de la politique de confidentialité.
- Erreur de traitement :Gérer séparément les cas de limitation de débit, de solde insuffisant, de refus du contenu, de panne du fournisseur et de dépassement du contexte, sans essais répétés indéfinis.
- Mise en ligne de la surveillance :Enregistrer le modèle réel, le fournisseur, le Token, le coût, le délai et l’ID généré, et définir le budget de clés ainsi que les alertes.
Guide d’utilisation d’OpenRouter
Créer des flux de travail professionnels réutilisables
- Utiliser des clés et des quotas différents pour les environnements de développement, de test et de production ;
- Créer un ensemble d’évaluation représentatif grâce à une API multi-modèles unifiée, à l’agrégation des modèles et des fournisseurs, ainsi qu’au routage et à la sélection automatique des modèles ;
- Définir les délais d’attente, la concurrence, les tentatives de réessai, le throttling et les plafonds budgétaires ;
- Effectuer des vérifications sur la sortie en ce qui concerne les faits, la sécurité, le format et les informations sensibles ;
- Surveiller les changements de version, de prix, de délai et de taux d’échec des modèles de surveillance ;
- Préparer des plans de dégradation du modèle, de coupure et de prise en main manuelle ;
Précisions sur la facturation et les coûts
- Les différents modèles peuvent facturer séparément en fonction des tokens d’entrée, des tokens de sortie, des tokens de raisonnement interne, de la lecture/écriture dans le cache, des images, de l’audio, de la recherche sur le web ou d’une requête unique.
- Les contextes longs et les modèles de raisonnement peuvent entraîner des coûts supplémentaires significatifs ;
- L’estimation du nombre de tokens par le client ne sert qu’à titre indicatif budgétaire ; la valeur finale doit se baser sur l’usage retourné par l’API et la facture de la console.
- Le rechargement du solde, les remboursements, les taxes et les méthodes de paiement suivent les règles en vigueur dans la région ainsi que celles indiquées sur la page de règlement.
- Les modèles gratuits, les prix, les fournisseurs et les limites de trafic peuvent être modifiés à tout moment ;
- Lors de la fourniture de services aux utilisateurs, il convient d’établir ses propres limites, des mesures de protection des coûts et des stratégies de dégradation.
À quels utilisateurs OpenRouter convient-il ?
- Développeurs qui souhaitent comparer et passer rapidement entre plusieurs grands modèles via une interface ;
- Équipes de développement qui doivent basculer entre plusieurs fournisseurs pour améliorer la disponibilité de l’API ;
- Les utilisateurs qui souhaitent utiliser un client compatible OpenAI pour accéder à différents modèles de texte et multimodaux ;
- Les organisations qui ont besoin d’une gestion unifiée des budgets, des journaux, des clés et des coûts des modèles ;
- Équipes disposant déjà d’un compte fournisseur et souhaitant utiliser un niveau de routage unique via BYOK.
Avantages et limites d'utilisation
- Les avantages d’OpenRouter sont une large couverture de modèles, une méthode d’accès unifiée, la possibilité de comparer les prix et les performances en temps réel, ainsi que des fonctionnalités de routage, de fallback, de BYOK, de gestion budgétaire et de filtrage des politiques de données.
- Il permet de réduire significativement les coûts d’ingénierie liés aux prototypes multi-modèles et au changement de fournisseur ;
- La couche d’agrégation ajoute également une dépendance par rapport à l’étape de traitement des données ;
- Les paramètres du modèle et les réponses ne sont pas entièrement interchangeables, un changement de fournisseur peut entraîner des variations des résultats ;
- La disponibilité du service reste affectée par les facteurs en amont ;
- Les données sensibles doivent faire l’objet de restrictions concernant les endpoints et les zones autorisées, ainsi que de contrôles des journaux et de clauses de conservation.
- La sortie du modèle peut être erronée ou non conforme ; OpenRouter ne remplace pas la modération des contenus, la vérification des faits ni le contrôle des risques commerciaux.
Questions fréquentes
OpenRouter est-il gratuit ?
Il existe une version gratuite qui propose actuellement plusieurs modèles gratuits avec une limite de 50 requêtes par jour. Les modèles payants sont facturés en fonction de l’utilisation réelle, avec un supplément de 5,5 % de frais de plateforme pour le mode pay-as-you-go.
OpenRouter est-il un modèle ?
Non. C’est une plateforme d’agrégation de modèles, d’API unifiée et de routage des fournisseurs, dont les réponses sont générées par le modèle upstream choisi.
OpenRouter est-il compatible avec l’SDK d’OpenAI ?
La plupart des appels de chat peuvent être connectés en modifiant l’URL de base, la clé et l’ID du modèle. Les paramètres avancés et les fonctionnalités des différents modèles doivent encore être testés conformément à la documentation.
OpenRouter prend-il en charge BYOK ?
Soutenu : il est possible d’ajouter sa propre clé de fournisseur et de définir un ordre de priorité ou de fallback. Le BYOK dispose d’un seuil gratuit mensuel, au-delà duquel une commission de 5 % est appliquée selon les règles en vigueur.
OpenRouter est-il entraîné à l’aide de prompts ?
Les politiques varient d’un fournisseur à l’autre. L’utilisateur peut interdire le routage vers les endpoints contenant des données d’entraînement ou exiger un ZDR, mais il doit néanmoins lire séparément les conditions de données de la plateforme et celles du fournisseur réel.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164