FlowKit

Connecter OpenRouter à n8n : tous les modèles IA derrière une seule clé

Publié le 30 juillet 2026 · 4 min de lecture

Chaque fournisseur d'IA a son API, sa clé, son format et son node dans n8n : OpenAI et Claude, Gemini, Mistral, Perplexity… Multiplier les crédentiels fonctionne, mais dès qu'on veut comparer des modèles, basculer en cas de panne ou optimiser les coûts requête par requête, la gestion devient laborieuse. OpenRouter répond exactement à ce problème : une API unique, compatible avec le format OpenAI, qui donne accès à des centaines de modèles de tous les grands fournisseurs derrière une seule clé. Et l'idée de choisir dynamiquement le modèle selon la requête n'est pas un gadget : les travaux de Ong et al. publiés en 2024 (« RouteLLM: Learning to Route LLMs with Preference Data », voir sur Google Scholar) montrent qu'un routage intelligent entre un modèle fort et un modèle faible réduit les coûts de plus de moitié sans dégrader la qualité des réponses — le principe même que ce type de passerelle rend accessible sans entraîner quoi que ce soit.

Créer le crédentiel dans n8n

  1. Créez un compte sur openrouter.ai, créditez-le de quelques euros et générez une clé dans Keys.
  2. Dans n8n, ajoutez un node OpenRouter Chat Model (c'est un sous-node : il se branche sur un AI Agent, une LLM Chain, un Text Classifier…).
  3. Créez le crédentiel OpenRouter API avec votre clé, puis choisissez le modèle dans la liste déroulante.

Les modèles sont nommés fournisseur/modele : openai/gpt-4o-mini, anthropic/claude-sonnet-4-5, google/gemini-2.5-flash, mistralai/mistral-small… Changer de modèle = changer cette chaîne. C'est toute la valeur du système : vos workflows deviennent indépendants du fournisseur.

À noter : comme l'API d'OpenRouter est compatible avec le format OpenAI, les nodes OpenAI de n8n fonctionnent aussi en pointant leur base URL vers https://openrouter.ai/api/v1 — utile pour les workflows existants que vous ne voulez pas recâbler.

Choisir son modèle sans dogmatisme

La liste d'OpenRouter affiche pour chaque modèle son prix par million de tokens en entrée et en sortie, sa fenêtre de contexte et son débit. Trois réflexes :

  • Tâches courtes et bornées (classification, extraction, reformulation) : un modèle économique suffit presque toujours — c'est la conclusion pratique de l'étude FrugalGPT de Chen, Zaharia et Zou publiée en 2023 (« FrugalGPT: How to Use Large Language Models While Reducing Cost and Improving Performance », voir sur Google Scholar), qui obtient les performances d'un grand modèle pour une fraction du coût en cascadant des modèles moins chers.
  • Raisonnement, synthèse, rédaction longue : réservez les modèles frontières aux étapes où la différence se voit, comme l'étage de synthèse d'un résumé de documents longs.
  • Prototypage : les variantes :free de certains modèles permettent de tester un workflow sans consommer de crédits — avec des limites de débit qui les excluent de la production.

Le méta-modèle openrouter/auto délègue le choix à OpenRouter, qui route la requête vers un modèle adapté : pratique pour démarrer, mais en production on préfère généralement un choix explicite par étape de workflow — les tests décrits dans notre guide des évaluations n8n vous diront objectivement quel modèle suffit où.

Fallback et haute disponibilité

Les pannes et saturations d'API sont la première cause d'échec des workflows IA en production. OpenRouter atténue le problème à sa couche : si le fournisseur principal d'un modèle est indisponible, la requête peut être servie par un autre hébergeur du même modèle. Cela ne remplace pas un vrai plan B applicatif : notre guide du fallback multi-fournisseurs reste d'actualité — la différence étant qu'avec OpenRouter, la bascule se fait en changeant un paramètre de modèle plutôt qu'en maintenant deux crédentiels et deux branches. Combinez les deux niveaux pour les flux critiques, avec les retries et timeouts habituels et un Error Workflow en filet.

Maîtriser les coûts

Le tableau de bord d'OpenRouter ventile la dépense par modèle, par clé et par jour — créez une clé par environnement ou par workflow critique pour obtenir une comptabilité analytique gratuite. Côté n8n, complétez avec notre méthode de suivi du coût des appels IA par workflow, et gardez les réflexes classiques : dédupliquer avant d'appeler, mettre en cache les réponses récurrentes, et respecter les limites de débit pour éviter les erreurs 429 en rafale.

Sécurité du crédentiel

Une clé OpenRouter donne accès à l'ensemble de vos crédits : traitez-la comme n'importe quel secret de production. Stockez-la exclusivement dans le gestionnaire de crédentiels de n8n, jamais dans un node Code ou une variable en clair, et appliquez les pratiques de notre guide sur la sécurisation des crédentiels API dans n8n — d'autant plus important sur une instance self-hosted partagée entre plusieurs utilisateurs.

Verdict

OpenRouter est devenu le raccourci standard pour les workflows n8n multi-modèles : un crédentiel, des centaines de modèles, un changement de fournisseur qui se fait en éditant une chaîne. Gardez l'API directe pour les gros volumes mono-modèle et les intégrations aux fonctionnalités propriétaires (fichiers, assistants), et OpenRouter pour tout le reste — c'est-à-dire, dans la plupart des stacks d'automatisation, l'essentiel.

FAQ

Questions fréquentes

Pourquoi passer par OpenRouter plutôt que par les API de chaque fournisseur ?

Trois raisons pratiques : un seul crédentiel à gérer dans n8n au lieu d'un par fournisseur ; la possibilité de changer de modèle en éditant une chaîne de caractères plutôt qu'en recâblant un node et une clé ; et des mécanismes de routage et de repli intégrés quand un fournisseur est saturé. En contrepartie, vous ajoutez un intermédiaire : pour un usage massif sur un seul modèle, l'API directe du fournisseur reste pertinente.

Comment se facture OpenRouter ?

Vous créditez un compte, puis chaque appel est décompté au tarif par token du modèle utilisé, aligné sur les prix des fournisseurs sous-jacents (OpenRouter se rémunère par des frais sur l'achat de crédits). Le tableau de bord détaille la consommation par modèle et par clé, ce qui complète bien un suivi des coûts par workflow côté n8n.

Les modèles gratuits d'OpenRouter suffisent-ils pour de la production ?

Non. Les variantes gratuites (suffixe :free) sont soumises à des limites de débit strictes et peuvent changer sans préavis : parfaites pour prototyper un workflow, inadaptées à un flux de production. Pour la production, utilisez les modèles payants, éventuellement avec le routage prix/performance d'OpenRouter pour optimiser la facture.

Que deviennent mes données envoyées via OpenRouter ?

OpenRouter relaie vos requêtes vers le fournisseur du modèle choisi, et ses réglages de confidentialité permettent d'exclure les fournisseurs qui utiliseraient les données à des fins d'entraînement. Pour des données réellement sensibles, les mêmes réflexes s'appliquent qu'avec n'importe quelle API : minimiser ce qu'on envoie, anonymiser en amont, ou garder ces flux sur un modèle local.

Bundle FlowKit Complet

269 €