Concept fondamental : les fournisseurs (Providers)
Les fournisseurs sont les moteurs IA sous-jacents (grands modèles de langage) qui traitent votre texte et génèrent les réponses. Rephlo est une interface universelle — vous pouvez échanger ces « cerveaux » selon la tâche, et un même fournisseur peut exposer plusieurs modèles (voir Modèles & Inférence).
Types de fournisseurs
Rephlo prend en charge 8 types de fournisseurs Bring-Your-Own-Key (BYOK), ainsi qu'une Dedicated API gérée par Rephlo :
Fournisseurs cloud (connexion Internet requise)
- OpenAI — modèles de la famille GPT. Référence du secteur pour le raisonnement, le code et la créativité.
- Anthropic — modèles Claude ; reconnus pour la qualité de rédaction, de grandes fenêtres de contexte, et le prompt caching (activé par défaut).
- Groq — inférence ultra-rapide sur puces LPU personnalisées — réponses quasi instantanées.
- Google — modèles Gemini avec de solides capacités multimodales.
- xAI (Grok) — modèles Grok avec Live Search en temps réel en option.
- OpenRouter — une passerelle unifiée vers plus de 100 modèles provenant de nombreux fournisseurs, avec suivi via Site URL / Site Name.
- OpenAI-Compatible — se connecte à tout service implémentant la spécification de l'API OpenAI (Azure OpenAI, vLLM, LocalAI, LiteLLM, LM Studio, proxys personnalisés). Nécessite une API Key, une Base URL et un Model Name.
Fournisseur local (confidentialité totale)
- Ollama — exécutez des modèles open source (Llama, Mistral, Gemma, DeepSeek, Qwen) directement sur votre ordinateur. Vos données ne quittent jamais votre machine. Base URL configurable (par défaut
http://localhost:11434) ; une clé API Ollama optionnelle active la recherche web.
Azure OpenAI se connecte via le type OpenAI-Compatible — choisissez OpenAI-Compatible et saisissez votre point de terminaison de déploiement Azure comme Base URL (et le nom de votre déploiement comme Model Name). Ce n'est pas une entrée distincte dans la liste d'ajout de fournisseur.
Modèles sur l'appareil (on-device) : Rephlo exécute aussi des modèles GGUF entièrement sur l'appareil (sans Internet, sans Ollama) via un moteur intégré. Il s'agit d'une voie d'inférence connexe mais distincte — voir Modèles sur l'appareil et Modèles & Inférence.
Fournisseur géré
- Dedicated API — l'option cloud gérée de Rephlo, utilisant OAuth 2.0. La configuration la plus simple pour les utilisateurs qui ne veulent pas gérer de clés API ; l'utilisation est suivie en credit. Sa configuration est créée automatiquement et masquée de la liste normale des fournisseurs.
Vous voulez un sélecteur limité au BYOK/sur l'appareil ? Activez Hide online models from Rephlo Gateway dans Fournisseurs (Providers) pour masquer les modèles Dedicated (Gateway) de tous les sélecteurs de modèle.
Sur l'appareil (On-Device) vs BYOK
Ces deux approches « apportez votre propre modèle » sont faciles à confondre :
- On-Device — des modèles ouverts (GGUF) qui s'exécutent localement sur votre machine via le moteur intégré. Aucune clé API, aucun Internet, confidentialité totale ; rien ne quitte votre ordinateur.
- BYOK (Bring Your Own Key) — vous fournissez votre propre clé API pour un fournisseur externe (un fournisseur cloud, ou Ollama en local). Les requêtes sont envoyées à ce fournisseur sous votre clé, et le fournisseur vous facture directement.
On-Device et BYOK sont tous deux des fonctionnalités du palier Pro — leur utilisation nécessite un plan Pro actif (ou supérieur) ou une licence perpétuelle. Pour les modèles on-device, cette restriction couvre à la fois le téléchargement et l'exécution ; une fois débloqués, ils s'exécutent sans credit et entièrement hors ligne. Configurez vos clés sous Fournisseurs.
Dedicated API de la plateforme vs BYOK Enterprise
- Dedicated API est une inférence hébergée gérée par Rephlo : connectez-vous et utilisez les modèles de pointe de Rephlo, facturés en credit, sans aucune clé à gérer.
- BYOK Enterprise (via la plateforme) s'adresse aux organisations qui configurent de façon centralisée leurs propres clés de fournisseur et modèles autorisés au niveau de l'organisation, afin que chaque membre utilise les modèles et les clés de l'organisation — pour la conformité et la maîtrise des coûts.
En résumé : la Dedicated API échange les clés contre du credit et une configuration nulle, tandis que le BYOK Enterprise centralise la gestion des clés au niveau de l'organisation. Les clés BYOK personnelles se configurent sous Fournisseurs.
Mode de fournisseur
Chaque fournisseur fonctionne selon l'un des deux modes suivants : BYOK (vous fournissez la clé du fournisseur) ou Dedicated (géré par Rephlo, avec suivi du credit).
Modes de connexion
Mode Dedicated (géré)
- Description : Rephlo gère la connexion et la facturation via OAuth 2.0 ; l'utilisation est prélevée sur votre credit.
- Avantages : configuration nulle, facturation gérée.
- Inconvénients : moins de contrôle bas niveau sur les paramètres du modèle.
Mode BYOK (Bring Your Own Key)
- Description : vous utilisez directement votre propre clé API du fournisseur.
- Avantages : confidentialité maximale (les données vont directement de votre machine au fournisseur, sans passer par les serveurs de Rephlo), tarification directe du fournisseur, et accès immédiat aux nouveaux modèles.
- Inconvénients : nécessite un compte chez le fournisseur.
Ce que stocke une configuration de fournisseur
Chaque configuration de fournisseur comprend :
- Un Display Name de remplacement optionnel.
- Un Mode (BYOK / Dedicated) et un type de fournisseur.
- Models — un ou plusieurs modèles, dont un marqué par défaut.
- Configuration — des champs spécifiques au fournisseur. Les clés API et les tokens sont stockés chiffrés :
- OpenAI / OpenAI-Compatible : API Key, Base URL optionnelle (et, pour OpenAI-Compatible, un Model Name). Azure OpenAI utilise ce type — pointez la Base URL vers votre point de terminaison de déploiement Azure.
- Anthropic : API Key, Base URL optionnelle, prompt caching activé par défaut.
- Google : API Key, Base URL optionnelle.
- Groq : API Key.
- Ollama : Base URL, clé API optionnelle (pour la recherche web).
- xAI (Grok) : API Key, bascule Live Search optionnelle.
- OpenRouter : API Key, Site URL / Site Name optionnels.
- Capabilities — des bascules pour Vision, Function Calling (tools), Long Context, Web Search, Thinking, et plus encore ; validées par rapport aux capacités réelles du modèle au moment de l'exécution.
- Model Parameters — des réglages de requête par fournisseur/modèle (température, nombre maximal de tokens, top-p, etc.).
Un seul fournisseur est actif à la fois. Vous pouvez aussi remplacer le fournisseur par commande pour un contrôle plus fin.

Obtenir des clés API (BYOK)
Avec le BYOK, vous payez directement le fournisseur pour l'utilisation de l'API.
| Provider | Où obtenir les clés | Remarques |
|---|---|---|
| Azure OpenAI | portal.azure.com | Nécessite un abonnement Azure + une ressource OpenAI déployée |
| OpenAI | platform.openai.com | Modèles de la famille GPT |
| Anthropic | console.anthropic.com | Modèles Claude ; prend en charge le prompt caching |
| Groq | console.groq.com | Palier gratuit disponible |
aistudio.google.com | Gemini Pro / Flash | |
| xAI | console.x.ai | Modèles Grok ; Live Search en option |
| OpenRouter | openrouter.ai | Une seule clé, plus de 100 modèles |
| OpenAI-Compatible | Varie selon le service | vLLM, LocalAI, LiteLLM, LM Studio |
| Ollama | installation locale + ollama.com/settings/keys | Modèles locaux ; clé API nécessaire uniquement pour la recherche web |
Changer de fournisseur
Vous pouvez changer de fournisseur globalement (par défaut pour toutes les commandes) ou par commande. Par exemple, utilisez Groq pour des vérifications orthographiques rapides (rapide et économique), et passez à Claude pour des analyses complexes (intelligent et nuancé).
Guide de comparaison des fournisseurs
| Provider | Idéal pour | Vitesse | Confidentialité |
|---|---|---|---|
| Azure OpenAI | Entreprise, conformité | Rapide | Cloud |
| OpenAI | Usage général, code, analyse | Rapide | Cloud |
| Anthropic (Claude) | Rédaction, documents longs, caching | Rapide | Cloud |
| Groq | Tâches rapides | Ultra-rapide | Cloud |
| Google (Gemini) | Multimodal, recherche | Rapide | Cloud |
| xAI (Grok) | Connaissances en temps réel | Rapide | Cloud |
| OpenRouter | Accès multi-modèles | Variable | Cloud |
| OpenAI-Compatible | Auto-hébergé, personnalisé | Variable | Auto-hébergé / cloud |
| Ollama | Confidentialité, hors ligne | Dépend du matériel | Sur votre machine |
Les noms de modèles spécifiques et la taille des fenêtres de contexte changent fréquemment. Pour voir précisément quels modèles chaque fournisseur expose — et comment remplacer le modèle par commande ou par conversation — consultez Modèles & Inférence.
Concept suivant : découvrez le Tableau de bord & Navigation.