Kernkonzept: Provider
Provider sind die zugrunde liegenden KI-Engines (Large Language Models), die Ihren Text verarbeiten und Antworten generieren. Rephlo ist eine universelle Schnittstelle — Sie können diese „Gehirne“ je nach Aufgabe austauschen, und ein einzelner Provider kann mehrere Modelle bereitstellen (siehe Modelle & Inferenz).
Provider-Typen
Rephlo unterstützt 8 Bring-Your-Own-Key (BYOK) Provider-Typen sowie eine von Rephlo verwaltete Dedicated API:
Cloud-Provider (Internetverbindung erforderlich)
- OpenAI — GPT-Klasse-Modelle. Industriestandard für Reasoning, Coding und Kreativität.
- Anthropic — Claude-Modelle; bekannt für hochwertiges Schreiben, große Kontextfenster und Prompt Caching (standardmäßig aktiviert).
- Groq — Ultraschnelle Inferenz auf speziellen LPU-Chips — nahezu sofortige Antworten.
- Google — Gemini-Modelle mit starken multimodalen Fähigkeiten.
- xAI (Grok) — Grok-Modelle mit optionaler Echtzeit-Live Search.
- OpenRouter — Ein einheitliches Gateway zu über 100 Modellen von vielen Anbietern, mit Tracking über Site URL / Site Name.
- OpenAI-Compatible — Verbindung zu jedem Dienst, der die OpenAI-API-Spezifikation implementiert (Azure OpenAI, vLLM, LocalAI, LiteLLM, LM Studio, benutzerdefinierte Proxys). Erfordert API-Schlüssel, Base URL und Model Name.
Lokaler Provider (vollständige Privatsphäre)
- Ollama — Führen Sie Open-Source-Modelle (Llama, Mistral, Gemma, DeepSeek, Qwen) direkt auf Ihrem Computer aus. Ihre Daten verlassen niemals Ihr Gerät. Konfigurierbare Base URL (Standard
http://localhost:11434); ein optionaler Ollama-API-Schlüssel aktiviert die Websuche.
Azure OpenAI wird über den Typ OpenAI-Compatible verbunden — wählen Sie OpenAI-Compatible und geben Sie Ihren Azure-Deployment-Endpunkt als Base URL ein (sowie Ihren Deployment-Namen als Model Name). Es handelt sich nicht um einen eigenen Eintrag in der Liste zum Hinzufügen von Providern.
On-Device-Modelle: Rephlo führt außerdem GGUF-Modelle vollständig on-device aus (kein Internet, kein Ollama) über eine integrierte Engine. Dies ist ein verwandter, aber separater Inferenzpfad — siehe On-Device-Modelle und Modelle & Inferenz.
Verwalteter Provider
- Dedicated API — Rephlos verwaltete Cloud-Option unter Verwendung von OAuth 2.0. Die einfachste Einrichtung für Nutzer, die keine API-Schlüssel verwalten möchten; die Nutzung wird über credits erfasst. Ihre Konfiguration wird automatisch erstellt und ist in der regulären Provider-Liste ausgeblendet.
Möchten Sie eine reine BYOK-/On-Device-Auswahl? Aktivieren Sie Hide online models from Rephlo Gateway unter Providers, um Dedicated-(Gateway-)Modelle aus jeder Modellauswahl auszublenden.
On-Device vs. BYOK
Diese beiden „Bring-your-own-model“-Wege werden leicht verwechselt:
- On-Device — offene Modelle (GGUF), die lokal auf Ihrem Gerät über die integrierte Engine laufen. Kein API-Schlüssel, kein Internet, vollständig privat; nichts verlässt Ihren Computer.
- BYOK (Bring Your Own Key) — Sie stellen Ihren eigenen API-Schlüssel für einen externen Provider bereit (einen Cloud-Anbieter oder das lokale Ollama). Anfragen gehen unter Ihrem Schlüssel an diesen Provider, und der Anbieter stellt Ihnen direkt in Rechnung.
Sowohl On-Device als auch BYOK sind Pro-Tier-Funktionen — ihre Nutzung erfordert einen aktiven Pro-Plan (oder höher) oder eine unbefristete Lizenz. Bei On-Device-Modellen deckt diese Freischaltung sowohl das Herunterladen als auch das Ausführen ab; sobald freigeschaltet, laufen sie ohne credits und vollständig offline. Richten Sie Schlüssel unter Providers ein.
Platform Dedicated API vs. Enterprise BYOK
- Dedicated API ist von Rephlo verwaltete, gehostete Inferenz: melden Sie sich an und nutzen Sie Rephlos Spitzenmodelle, abgerechnet in credits, ohne Schlüssel verwalten zu müssen.
- Enterprise BYOK (über die Plattform) ist für Organisationen, die zentral ihre eigenen Provider-Schlüssel und zulässigen Modelle auf Organisationsebene konfigurieren, sodass jedes Mitglied die Modelle und Schlüssel der Organisation nutzt — für Compliance und Kostenkontrolle.
Kurz gesagt: Die Dedicated API tauscht Schlüssel gegen credits und keine Einrichtung, während Enterprise BYOK die Schlüsselverwaltung zentral in der Organisation belässt. Persönliche BYOK-Schlüssel werden unter Providers konfiguriert.
Provider-Modus
Jeder Provider arbeitet in einem von zwei Modi: BYOK (Sie stellen den Anbieter-Schlüssel bereit) oder Dedicated (von Rephlo verwaltet, mit Credit-Tracking).
Verbindungsmodi
Dedicated-Modus (verwaltet)
- Beschreibung: Rephlo verwaltet die Verbindung und Abrechnung über OAuth 2.0; die Nutzung wird von Ihren credits abgezogen.
- Vorteile: Keine Einrichtung erforderlich, verwaltete Abrechnung.
- Nachteile: Weniger detaillierte Kontrolle über Modellparameter.
BYOK-Modus (Bring Your Own Key)
- Beschreibung: Sie verwenden Ihren eigenen API-Schlüssel des Anbieters direkt.
- Vorteile: Maximale Privatsphäre (Daten gehen direkt von Ihrem Gerät zum Anbieter, unter Umgehung der Rephlo-Server), direkte Anbieterpreise und sofortiger Zugriff auf neue Modelle.
- Nachteile: Erfordert ein Konto beim Anbieter.
Was eine Provider-Konfiguration speichert
Jede Provider-Konfiguration umfasst:
- Einen optionalen Display Name als Überschreibung.
- Einen Mode (BYOK / Dedicated) und den Provider-Typ.
- Models — ein oder mehrere Modelle, wobei eines als Standard markiert ist.
- Configuration — providerspezifische Felder. API-Schlüssel und Tokens werden verschlüsselt gespeichert:
- OpenAI / OpenAI-Compatible: API-Schlüssel, optionale Base URL (und bei OpenAI-Compatible ein Model Name). Azure OpenAI verwendet diesen Typ — richten Sie die Base URL auf Ihren Azure-Deployment-Endpunkt.
- Anthropic: API-Schlüssel, optionale Base URL, Prompt Caching standardmäßig aktiviert.
- Google: API-Schlüssel, optionale Base URL.
- Groq: API-Schlüssel.
- Ollama: Base URL, optionaler API-Schlüssel (für Websuche).
- xAI (Grok): API-Schlüssel, optionaler Live-Search-Schalter.
- OpenRouter: API-Schlüssel, optionale Site URL / Site Name.
- Capabilities — Schalter für Vision, Function Calling (Tools), Long Context, Web Search, Thinking und mehr; wird zur Laufzeit gegen die tatsächlichen Fähigkeiten des Modells geprüft.
- Model Parameters — Anfrageeinstellungen pro Provider/Modell (Temperature, Max Tokens, Top-P usw.).
Es ist immer nur ein Provider gleichzeitig aktiv. Sie können den Provider auch pro Command für eine feingranulare Steuerung überschreiben.

API-Schlüssel erhalten (BYOK)
Bei Verwendung von BYOK zahlen Sie die API-Nutzung direkt an den Anbieter.
| Provider | Wo Sie Schlüssel erhalten | Hinweise |
|---|---|---|
| Azure OpenAI | portal.azure.com | Erfordert ein Azure-Abonnement + eine bereitgestellte OpenAI-Ressource |
| OpenAI | platform.openai.com | GPT-Klasse-Modelle |
| Anthropic | console.anthropic.com | Claude-Modelle; unterstützt Prompt Caching |
| Groq | console.groq.com | Kostenlose Stufe verfügbar |
aistudio.google.com | Gemini Pro / Flash | |
| xAI | console.x.ai | Grok-Modelle; optionale Live Search |
| OpenRouter | openrouter.ai | Ein Schlüssel, über 100 Modelle |
| OpenAI-Compatible | Je nach Dienst unterschiedlich | vLLM, LocalAI, LiteLLM, LM Studio |
| Ollama | Lokale Installation + ollama.com/settings/keys | Lokale Modelle; API-Schlüssel nur für Websuche erforderlich |
Provider wechseln
Sie können Provider global (Standard für alle Commands) oder pro Command wechseln. Verwenden Sie beispielsweise Groq für schnelle Rechtschreibprüfungen (schnell und günstig) und wechseln Sie zu Claude für komplexe Analysen (intelligent und nuanciert).
Provider-Vergleichsleitfaden
| Provider | Am besten geeignet für | Geschwindigkeit | Privatsphäre |
|---|---|---|---|
| Azure OpenAI | Unternehmen, Compliance | Schnell | Cloud |
| OpenAI | Allgemein, Coding, Analyse | Schnell | Cloud |
| Anthropic (Claude) | Schreiben, lange Dokumente, Caching | Schnell | Cloud |
| Groq | Schnelle Aufgaben | Ultraschnell | Cloud |
| Google (Gemini) | Multimodal, Recherche | Schnell | Cloud |
| xAI (Grok) | Echtzeitwissen | Schnell | Cloud |
| OpenRouter | Zugriff auf mehrere Modelle | Variiert | Cloud |
| OpenAI-Compatible | Selbst gehostet, individuell | Variiert | Selbst gehostet / Cloud |
| Ollama | Privatsphäre, offline | Abhängig von der Hardware | Auf Ihrem Gerät |
Konkrete Modellnamen und Kontextfenstergrößen ändern sich häufig. Um genau zu sehen, welche Modelle jeder Provider bereitstellt — und wie Sie das Modell pro Command oder pro Unterhaltung überschreiben können — lesen Sie Modelle & Inferenz.
Nächstes Konzept: Entdecken Sie Dashboard & Navigation.