Conceito Central: Providers
Providers são os motores de IA subjacentes (Large Language Models) que processam seu texto e geram respostas. O Rephlo é uma interface universal — você pode trocar esses "cérebros" conforme a tarefa, e um único provider pode expor vários modelos (veja Models & Inference).
Tipos de Provider
O Rephlo suporta 8 tipos de provider Bring-Your-Own-Key (BYOK) além de uma Dedicated API gerenciada pelo Rephlo:
Providers de Nuvem (Requer Internet)
- OpenAI — modelos da classe GPT. Padrão da indústria para raciocínio, programação e criatividade.
- Anthropic — modelos Claude; conhecidos pela escrita de alta qualidade, janelas de contexto grandes e prompt caching (ativado por padrão).
- Groq — inferência ultrarrápida em chips LPU personalizados — respostas quase instantâneas.
- Google — modelos Gemini com fortes capacidades multimodais.
- xAI (Grok) — modelos Grok com Live Search opcional em tempo real.
- OpenRouter — um gateway unificado para mais de 100 modelos de vários fornecedores, com rastreamento via Site URL / Site Name.
- OpenAI-Compatible — conecte-se a qualquer serviço que implemente a especificação da API da OpenAI (Azure OpenAI, vLLM, LocalAI, LiteLLM, LM Studio, proxies personalizados). Requer API Key, Base URL e Model Name.
Provider Local (Privacidade Total)
- Ollama — execute modelos de código aberto (Llama, Mistral, Gemma, DeepSeek, Qwen) diretamente no seu computador. Seus dados nunca saem da sua máquina. Base URL configurável (padrão
http://localhost:11434); uma chave de API opcional do Ollama habilita a busca na web.
O Azure OpenAI é conectado através do tipo OpenAI-Compatible — escolha OpenAI-Compatible e insira o endpoint de deployment do seu Azure como Base URL (e o nome do seu deployment como Model Name). Ele não é uma entrada separada na lista de adicionar provider.
Modelos on-device: o Rephlo também executa modelos GGUF totalmente on-device (sem internet, sem Ollama) através de um mecanismo embutido. Esse é um caminho de inferência relacionado, mas separado — veja On-Device Models e Models & Inference.
Provider Gerenciado
- Dedicated API — a opção de nuvem gerenciada do Rephlo, usando OAuth 2.0. A configuração mais simples para usuários que não querem gerenciar chaves de API; o uso é rastreado com créditos. Sua configuração é criada automaticamente e fica oculta da lista de providers normal.
Quer um seletor exclusivo para BYOK/on-device? Ative Hide online models from Rephlo Gateway em Providers para ocultar os modelos Dedicated (Gateway) de todos os seletores de modelo.
On-Device vs. BYOK
Esses dois caminhos de "traga seu próprio modelo" são fáceis de confundir:
- On-Device — modelos abertos (GGUF) executados localmente na sua máquina através do mecanismo embutido. Sem chave de API, sem internet, totalmente privado; nada sai do seu computador.
- BYOK (Bring Your Own Key) — você fornece sua própria chave de API para um provider externo (um fornecedor de nuvem, ou o Ollama local). As requisições vão para esse provider usando sua chave, e o fornecedor cobra você diretamente.
Tanto On-Device quanto BYOK são recursos do tier Pro — usá-los requer um plano Pro ativo (ou superior) ou uma licença perpétua. Para modelos on-device, essa restrição cobre tanto o download quanto a execução; uma vez desbloqueados, eles rodam sem créditos e totalmente offline. Configure as chaves em Providers.
Dedicated API da Plataforma vs. Enterprise BYOK
- A Dedicated API é a inferência hospedada e gerenciada pelo Rephlo: faça login e use os modelos de ponta do Rephlo, cobrados em créditos, sem chaves para gerenciar.
- O Enterprise BYOK (via plataforma) é para organizações que configuram centralmente suas próprias chaves de provider e modelos permitidos em nível organizacional, de forma que todos os membros usem os modelos e chaves da organização — para conformidade e controle de custos.
Em resumo: a Dedicated API troca chaves por créditos e configuração zero, enquanto o Enterprise BYOK mantém o gerenciamento de chaves centralizado na organização. Chaves BYOK pessoais são configuradas em Providers.
Modo de Provider
Cada provider opera em um de dois modos: BYOK (você fornece a chave do fornecedor) ou Dedicated (gerenciado pelo Rephlo, com rastreamento de créditos).
Modos de Conexão
Modo Dedicated (Gerenciado)
- Descrição: o Rephlo gerencia a conexão e o faturamento via OAuth 2.0; o uso é debitado dos seus créditos.
- Prós: configuração zero, faturamento gerenciado.
- Contras: menos controle de baixo nível sobre os parâmetros do modelo.
Modo BYOK (Bring Your Own Key)
- Descrição: você usa diretamente sua própria chave de API do fornecedor.
- Prós: privacidade máxima (os dados vão da sua máquina diretamente para o fornecedor, sem passar pelos servidores do Rephlo), preços diretos do fornecedor e acesso imediato a novos modelos.
- Contras: requer uma conta no fornecedor.
O Que uma Configuração de Provider Armazena
Cada configuração de provider inclui:
- Uma substituição opcional de Display Name.
- Um Mode (BYOK / Dedicated) e o tipo de provider.
- Models — um ou mais modelos, com um marcado como padrão.
- Configuration — campos específicos do provider. Chaves de API e tokens são armazenados criptografados:
- OpenAI / OpenAI-Compatible: API Key, Base URL opcional (e, para OpenAI-Compatible, um Model Name). O Azure OpenAI usa esse tipo — aponte a Base URL para o endpoint de deployment do seu Azure.
- Anthropic: API Key, Base URL opcional, prompt caching habilitado por padrão.
- Google: API Key, Base URL opcional.
- Groq: API Key.
- Ollama: Base URL, chave de API opcional (para busca na web).
- xAI (Grok): API Key, alternador opcional de Live Search.
- OpenRouter: API Key, Site URL / Site Name opcionais.
- Capabilities — alternadores para Vision, Function Calling (tools), Long Context, Web Search, Thinking e mais; validados em relação às capacidades reais do modelo em tempo de execução.
- Model Parameters — configurações de requisição por provider/modelo (temperature, max tokens, top-p, etc.).
Apenas um provider está ativo por vez. Você também pode sobrepor o provider por command para um controle mais refinado.

Obtendo Chaves de API (BYOK)
Ao usar BYOK, você paga o fornecedor diretamente pelo uso da API.
| Provider | Onde Obter Chaves | Observações |
|---|---|---|
| Azure OpenAI | portal.azure.com | Requer uma assinatura Azure + um recurso OpenAI implantado |
| OpenAI | platform.openai.com | Modelos da classe GPT |
| Anthropic | console.anthropic.com | Modelos Claude; suporta prompt caching |
| Groq | console.groq.com | Tier gratuito disponível |
aistudio.google.com | Gemini Pro / Flash | |
| xAI | console.x.ai | Modelos Grok; Live Search opcional |
| OpenRouter | openrouter.ai | Uma chave, mais de 100 modelos |
| OpenAI-Compatible | Varia por serviço | vLLM, LocalAI, LiteLLM, LM Studio |
| Ollama | instalação local + ollama.com/settings/keys | Modelos locais; chave de API necessária apenas para busca na web |
Trocando de Provider
Você pode trocar de provider globalmente (padrão para todos os commands) ou por command. Por exemplo, use o Groq para correções ortográficas rápidas (rápido e barato) e mude para o Claude para análises complexas (inteligente e sutil).