Gerenciando provedores
O Rephlo se conecta a vários provedores de IA ao mesmo tempo. Você pode usar um plano Rephlo hospedado para o trabalho do dia a dia, sua própria conta OpenAI para tarefas gerais, uma conta Anthropic para documentos longos e um modelo Ollama local para dados privados — tudo configurado lado a lado.
Duas formas de acessar a IA
1. Rephlo Gateway (recomendado para novos usuários)
O Rephlo Gateway (a Dedicated API) é a forma mais fácil de começar. Em vez de gerenciar suas próprias chaves de API, você acessa os modelos de IA por meio da sua assinatura da conta Rephlo.
Benefícios:
- Sem gerenciamento de chaves de API — basta fazer login com sua conta Rephlo.
- Cobrança unificada — uma única assinatura cobre vários modelos de IA, contabilizados em credits.
- Modelos pré-configurados — modelos populares disponíveis sem necessidade de configuração.
- Atualizações automáticas — novos modelos são adicionados para você.
Para usar o Gateway:
- Abra a área Account e faça Sign in com sua conta Rephlo.
- Depois de fazer login, o provedor Gateway é configurado automaticamente para você e seus modelos ficam disponíveis.
O provedor Gateway é gerenciado por meio da sua conta — você não o adiciona nem o remove manualmente da lista de provedores. Veja Account e Billing & Subscription.
Prefere usar apenas BYOK ou modelos on-device? Ative Hide online models from Rephlo Gateway em Settings > LLM Providers — a opção está disponível tanto na subaba On-Device quanto na BYOK Providers. Isso oculta os modelos do Gateway (Dedicated API) em todos os seletores de modelo: a barra de status, o chat e o overlay. Se um modelo do Gateway for o seu modelo ativo quando você ativar essa opção, o Rephlo muda você automaticamente para um modelo on-device ou BYOK acessível, em vez de deixar você silenciosamente no modelo que agora está oculto.
2. BYOK (traga sua própria chave)
Para quem prefere ter controle direto ou já possui assinaturas com os provedores, o Rephlo se conecta diretamente aos provedores de IA usando suas próprias chaves de API.
Benefícios:
- Relação direta com o provedor — você paga diretamente ao provedor.
- Controle total — acesso a todos os modelos e recursos que o provedor oferece.
- Endpoints personalizados — conecte-se a implantações privadas, corporativas ou auto-hospedadas.
Provedores compatíveis (BYOK)
Ao adicionar um provedor, você escolhe um destes tipos:
| Provedor | Visão | Notas |
|---|---|---|
| OpenAI | Sim | Modelos da família GPT; endpoint personalizado opcional |
| Anthropic | Sim | Modelos Claude; compatível com prompt caching |
| Google AI | Sim | Modelos Gemini |
| Grok (xAI) | Sim | Modelos Grok; Live Search (web) opcional |
| Groq | Varia | Inferência rápida para modelos abertos |
| OpenRouter | Varia | Gateway para muitos modelos de vários fornecedores |
| Ollama | Varia | Modelos locais/off-line; chave opcional para busca na web |
| OpenAI-Compatible | Varia | Qualquer serviço compatível com a especificação da OpenAI — Azure OpenAI, vLLM, LocalAI, LiteLLM, proxies personalizados |
O Azure OpenAI é conectado por meio do tipo OpenAI-Compatible (apontando para o seu endpoint do Azure), e não como uma entrada separada na lista de adicionar provedor. O Ollama é abordado em detalhes na página dedicada Modelos on-device.
Adicionando um provedor
- Vá em Settings > Providers.
- Clique em Add Provider.
- Select Type — escolha o provedor no menu suspenso.
- Enter details (os campos mudam de acordo com o tipo escolhido):
- Name — um apelido amigável (por exemplo, "My GPT", "Work Claude").
- API Key — sua chave secreta obtida no painel do provedor.
- Base URL — para OpenAI-Compatible e Ollama, a URL do endpoint.
- Model Name — o modelo a ser usado (obrigatório para OpenAI-Compatible e vários outros).
- Test Connection — valide a configuração antes de salvar (veja abaixo).
- Save.
Campos específicos de cada provedor
Cada tipo de provedor solicita o que precisa:
| Provedor | Obrigatório | Opcional |
|---|---|---|
| OpenAI | API Key | Base URL personalizada |
| Anthropic | API Key | Base URL; configurações de prompt caching |
| Google AI | API Key | Base URL |
| Grok (xAI) | API Key | Opção de Live Search |
| Groq | API Key | — |
| OpenRouter | API Key | Site URL, Site Name (para o painel de atividade do OpenRouter) |
| Ollama | Base URL (padrão http://localhost:11434) | Chave de API (apenas para busca na web) |
| OpenAI-Compatible | API Key, Base URL, Model Name | — |
Prompt caching da Anthropic
Ao adicionar um provedor Anthropic, você verá as opções de prompt caching:
- Enable Prompt Caching — ativado por padrão. O caching pode reduzir bastante o custo de contexto repetido.
- Cache TTL —
ephemeral(cerca de 5 minutos) ouextended(cerca de 1 hora). Um TTL mais longo tem um custo de escrita mais alto, mas mantém o contexto em cache por mais tempo. - Cache Logging — registro detalhado opcional do desempenho do cache.
O caching só entra em ação quando uma solicitação realmente carrega contexto reutilizável (por exemplo, quando um Space está anexado a um chat). Veja Prompt Caching para o panorama completo.
Testando a conexão
O botão Test Connection valida suas configurações antes de você salvar:
Um resultado verde significa que as credenciais e o endpoint funcionam; um resultado vermelho mostra o que deu errado para que você possa corrigir.
Parâmetros do modelo
Depois que um modelo é configurado, você pode ajustar como ele gera texto:
- Temperature — mais baixa para saídas precisas/determinísticas, mais alta para saídas criativas/variadas.
- Max tokens — limita o tamanho da resposta.
- Top-p / sampling — controle refinado sobre a aleatoriedade (quando o modelo oferece suporte).
O Rephlo aplica intervalos de parâmetros adequados a cada modelo, então você não consegue definir valores que um modelo não aceite.
Vários modelos por provedor
Um único provedor pode conter vários modelos. No painel Add/Edit Provider você pode:
- Add Model — registrar outro modelo no mesmo provedor, cada um com seus próprios parâmetros.
- Set Active Model — marcar qual modelo esse provedor usa por padrão.
- Edit / Remove modelos individuais.
Isso permite que uma única conexão Anthropic ou OpenRouter cubra, por exemplo, um modelo rápido para o trabalho do dia a dia e um modelo mais potente para problemas difíceis — sem precisar configurar o provedor duas vezes.
Capacidades do provedor
Ao adicionar ou editar um provedor, você pode sinalizar quais capacidades ele oferece suporte. Isso determina o que fica disponível no Chat e nos commands:
- Vision — habilita o Visual Intelligence: capturar e analisar screenshots, fotos, diagramas e mensagens de erro.
- Function Calling — chamar ferramentas externas (necessário para os MCP Connectors).
- Long Context — lidar com entradas grandes.
- Code Generation — otimizado para tarefas de programação.
- Streaming — as respostas aparecem progressivamente em tempo real.
Por exemplo, você precisa de um provedor com capacidade Vision para usar os recursos de Visual Intelligence (screenshots, diagramas, mensagens de erro), e de um modelo com capacidade Function Calling para usar connectors no chat.
Configurando o provedor ativo
Você pode designar um provedor ativo usado por padrão em todos os commands.
- O provedor ativo executa todo command, a menos que um command o substitua.
- Para alterá-lo, clique em Activate ao lado do provedor preferido na lista.
- O provedor ativo fica destacado na interface.
- Apenas um provedor fica ativo por vez.
Obtendo chaves de API (BYOK)
Com BYOK, você paga diretamente ao provedor pelo uso. Obtenha as chaves no console de cada provedor:
- OpenAI —
platform.openai.com - Anthropic —
console.anthropic.com - Google AI —
aistudio.google.com - Grok (xAI) —
console.x.ai - Groq —
console.groq.com - OpenRouter —
openrouter.ai - Ollama (chave de busca na web) —
ollama.com/settings/keys
Configurando modelos locais (Ollama)
Para executar modelos totalmente off-line:
- Instale o Ollama.
- Baixe um modelo no seu terminal, por exemplo
ollama pull llama3. - No Rephlo, adicione um provedor Ollama.
- Base URL —
http://localhost:11434(padrão). - Model — digite o nome exatamente como aparece no Ollama (por exemplo,
llama3:latest). - (Opcional) adicione uma chave de busca na web do Ollama para habilitar a busca na web.
Para modelos GGUF on-device e verificações de hardware, veja Modelos on-device.
Recursos da interface de provedores
A página Providers ajuda você a gerenciar muitas conexões:
- Search — encontre provedores pelo nome.
- View toggle — alterne entre visualização em cards e em lista.
- Status indicators — veja rapidamente quais provedores estão configurados, ativos ou com erro.
Solução de problemas com provedores
- 401 Unauthorized — a chave de API provavelmente está incorreta. Copie-a novamente do provedor e teste de novo.
- 429 Too Many Requests — você atingiu o limite de requisições do provedor ou ficou sem credits.
- Connection Refused (Ollama) — verifique se o serviço em segundo plano do Ollama está em execução.
- Model Not Found — verifique se o ID do modelo está escrito corretamente e disponível na sua conta.
- Test fails after import on a new computer — chaves criptografadas não podem ser transferidas entre máquinas; insira a chave novamente. Veja Import & Export.
Relacionado: Modelos on-device · Prompt Caching · Configurações de provedores
Próximo recurso: Aprenda as diferentes formas de executar Commands.