LLM Providers
La pestaña LLM Providers de Settings es donde conectas Rephlo con los modelos de IA que impulsan tus comandos y chats. Puedes usar tus propias cuentas en los principales proveedores de IA, ejecutar modelos en local para una privacidad total, o dejar que Rephlo se encargue de todo sin necesidad de ninguna clave.
Ábrela desde Settings → LLM Providers.

Dos formas de usar proveedores
| Modo | Cómo funciona | Ideal para |
|---|---|---|
| Login (Dedicated API) | Rephlo ejecuta la inferencia por ti. No hay claves de API que gestionar — el uso se descuenta de los credits de tu plan. | Cualquiera que quiera cero configuración. |
| BYOK (Bring Your Own Key) | Añades tu propia clave de API de un proveedor (OpenAI, Anthropic, etc.). Pagas directamente a ese proveedor y usas sus modelos más recientes. | Usuarios avanzados que ya tienen cuentas con proveedores. |
Puedes combinar ambos: mantén la sesión iniciada para el uso diario y añade un proveedor BYOK para un modelo concreto. Para saber cómo funcionan la facturación y los credits, consulta Credits y uso y Planes y precios.
Proveedores compatibles
Rephlo admite ocho tipos de proveedores BYOK — siete proveedores en la nube más Ollama en local (que se ejecuta en tu propio equipo en localhost:11434) — además de las opciones on-device y gestionadas:
| Proveedor | Qué debes aportar |
|---|---|
| OpenAI | Clave de API (endpoint personalizado opcional) |
| Anthropic | Clave de API (base URL opcional); admite prompt caching |
| Clave de API (base URL opcional) | |
| Groq | Clave de API |
| xAI (Grok) | Clave de API (Live Search opcional) |
| OpenRouter | Clave de API (URL/nombre del sitio opcional para el panel de OpenRouter) |
| OpenAI-Compatible | Base URL + clave de API + nombre del modelo (Azure OpenAI, vLLM, LocalAI, LiteLLM y similares) |
| Ollama | Base URL (por defecto http://localhost:11434); clave opcional para la búsqueda web |
| On-Device | Nada — los modelos se ejecutan en local. Consulta Modelos On-Device. |
| Dedicated API | Nada — Rephlo lo gestiona al iniciar sesión. |
Azure OpenAI se conecta a través del tipo OpenAI-Compatible — apunta la Base URL al endpoint de tu implementación en Azure — y no como una entrada independiente en la lista de proveedores para añadir.
Para una visión conceptual de cómo se relacionan los proveedores y los modelos, consulta Proveedores y Modelos e inferencia.
Añadir un proveedor
- Haz clic en Add Provider.
- Elige el tipo de proveedor. El formulario se adapta para mostrar solo los campos que necesita ese proveedor.
- Introduce tus credenciales (por ejemplo, una clave de API, o un endpoint de Azure + el nombre de la implementación).
- Opcionalmente, define un nombre personalizado para reconocer fácilmente el proveedor en las listas.
- Haz clic en Test Connection para confirmar que la clave funciona antes de guardar.
- Haz clic en Save.
Tus claves están cifradas
Las claves de API y los tokens se cifran antes de almacenarse en tu equipo. Nunca se escriben en los registros (logs) y se excluyen de las exportaciones de datos. Trata tus claves como contraseñas — Rephlo las mantiene locales y protegidas.
Modelos
Cada proveedor expone uno o más modelos (por ejemplo, un proveedor de OpenAI puede ofrecer varios modelos GPT). Puedes añadir varios modelos a un mismo proveedor y marcar uno como predeterminado. Cuando ejecutas un comando o un chat, Rephlo usa el modelo predeterminado del proveedor activo, a menos que el comando o la conversación especifiquen otro distinto.
En el selector de modelos, los modelos Dedicated (Gateway) bloqueados que tu plan no incluye muestran una insignia de nivel (por ejemplo, PRO o ENTERPRISE) y un icono de candado, para que veas de un vistazo qué modelos cubre tu plan. Al iniciar un chat totalmente nuevo, o al abrir Chat sin ningún modelo ya definido para esa conversación, se retoma el modelo que usaste por última vez a nivel global — una memoria distinta de la elección de modelo por conversación.
Para saber cómo funcionan las sustituciones de modelo por comando y por conversación —y esta memoria global de "usado por última vez"—, consulta Modelos e inferencia.
Ocultar modelos online de Rephlo Gateway
Las subpestañas On-Device y BYOK Providers incluyen ambas un interruptor Hide online models from Rephlo Gateway (información sobre herramienta: "When enabled, hides online models from Rephlo Gateway"). Al activarlo, se ocultan los modelos Dedicated (Gateway) de todas las superficies del selector de modelos — la barra de estado, el chat y la superposición.
Desde la v1.4.1, si tu modelo activo es un modelo Gateway cuando activas el interruptor, Rephlo te cambia automáticamente a un modelo on-device o BYOK accesible en lugar de dejarte silenciosamente con el modelo que acaba de ocultarse — o desactiva el modelo si no hay ninguno disponible.
Capacidades
Cada configuración de proveedor incluye un conjunto de indicadores de capacidad que le dicen a Rephlo qué puede hacer el modelo:
- Text generation — siempre activo.
- Vision — analiza imágenes (solo para modelos con capacidad de visión, como GPT-4o, Claude o Gemini).
- Function calling / tools — uso estructurado de herramientas, necesario para los connectors de MCP.
- Long context — gestiona entradas muy grandes (>100K tokens).
- Streaming — muestra las respuestas token a token (activo por defecto).
- Web search y Thinking — cuando el modelo los admite.
Las capacidades se validan frente a las habilidades reales del modelo en tiempo de ejecución, así que activar un indicador que el modelo no admite no rompe nada — Rephlo simplemente no intentará esa operación.
Parámetros del modelo
Puedes ajustar el comportamiento de generación por modelo:
- Temperature — los valores más bajos son más precisos y repetibles; los más altos son más creativos.
- Max tokens — limita la longitud de cada respuesta.
- Top-p / top-k — controles de muestreo adicionales para usuarios avanzados.
Un comando puede sobrescribir estos valores para sus propias ejecuciones, así puedes mantener un valor predeterminado tranquilo, con temperature baja, y dejar que un comando de brainstorming sea más atrevido.
Prompt caching de Anthropic
Los proveedores de Anthropic admiten prompt caching, que puede reducir considerablemente el coste del contexto repetido. Está activado por defecto con una caché «ephemeral» (unos 5 minutos). También hay disponible una opción «extended» (aproximadamente 1 hora). El caching solo se activa cuando una solicitud realmente incluye contexto cacheable — consulta Prompt Caching para conocer todos los detalles.
Ollama y modelos locales
Para Ollama, configura la base URL (por defecto http://localhost:11434). En equipos con recursos limitados, vigila la ventana de contexto para no quedarte sin memoria. Si prefieres que Rephlo descargue y gestione los modelos locales por ti, usa en su lugar el catálogo integrado de Modelos On-Device.
Editar, probar y eliminar
- Edit cualquier proveedor para actualizar su clave, añadir modelos o cambiar parámetros.
- Test Connection vuelve a validar un proveedor después de rotar la clave.
- Remove un proveedor que ya no uses. Eliminar un proveedor no borra tus comandos — pasan a usar tu proveedor activo.
Ajustes comunes
Todos los proveedores también comparten estas opciones:
- Request timeout (60 segundos por defecto)
- Max retries para fallos transitorios (3 por defecto)
- Streaming activado/desactivado