Configuración avanzada
Para usuarios avanzados, Rephlo expone un control más fino sobre el rendimiento, el comportamiento de la IA y el almacenamiento en caché de prompts. A diferencia de lo básico, esta configuración está repartida en varios lugares: algunas opciones son por Space, otras por proveedor o por comando, y otras son de toda la aplicación. Esta página indica dónde vive cada una y qué hace.

Presupuestos de tokens
El Default Space Token Budget se encuentra en Settings → General → Performance. Define el límite inicial de tokens para cada Space nuevo: cuánto contenido de documentos puede contener el Space antes de que entren en juego los modos de datos y la compactación.
- Rango del control deslizante: de 5.000 a 1.000.000 tokens (el campo numérico permite bajar hasta 1.000).
- Valor predeterminado: 100.000 tokens.
- Se aplica solo a los Spaces nuevos. Después, cada Space puede reajustarse individualmente, y cambiar este valor predeterminado nunca reescribe los Spaces existentes.
Un ajuste independiente, el tamaño de la ventana de exploración del chat, en la misma sección, controla cuántas conversaciones recientes se cargan a la vez en la barra lateral del chat (10–5.000; los chats más antiguos siguen siendo accesibles mediante la búsqueda). Es un ajuste de rendimiento, no un límite de datos.
Estrategia de compactación
La Compactación mantiene un Space liviano en tokens resumiendo sus documentos. Se aplica cuando un Space está configurado en el modo de datos 🗜️ Compact (se elige con el selector de modo de datos por Space; no existe un interruptor global independiente):
- Al cambiar un Space a Compact, Rephlo te ofrece resumir sus archivos actuales, y los archivos que agregues después se pueden compactar desde la vista del Space. Generar los resúmenes consume credits, así que Rephlo siempre te pide confirmar antes el costo en credits: la compactación nunca es silenciosa.
- Protección de credits: en un Space grande (total en bruto ≈ 128.000 tokens o más), el modo Compact se desactiva y la compactación se bloquea, dirigiéndote hacia Smart Search, que es gratis. Compactar un solo archivo grande (≈ 50.000 tokens o más) exige una confirmación adicional.
- Al compactar, Rephlo te pide elegir una estrategia y qué modelo debe encargarse del resumen. La elección del modelo se recuerda durante el resto de la sesión.
Las tres estrategias equilibran fidelidad frente a ahorro de tokens:
| Estrategia | Qué hace | Ideal para |
|---|---|---|
| Conservative | Conserva la mayor cantidad de detalle; la menor reducción de tokens. | Cuando la precisión importa más que ahorrar tokens. |
| Balanced | Resume los documentos más antiguos: el punto intermedio recomendado (predeterminado). | La mayoría de los proyectos. |
| Aggressive | Conserva solo los puntos clave más recientes; máximo ahorro, mayor pérdida de detalle. | Encajar material muy extenso en una ventana de contexto pequeña. |
Sea cual sea el modo que use un Space, Rephlo hace un seguimiento tanto del total de tokens en bruto como del total de tokens compactos por Space, para que puedas ver el efecto de la compactación. Para tener el panorama completo de Smart Search frente a los datos en modo Compact, y cómo la compactación interactúa con la recuperación en el dispositivo (RAG), consulta Modos de datos y compactación.
Ajuste de proveedor y modelo
La temperatura, la longitud máxima de respuesta y la ventana de contexto son ajustes por proveedor y por modelo (con anulaciones opcionales por comando); no son un único control global. Configúralos en la pestaña LLM Providers; consulta Proveedores y Gestión de proveedores.
Temperatura
Controla qué tan deterministas o creativas son las respuestas. El valor predeterminado es 0,7 (equilibrado).
- 0,0 – 0,3 — precisas y repetibles. Ideal para código y datos objetivos.
- ~0,7 — equilibrada. Ideal para escritura general.
- 1,0+ — más creativa y variada. Ideal para lluvia de ideas.
Tokens máximos de respuesta
Limita la longitud de la respuesta de la IA para que no escriba un ensayo cuando solo querías una frase. Un valor de alrededor de 2.000 tokens es un valor predeterminado típico.
Límite de la ventana de contexto
Para los modelos de proveedores BYOK/en la nube y de tipo Ollama, este límite corresponde al campo Context Length del cuadro de diálogo Add/Edit Model. Limita cuánto texto se envía al modelo. Déjalo en Auto para usar el valor predeterminado del proveedor, o establece un límite manual para controlar el costo en las API de pago.
Los modelos en el dispositivo no usan este campo: el catálogo curado on-device lo ignora. En su lugar, su ventana de contexto es un ajuste dedicado llamado Context Window (Settings → LLM Providers → On-Device, en la tarjeta Model Memory): un rango de 2.048–262.144 tokens, con un valor predeterminado de ~32.768. Aumentarlo consume más RAM/VRAM y recarga el modelo activo.
Anulaciones por comando
Cada comando puede anular el proveedor, el modelo, la temperatura y los tokens máximos globales. La configuración propia de un comando tiene prioridad sobre los valores predeterminados globales del proveedor cuando se ejecuta. Consulta Flujos de ejecución.
Almacenamiento en caché de prompts
Rephlo puede reutilizar un prefijo en caché de tu prompt para reducir el costo y la latencia en los proveedores compatibles. La configuración de la caché se encuentra junto con la configuración del proveedor:
- Enable prompt caching — activa la caché para las solicitudes compatibles (activado de forma predeterminada).
- Cache TTL — cuánto tiempo vive una entrada de la caché:
- Ephemeral — unos 5 minutos.
- Extended — aproximadamente 1 hora.
- Cache logging — registra información detallada sobre el rendimiento de la caché.
Las lecturas de caché tienen un descuento importante, y la vista de detalle de Historial muestra los tokens de creación y de lectura de caché por solicitud, para que puedas ver el ahorro. La caché solo se activa cuando la solicitud tiene un prefijo cacheable (por ejemplo, un chat con un Space adjunto). Para conocer el comportamiento completo, consulta Almacenamiento en caché de prompts.
Herramientas para desarrolladores
Son ayudas para la resolución de problemas, no ajustes de uso diario:
- Debug Mode — activa un registro detallado en el archivo de log de la aplicación. Útil para diagnosticar problemas de conexión con el proveedor.
- Prompt Inspection — muestra el payload JSON exacto que se envía al proveedor, visible en los detalles del Historial.
El cambio de entorno (Environment switching: Production / Staging / Local API endpoints) solo está disponible en compilaciones de depuración y no forma parte de la experiencia habitual del usuario.
Relacionado: Modos de datos y compactación · Proveedores · Almacenamiento en caché de prompts · Historial y auditoría