Aller au contenu principal

Modes de données & Compaction

Lorsque vous attachez un Space (votre base de connaissances de documents) à une commande ou à un chat, tout ce texte alimente l'IA. Vous décidez comment il alimente l'IA avec un seul choix — le sélecteur Mode de données en haut de la vue des données d'un Space. Il existe deux options :

  • 🔍 Smart Search — contenu brut, récupéré à la demande. Gratuit (aucun credit).
  • 🗜️ Compact — contenu pré-résumé, toujours envoyé. Utilise des credits pour construire les résumés.

Cette page explique les deux modes, les garde-fous de credits autour de la compaction, et comment l'application maintient proactivement votre Space sur le mode le moins coûteux.

Un seul choix : le sélecteur de Mode de données

Chaque Space possède un seul Mode de données, défini par deux options mutuellement exclusives (pensez à des boutons radio, pas à des interrupteurs séparés). Une icône d'information se trouve à côté du sélecteur, et une ligne d'aide en direct en dessous explique ce que votre choix actuel fait pour la taille de ce Space.

Mode de donnéesCe qu'il envoieCreditsIdéal pour
🔍 Smart Search (par défaut)Votre contenu brut — le texte complet pour un petit Space, ou uniquement les parties les plus pertinentes une fois que le Space granditGratuitTous les Spaces, quelle que soit leur taille — le choix par défaut sûr
🗜️ CompactUniquement les passages récupérés les plus pertinents une fois que le Space grandit, ou l'ensemble complet des résumés IA pour un petit SpaceUtilise des credits pour construire les résumés (réutilisés ensuite)Les petits Spaces que vous interrogez largement et pour lesquels vous voulez limiter les tokens

🔍 Smart Search (par défaut, gratuit)

Smart Search envoie votre contenu brut, et s'adapte automatiquement à la taille du Space :

  • Petit Space — Rephlo envoie tout (une analyse complète), car la récupération n'en vaut pas la peine pour une poignée de documents.
  • Grand Space — Rephlo récupère uniquement les parties les plus pertinentes pour votre demande (Retrieval-Augmented Generation, ou RAG — voir RAG & Retrieval) plutôt que d'envoyer l'ensemble.

Dans les deux cas, Smart Search ne dépense jamais de credits, et la récupération s'exécute sur votre appareil — vos documents ne quittent jamais votre machine. La ligne d'aide sous le sélecteur vous indique quel comportement est actif en ce moment :

« Envoi de tout le contenu — ce Space est assez petit pour être analysé entièrement. » — ou — « Récupération des parties les plus pertinentes (le Space est volumineux). »

Où se trouve le seuil de taille

La limite entre « tout analyser » et « ne récupérer que les parties pertinentes » est configurable. Ouvrez Settings ▸ General ▸ RAG Retrieval Tuning, activez Advanced, et ajustez Minimum Space size (tokens) (par défaut 4 000). Augmentez-le pour continuer à tout analyser sur des Spaces plus grands ; réduisez-le pour commencer la récupération plus tôt. Consultez RAG Retrieval & Tuning pour l'ensemble des réglages.

astuce

Comme Smart Search ne récupère que ce qui est pertinent pour les grands Spaces, il est généralement moins coûteux que l'envoi d'un Space compacté entier — et il ne coûte aucun credit. C'est le bon choix par défaut pour presque tout le monde.

🗜️ Compact (utilise des credits)

Compact stocke un résumé généré par l'IA de chaque fichier et envoie ces résumés au lieu du texte complet, de sorte que chaque requête transporte moins de tokens. Construire ces résumés coûte des credits — mais une fois qu'un fichier est compacté, son résumé est réutilisé, vous ne payez donc que pour le construire (ou pour le reconstruire à la demande).

Compact bénéficie également de la récupération : une fois qu'un Space dépasse le seuil de récupération, une requête normale récupère uniquement les passages pertinents du contenu brut de votre Space (Retrieval-Augmented Generation, ou RAG — voir RAG & Retrieval) — tout comme Smart Search. L'ensemble complet des résumés IA n'est envoyé qu'en solution de repli — lorsque le Space est assez petit pour être envoyé en entier, ou lorsque rien ne correspond avec certitude à votre demande.

Vous construisez les résumés via des actions explicites dans la vue des données du Space :

  • Compact — résume un seul fichier.
  • Compact All — résume tous les fichiers non compactés du Space.
  • Regenerate — reconstruit le résumé existant d'un fichier.
La compaction n'est jamais silencieuse

Chaque action de compaction vous demande de confirmer d'abord le coût en credits. Rien n'est résumé — et aucun credit n'est dépensé — tant que vous n'avez pas confirmé.

Garde-fou de credits pour la compaction (grands Spaces)

Pour empêcher un simple clic de consommer une grande partie de vos credits, Rephlo verrouille la compaction pour les grands Spaces. Lorsque le contenu brut total d'un Space atteint environ 128 000 tokens, l'option Compact est désactivée (grisée) et toute action de compaction — Compact, Compact All et Regenerate — est bloquée. Une courte note vous oriente vers Smart Search, qui gère déjà les grands Spaces de manière efficace et gratuite.

Avertissement pour les fichiers volumineux uniques

Même en dessous du verrou, compacter un gros fichier unique peut coûter sensiblement. Si un seul fichier fait environ 50 000 tokens ou plus, Rephlo affiche une confirmation du coût en credits avant de le compacter, afin qu'un document volumineux ne soit jamais résumé par surprise.

Smart Mode Advisor

Lorsqu'un Space est en mode Compact, Rephlo surveille les situations où Smart Search vous servirait mieux — gratuitement — et propose de basculer. Il évalue la situation lorsque vous ouvrez un Space et après chaque modification de ses données, et suggérera de basculer lorsque le Space :

  • Devient volumineux (environ 128 000 tokens ou plus) — la compaction est de toute façon verrouillée, donc Smart Search est le choix efficace.
  • Vient de recevoir un gros fichier (environ 50 000 tokens ou plus) — le compacter coûterait de véritables credits.
  • Est minuscule (à ou en dessous de votre Minimum Space size) — Smart Search peut tout analyser gratuitement, il n'y a donc aucune raison de dépenser des credits.

Le conseiller ne propose jamais que de passer à Smart Search — il ne compacte jamais rien de sa propre initiative et ne change jamais votre mode silencieusement. Si vous refusez, votre Space reste en mode Compact, et le conseiller ne vous relancera pas pour la même situation.

Budget de tokens par Space

Chaque Space possède un budget de tokens — la taille combinée maximale de ses documents (par défaut 100 000 tokens, ajustable). Rephlo suit deux totaux en continu afin que vous puissiez voir l'effet de la compaction en un coup d'œil :

  • Nombre de tokens bruts — le total si chaque document est utilisé intégralement (c'est ce que le garde-fou de credits mesure par rapport à ~128 000).
  • Nombre de tokens compactés — le total une fois les versions résumées utilisées à la place.

Quand utiliser quoi

  • Presque toujours — Restez sur Smart Search. C'est gratuit, cela analyse intégralement les petits Spaces, et cela ne récupère que ce qui est pertinent pour les grands.
  • Grands SpacesSmart Search. La compaction est de toute façon verrouillée ici, et la récupération est à la fois moins coûteuse et gratuite.
  • Un petit Space que vous interrogez très largement (vous voulez que l'ensemble soit résumé en quelques tokens à chaque fois) — Compact peut aider, et vous confirmerez le coût en credits au préalable.

Vue des données du Space — le sélecteur Smart Search / Compact avec son infobulle et sa ligne d'aide en direct, les cartes d'utilisation de tokens Normal vs Compact, et la liste par fichier avec les actions de compaction La vue des données du Space montrant le sélecteur de Mode de données (Smart Search / Compact), les cartes d'utilisation de tokens, et les actions de compaction par fichier.

Pages associées