Modèles sur l'appareil et modèles cloud
Rephlo peut exécuter des modèles d'IA sur votre propre ordinateur ou envoyer votre requête à un modèle cloud. Les deux apparaissent dans le même sélecteur de modèles et répondent dans la même fenêtre de chat, ce qui laisse facilement croire qu'ils sont interchangeables.
Ils ne le sont pas. Cette page explique la différence en termes simples, pour que vous choisissiez le bon — et montre comment obtenir l'essentiel de la confidentialité du traitement local et la puissance d'un grand modèle cloud en même temps.
La réponse courte
Un modèle exécuté sur votre appareil est une IA bien plus petite qu'un modèle cloud. Il tourne sur votre ordinateur portable, il doit donc tenir dans sa mémoire. Un modèle cloud tourne dans un centre de données, sur du matériel qui coûte plus cher qu'une voiture.
Attendez-vous à ce qu'un modèle sur votre appareil soit réellement utile pour le travail quotidien sur le texte, et attendez-vous aussi à ce qu'il peine là où un modèle cloud ne peinerait pas. Ce n'est pas une version plus petite mais équivalente de la même chose : c'est un autre niveau de capacité.
Pourquoi l'écart est si important
Les modèles d'IA se mesurent en paramètres — très grossièrement, le nombre de valeurs internes ajustables que le modèle a apprises pendant son entraînement. Plus de paramètres signifie généralement plus de capacité, et aussi plus de mémoire.
Le catalogue de Rephlo pour l'appareil va d'environ 2 à 14 milliards de paramètres, car c'est ce qui tient confortablement sur un ordinateur personnel. Les grands modèles cloud sont des dizaines à des centaines de fois plus volumineux.
Cet écart se traduit par une différence de discernement : suivre une instruction longue et à plusieurs niveaux ; garder à l'esprit un document complexe tout en y répondant ; remarquer que votre question repose sur une prémisse fausse. Les modèles plus petits font bien l'évident et de façon peu fiable le subtil.
Côte à côte
| Modèle sur l'appareil | Modèle cloud | |
|---|---|---|
| Où va votre texte | Nulle part — il reste sur votre ordinateur | Chez le fournisseur qui sert le modèle |
| Fonctionne hors ligne | Oui | Non |
| Coût par message | Aucun | credits, ou votre propre facture fournisseur avec BYOK |
| Vitesse | Dépend de votre matériel | Constante, généralement plus rapide |
| Raisonnement sur les problèmes difficiles | Limité | Solide |
| Documents longs | Limité | Solide |
| Recherche web | Non | Disponible chez les fournisseurs qui la prennent en charge |
| Lecture d'images | Non | Disponible avec les modèles dotés de vision |
| Lecture des documents joints | Oui — PDF, fichiers texte et Office | Oui |
| Mise en route | Téléchargement unique de plusieurs Go | Aucune |
| Disponibilité | Pro, Enterprise ou licence perpétuelle | Toutes les formules |
Ce que les modèles sur l'appareil font bien
Sur ces tâches, l'écart se voit à peine :
- Reformuler et réécrire — changer de ton, raccourcir, rendre plus formel
- Corriger la grammaire et l'orthographe
- Résumer des textes courts à moyens
- Extraction simple — repérer des noms, des dates ou des éléments de liste dans un paragraphe
- Traduction rapide de textes courants
- Travailler hors ligne — en avion, dans un site sécurisé ou sans connexion
- Tout ce qui est assez confidentiel pour que vous préfériez que cela ne quitte pas la machine
Où ils atteignent leurs limites
Attendez-vous à des résultats plus faibles ici :
- Raisonnement complexe — logique en plusieurs étapes, mathématiques, analyse minutieuse
- Documents longs — la mémoire de travail d'un petit modèle se remplit vite
- Génération de code au-delà de courts extraits
- Instructions longues et imbriquées — un petit modèle a tendance à suivre les premières et à s'écarter du reste
- Nuance et exactitude factuelle — les modèles plus petits affirment plus volontiers quelque chose avec assurance et à tort
Deux limites strictes à connaître d'emblée
Pas de recherche web. Comme les modèles sur l'appareil fonctionnent entièrement hors ligne, ils ne peuvent rien consulter. Leurs connaissances s'arrêtent à leurs données d'entraînement. Un connecteur de recherche web est en développement ; pour des informations à jour aujourd'hui, utilisez un fournisseur cloud qui prend en charge la recherche.
Pas de vision. Les modèles sur l'appareil ne peuvent pas regarder d'images. Si vous en joignez une, Rephlo en lit le texte sur votre appareil et le transmet à la place — utile, mais pas équivalent à un modèle voyant réellement votre graphique. Voir Comment Rephlo lit vos fichiers.
Le meilleur des deux : masquer en local, puis utiliser un modèle cloud
C'est la configuration que nous recommanderions à la plupart des personnes traitant des sujets sensibles, et celle dont la plupart des utilisateurs ignorent l'existence.
Vous n'avez pas à choisir entre « puissant, mais mes données partent » et « confidentiel, mais limité ». Rephlo peut retirer les informations personnelles de votre requête sur votre propre ordinateur, et seulement ensuite l'envoyer à un grand modèle cloud. Le modèle cloud fait le travail difficile ; les informations personnelles, elles, ne font jamais le voyage.
Pour le configurer : Settings ▸ Privacy ▸ Remove personal info before cloud requests, puis choisissez les catégories à masquer.
Deux couches assurent la détection :
- La correspondance de motifs, intégrée et toujours disponible, capte ce qui a une forme prévisible : adresses e-mail, numéros de téléphone, numéros de sécurité sociale et données complètes de carte bancaire.
- Un modèle d'IA sur l'appareil, téléchargé à la demande (environ 1,16 Go), capte ce qui n'a pas de forme fixe : noms, dates de naissance, adresses et numéros d'identité comme le permis de conduire ou le passeport.
Tant que ce second modèle n'est pas téléchargé, les catégories qui en dépendent sont affichées comme indisponibles : vous n'êtes donc jamais induit en erreur sur ce qui est réellement retiré.
Restez réaliste sur ce que cela vous apporte. Le masquage réduit sensiblement l'exposition accidentelle, mais il s'agit d'une détection et non d'une garantie : il ne peut pas couvrir tous les cas. Si votre contenu est sensible au point qu'un oubli serait inacceptable, utilisez l'une des options plus fortes :
- Activez Block send if redaction is uncertain, et Rephlo retient la requête plutôt que de risquer d'envoyer quelque chose dont il n'est pas sûr.
- Activez Force Local for Sensitive, et les requêtes marquées comme sensibles sont traitées par un modèle sur l'appareil : elles n'atteignent alors aucun fournisseur cloud.
Voir Confidentialité et données pour chaque réglage en détail.
Alors, lequel utiliser ?
| Votre situation | Utilisez |
|---|---|
| Reformulation, ton et grammaire au quotidien | Le modèle sur l'appareil suffit largement |
| Pas de connexion internet | Sur l'appareil |
| Contenu qui ne doit jamais quitter la machine | Sur l'appareil, ou Force Local for Sensitive |
| Contenu sensible, mais vous avez besoin de vraies capacités | Masquer en local, puis un modèle cloud |
| Raisonnement difficile, code, documents longs | Cloud |
| Vous avez besoin d'informations à jour issues du web | Cloud, avec un fournisseur prenant en charge la recherche |
| Vous avez besoin que le modèle regarde une image | Cloud, avec un modèle doté de vision |
| Vous surveillez votre consommation de credits | Sur l'appareil, cela ne coûte aucun credits |
Rien ne vous engage. Changer de modèle se fait dans un menu déroulant : une habitude raisonnable consiste donc à rédiger avec un modèle sur l'appareil, puis à passer à un modèle cloud quand une réponse n'est pas assez bonne.
Questions fréquentes
Le modèle sur l'appareil est-il le même que celui que Rephlo utilise dans le cloud ? Non. Ce sont des modèles entièrement différents, issus de familles distinctes et de tailles très différentes.
Pourquoi mon modèle sur l'appareil est-il lent ? La vitesse dépend de votre matériel — mémoire et processeur. Utilisez Check my machine sur l'écran des modèles pour l'appareil afin de voir ce que votre ordinateur peut exécuter confortablement, et préférez un modèle plus petit si un plus grand est poussif.
Les modèles sur l'appareil consomment-ils des credits ? Non. Une fois téléchargés, ils s'exécutent sur votre matériel sans coût par message. La fonctionnalité nécessite une formule Pro, Enterprise ou perpétuelle.
Un modèle sur l'appareil rend-il automatiquement mes données confidentielles ? Votre contenu reste sur votre machine en mode local. C'est une propriété du traitement local, pas une certification de conformité : si votre activité est réglementée, écrivez-nous à [email protected].
Puis-je utiliser l'OCR avec un modèle sur l'appareil ? Oui. La lecture des documents numérisés s'exécute localement quel que soit le modèle choisi : un PDF numérisé fonctionne donc avec un modèle sur l'appareil comme avec un modèle cloud.
Pages associées
- Modèles sur l'appareil — le catalogue, les téléchargements et les réglages mémoire
- Modèles et inférence — comment Rephlo choisit entre cloud et appareil
- Confidentialité et données — masquage, routage et traitement local
- Comment Rephlo lit vos fichiers — pièces jointes, Spaces, documents numérisés et images