Les assistants d’IA sont devenus des outils de travail quotidiens : rédiger un courriel, résumer un contrat, analyser un tableau, préparer une présentation. Le réflexe est naturel : copier-coller le document dans la conversation. C’est aussi là que commencent les risques. Un nom de client, un IBAN, un identifiant de connexion ou une clause confidentielle collés dans un assistant quittent l’entreprise. Bonne nouvelle : il est possible de profiter de ces outils sans exposer vos données, à condition de combiner les bonnes offres, les bons réglages, des règles claires et, quand c’est utile, un outil d’anonymisation.
Ce qui arrive à vos données quand vous écrivez à une IA
Quand vous envoyez une requête à un assistant d’IA, son contenu est transmis aux serveurs du fournisseur pour être traité par le modèle. Selon l’offre et les réglages, il peut ensuite être :
- conservé dans l’historique des conversations, pendant une durée variable ;
- examiné dans certains cas (détection d’abus, par exemple), selon les conditions du fournisseur ;
- utilisé pour entraîner de futurs modèles, notamment sur certaines offres grand public selon les réglages choisis par l’utilisateur.
Le risque n’est pas théorique : une information transmise ne peut plus être « rappelée ». Et dans beaucoup d’entreprises, les salariés utilisent des comptes personnels gratuits, en dehors de tout cadre.
Première règle : des offres professionnelles
Les grands fournisseurs distinguent nettement leurs offres grand public et leurs offres professionnelles (abonnements entreprise et accès par API). Les secondes s’accompagnent en général d’engagements contractuels : pas d’entraînement des modèles sur vos données par défaut, accord de traitement des données conforme au RGPD, durées de conservation définies, administration centralisée des comptes.
Par exemple, les conditions commerciales d’Anthropic stipulent que l’entreprise ne peut pas entraîner ses modèles sur le contenu de ses clients professionnels. Les autres grands fournisseurs prennent des engagements comparables sur leurs offres entreprise. Dans tous les cas, lisez le contrat, pas seulement la page de présentation, et vérifiez où les données sont traitées.
Fournir aux équipes un outil professionnel encadré est aussi le meilleur moyen d’éviter l’usage de comptes personnels.
Deuxième règle : des réglages vérifiés
Même sur une offre professionnelle, quelques réglages méritent d’être vérifiés par l’administrateur :
- la durée de conservation des conversations et la possibilité de les supprimer ;
- les connecteurs autorisés (accès à la messagerie, aux fichiers, aux agendas) : n’activez que ceux qui sont utiles ;
- le partage de conversations et de projets entre utilisateurs ;
- l’authentification des comptes (double facteur, connexion via l’annuaire de l’entreprise).
Troisième règle : ne pas envoyer ce qui n’est pas nécessaire
La donnée la mieux protégée est celle qui n’est jamais envoyée. Avant de coller un document, posez-vous une question simple : l’IA a-t-elle besoin de ce nom, de ce numéro, de ce montant pour accomplir la tâche ? Très souvent, la réponse est non.
| Type d’information | Exemple | Bonne pratique |
|---|---|---|
| Identité | Nom, adresse, téléphone d’un client | Remplacer par « Client A » |
| Données bancaires | IBAN, numéro de carte | Ne jamais envoyer |
| Secrets techniques | Mots de passe, clés d’API, jetons | Ne jamais envoyer |
| Données de santé ou RH | Arrêt maladie, évaluation | Éviter, ou anonymiser strictement |
| Informations stratégiques | Prix d’achat, projet de rachat | Réserver aux outils validés |
Le problème de cette règle : elle repose sur la vigilance de chacun, à chaque requête. Dans la pratique, elle est vite oubliée.
Quatrième règle : automatiser l’anonymisation
C’est pourquoi des outils automatisent cette étape. Le principe : intercepter la requête sur le poste, détecter les données sensibles, les remplacer par des leurres avant l’envoi, puis rétablir les vraies valeurs dans la réponse affichée. L’IA travaille sur des données fictives ; l’utilisateur lit une réponse exacte.
C’est le fonctionnement de notre logiciel AIGuard :
- il intercepte les requêtes envoyées à ChatGPT, Claude, Gemini, Copilot, Le Chat de Mistral ou Perplexity, dans le navigateur comme dans les applications ;
- il remplace adresses e-mail, IBAN, numéros, identifiants et secrets par des jetons réversibles ou des noms fictifs ;
- il bloque l’envoi d’un fichier contenant des données sensibles, avec un déblocage temporaire en un clic pour les faux positifs ;
- il journalise chaque échange (qui, quand, quel service, quels types de données protégées) pour vos obligations RGPD, sans stocker le contenu sensible.
Pour aller plus loin : une IA qui travaille chez vous
Au-delà des conversations, de plus en plus d’entreprises veulent confier à l’IA des traitements entiers : rapprochements bancaires, dossiers clients, documents à classer. Ces usages posent une question supplémentaire : faut-il téléverser tous ses documents chez un fournisseur pour que l’IA puisse les exploiter ?
Pas nécessairement. Notre logiciel AIKeep s’exécute sur les postes de l’entreprise : il ouvre les fichiers là où ils se trouvent, garde ses historiques et sa mémoire chiffrés sur le poste, et ne transmet au modèle que l’extrait nécessaire à l’instruction en cours, débarrassé de ses données sensibles par AIGuard. Le stockage ne sort pas ; seul l’extrait utile transite.
Et les secrets techniques ?
Les équipes techniques sont particulièrement exposées : un développeur qui colle un fichier de configuration ou un extrait de journal pour obtenir de l’aide peut transmettre sans s’en rendre compte une clé d’API, un mot de passe de base de données ou un jeton d’accès. Ces secrets doivent être détectés et masqués avec la même rigueur que les données personnelles, et toute clé exposée par erreur doit être révoquée sans attendre.
La charte d’usage en dix lignes
Une règle écrite, courte et connue de tous vaut mieux qu’une longue politique que personne ne lit :
- Utiliser uniquement les outils d’IA fournis par l’entreprise.
- Ne jamais saisir de mot de passe, clé ou identifiant.
- Ne jamais saisir de données bancaires.
- Anonymiser les noms et coordonnées des clients et des salariés.
- Ne pas joindre de document confidentiel à un outil non validé.
- Vérifier systématiquement les réponses avant de les utiliser.
- Ne pas prendre de décision concernant une personne sur la seule base d’une IA.
- Signaler les contenus générés par l’IA quand ils sont publiés.
- Signaler tout incident (donnée envoyée par erreur) sans délai.
- Suivre la formation à l’usage de l’IA proposée par l’entreprise.
Cette charte contribue aussi à l’obligation de maîtrise de l’IA prévue par l’AI Act, détaillée dans notre article sur l’IA, le RGPD et l’AI Act.
Questions fréquentes
Les offres gratuites des assistants d’IA sont-elles à proscrire ?
Pour des données professionnelles, oui dans la plupart des cas : elles n’offrent pas les engagements contractuels d’une offre entreprise, et l’utilisation des conversations pour l’entraînement dépend des réglages de chaque utilisateur.
L’anonymisation dégrade-t-elle la qualité des réponses ?
Rarement. Pour rédiger un courrier ou résumer un contrat, l’IA n’a pas besoin du vrai nom du client : un nom fictif cohérent suffit, et la vraie valeur est rétablie à l’affichage.
Copilot dans Microsoft 365 pose-t-il les mêmes questions ?
Oui, avec une particularité : il accède aux documents et courriels auxquels l’utilisateur a accès. Des droits de partage bien rangés sont donc un prérequis avant son déploiement.
Comment savoir quels outils d’IA mes équipes utilisent déjà ?
En posant la question, simplement, et en observant les usages. Un inventaire sans jugement permet souvent de découvrir des besoins réels, à couvrir ensuite avec un outil encadré.
Step By Step, studio de développement et d’IA basé à Ajaccio, édite AIGuard et AIKeep et accompagne les entreprises dans un usage maîtrisé de l’IA. Parlons de vos usages.