Vos données professionnelles dans l'IA : ce que les éditeurs en font

Sur cette page
- L'essentiel
- Vos conversations servent-elles à entraîner les modèles ?
- Quelle brèche les deux éditeurs laissent-ils ouverte ?
- Combien de temps vos données sont-elles conservées ?
- Que devient le contenu de vos fichiers connectés ?
- Que dit le régulateur français en 2026 ?
- Que faire, et que change une implantation hors de l'Union européenne ?
- Par quoi commencer cette semaine ?
- À lire également
- FAQ
Sur sa page d'aide consacrée à l'usage des données, relevée le 19 août 2026, OpenAI écrit que lorsqu'un utilisateur recourt à ses services destinés aux particuliers, l'éditeur peut utiliser son contenu pour entraîner ses modèles, et qu'il faut agir pour s'y opposer. Sur la sienne, mise à jour le 16 mars 2026, Anthropic écrit qu'il utilisera les conversations pour améliorer ses modèles si l'utilisateur choisit de l'y autoriser. Le même usage, sur deux produits comparables, obéit donc à deux régimes opposés, l'un par défaut et l'autre sur autorisation.
Cette différence est réelle et vaut d'être connue, mais elle n'est pas là que se joue le risque d'une entreprise, et c'est le déplacement qu'il faut opérer. Sur les formules professionnelles, les deux éditeurs prennent le même engagement, en des termes presque identiques : les données ne servent pas à entraîner les modèles par défaut. Et les deux laissent ouverte exactement la même porte, au même endroit, avec les mêmes conséquences : le bouton de retour d'expérience, celui qui affiche un pouce levé et un pouce baissé au bas de chaque réponse.
Cet article détaille ce que chaque régime prévoit réellement offre par offre, la brèche commune aux deux éditeurs et comment la refermer, les durées de conservation effectives, ce qu'il advient du contenu de vos fichiers connectés, ce que le régulateur français a publié en 2026 sur ces sujets, et la politique interne minimale à écrire.
L'essentiel
Sur les formules professionnelles des deux principaux éditeurs, les données ne servent pas à entraîner les modèles par défaut, et cet engagement est écrit sur leurs pages officielles. Il comporte une exception commune, rarement lue : dès qu'un collaborateur clique sur le pouce levé ou le pouce baissé, la conversation entière part chez l'éditeur et peut servir à l'entraînement, y compris chez celui dont l'entraînement est désactivé. Chez Anthropic, un administrateur peut désactiver ce bouton pour toute l'organisation, et c'est probablement le réglage le plus rentable de tout le dispositif. Le second point de vigilance est le compte personnel gratuit utilisé pour du travail professionnel, qui relève d'un régime entièrement différent de celui que l'employeur a signé. Le troisième est la mémoire persistante et les connecteurs, que la CNIL a identifiés le 20 juillet 2026 comme le changement d'échelle du sujet.
Vos conversations servent-elles à entraîner les modèles ?
Cela dépend entièrement de la formule, et l'écart entre le grand public et le professionnel est plus grand que l'écart entre les éditeurs.
Chez Anthropic, la page consacrée aux produits grand public, mise à jour le 16 mars 2026, énumère trois cas dans lesquels les conversations et les sessions de code sont utilisées pour améliorer les modèles : lorsque l'utilisateur choisit de l'autoriser, lorsque la conversation est signalée pour examen de sécurité, ou lorsqu'il opte explicitement pour un programme de test. La page consacrée aux produits commerciaux est plus catégorique encore.
Par défaut, nous n'utiliserons pas vos entrées ou vos sorties provenant de nos produits commerciaux (par exemple Claude for Work, l'API Anthropic, Claude Gov) pour entraîner nos modèles.
Chez OpenAI, la page consacrée à la confidentialité en entreprise, mise à jour le 8 janvier 2026, couvre ChatGPT Business, Enterprise, Healthcare, Edu, for Teachers et la plateforme d'interface de programmation, et pose trois engagements : l'entreprise possède et contrôle ses données, l'éditeur n'entraîne pas ses modèles sur ces données par défaut, et l'entreprise possède ses entrées et ses sorties dans la limite de ce que la loi permet. La même page réserve en revanche le contrôle de la durée de rétention à ChatGPT Enterprise, Healthcare et Edu, sans mentionner ChatGPT Business.
| Formules grand public | Formules professionnelles | |
|---|---|---|
| Anthropic | entraînement seulement si l'utilisateur l'autorise | pas d'entraînement par défaut |
| OpenAI | entraînement par défaut, désactivation possible | pas d'entraînement par défaut |
| L'exception commune | le retour d'expérience par pouce levé ou baissé | le retour d'expérience par pouce levé ou baissé |
| Le contrôle de la rétention | suppression de la conversation | Enterprise, Healthcare et Edu chez OpenAI ; à vérifier ailleurs |
Sources : pages officielles des deux éditeurs, relevées le 19 août 2026.
La ligne la plus lourde de conséquences n'est pas dans ce tableau, elle en découle. Un collaborateur qui utilise son compte personnel gratuit pour rédiger une proposition commerciale ne bénéficie d'aucun des engagements souscrits par son employeur : il relève de la colonne de gauche, et chez l'un des deux éditeurs cela signifie que le contenu sert à l'entraînement sauf action de sa part. C'est le premier risque réel d'une organisation, très loin devant le choix de l'éditeur, et il se traite par une politique interne, pas par un contrat.
Quelle brèche les deux éditeurs laissent-ils ouverte ?
Le bouton de retour d'expérience, et les deux le documentent dans les mêmes termes sans que personne ne le relève.
Chez Anthropic, la page relative aux produits commerciaux précise que lorsqu'un utilisateur donne son avis via le bouton pouce levé ou pouce baissé, l'éditeur stocke la conversation entière, y compris son contenu, les styles personnalisés, les préférences de conversation et les réglages de modèle, dans son infrastructure sécurisée, pour une durée pouvant aller jusqu'à cinq ans. Il indique délier ces données des identifiants d'utilisateur et de client avant usage, et pouvoir s'en servir pour entraîner ses modèles dans les limites permises par la loi.
Chez OpenAI, la formulation est encore plus explicite sur le point qui compte : même après avoir désactivé l'entraînement, un utilisateur qui choisit de donner un retour d'expérience accepte que la conversation entière associée à ce retour puisse être utilisée pour entraîner les modèles. Le réglage d'opposition ne couvre donc pas ce geste.
La même vérification doit être menée chez les autres éditeurs, sur leurs propres pages, avec trois questions identiques : le retour d'expérience échappe-t-il au réglage d'opposition, la conversation entière part-elle avec lui, et un administrateur peut-il le désactiver. Nous n'avons vérifié ce point que chez Anthropic et OpenAI, et nous ne l'étendons pas aux autres sans l'avoir lu.
Combien de temps vos données sont-elles conservées ?
Plus longtemps que la conversation, et selon des durées qui varient d'un facteur quatorze selon ce qui est arrivé à cette conversation.
La page d'Anthropic consacrée à la conservation, mise à jour le 1er juillet 2026, donne les repères les plus précis publiés par un éditeur. Une conversation supprimée disparaît immédiatement de l'historique et des systèmes de stockage dans les trente jours. Si l'utilisateur a autorisé l'usage de ses données pour améliorer le modèle, celles-ci peuvent être conservées sous une forme dépersonnalisée pendant cinq ans dans les chaînes d'entraînement, et cette rétention ne vaut que pour les conversations nouvelles ou reprises après activation du réglage.
Trois précisions de cette page méritent d'être connues avant de croire qu'une désactivation suffit. Désactiver le réglage empêche l'usage des conversations passées comme futures pour les entraînements à venir, et supprimer une conversation l'exclut également. En revanche, les données restent présentes dans les entraînements déjà en cours et dans les modèles déjà entraînés : la désactivation vaut pour l'avenir, jamais rétroactivement. Enfin, lorsqu'une conversation est signalée par les systèmes automatiques comme contrevenant à la politique d'usage, les entrées et sorties sont conservées jusqu'à deux ans et les scores de classification jusqu'à sept ans.
Que devient le contenu de vos fichiers connectés ?
Il fait l'objet d'un traitement distinct, plus protecteur, et c'est une bonne nouvelle que personne ne rapporte.
Les deux pages d'Anthropic consultées précisent que les données susceptibles d'être utilisées pour améliorer les modèles n'incluent pas le contenu brut provenant des connecteurs, en citant nommément les espaces de stockage documentaire et les serveurs distants ou locaux du protocole de connexion aux outils. La réserve est cependant importante et elle annule l'avantage si on l'ignore : un contenu directement copié dans la conversation par l'utilisateur redevient, lui, du contenu de conversation ordinaire.
La conséquence pratique est nette et facile à transmettre à une équipe. Brancher un connecteur sur un espace documentaire est, du point de vue de la réutilisation, plus prudent que de coller le même document dans la fenêtre de conversation. C'est exactement l'inverse de l'intuition, qui voit dans le connecteur une ouverture plus large.
Ce déplacement vers les connecteurs et les mémoires persistantes est précisément ce que le régulateur français a identifié cet été comme le vrai changement de nature du sujet.
Que dit le régulateur français en 2026 ?
Sa doctrine générale n'a pas bougé depuis deux ans, et sa publication la plus récente porte sur ce qui a changé entretemps, c'est à dire les agents.
La foire aux questions de la CNIL consacrée à l'utilisation d'un système d'IA générative reste datée du 18 juillet 2024 au relevé du 19 août 2026. C'est un fait à connaître avant de la citer comme état de l'art : elle est solide sur les principes et elle est antérieure à l'ensemble des produits agentiques du marché.
La publication qui compte est plus récente. Le 20 juillet 2026, la CNIL et le Conseil de l'IA et du Numérique ont publié une note exploratoire commune consacrée à l'IA agentique et aux données personnelles, dont les constats recoupent point par point ce que cet article a établi côté éditeurs. Les autorités y décrivent un changement d'échelle qui renouvelle et amplifie les risques, la circulation de données personnelles entre de nombreux services, et le rôle de la conservation de l'historique et des mémoires persistantes dans l'augmentation du volume conservé. Elles signalent également que le fonctionnement décentralisé de ces systèmes complique l'identification des responsabilités de chaque partie et étend le risque de cybersécurité à l'ensemble des services connectés.
Le point de méthode est le plus utile pour une direction : les autorités constatent que les instruments européens existants s'appliquent déjà à ces systèmes, mais que leurs caractéristiques propres, l'autonomie décisionnelle, la mémoire persistante, la capacité d'interagir avec plusieurs services et d'agir au nom de l'utilisateur, appellent une adaptation des modalités de mise en œuvre des règles. Autrement dit, il ne faut pas attendre un texte nouveau : le cadre est là, c'est sa déclinaison pratique qui reste à faire dans chaque organisation.
Cette déclinaison rejoint les obligations de transparence en vigueur depuis le 2 août 2026, détaillées dans notre article sur le calendrier réel de l'AI Act, et la question du périmètre d'accès posée par notre article sur ce qu'est un agent IA : ce que l'agent peut atteindre compte davantage que ce qu'on prévoit de lui demander, puisque personne n'a écrit son chemin.
Que faire, et que change une implantation hors de l'Union européenne ?
Écrire une politique interne d'une page, et savoir que l'implantation ne met à l'abri de rien dès lors qu'on travaille avec l'Europe.
Quatre décisions suffisent à couvrir l'essentiel, et aucune ne demande de juriste pour être prise. La première est de désigner les comptes autorisés pour le travail professionnel, et d'interdire explicitement l'usage des comptes personnels gratuits, qui relèvent d'un régime différent de celui que l'entreprise a signé. La deuxième est de désactiver le retour d'expérience par pouce au niveau de l'organisation. La troisième est d'écrire la liste de ce qui ne doit jamais être saisi, en nommant les catégories réelles de l'entreprise plutôt qu'en recopiant une liste générique. La quatrième est de préférer un connecteur à un copier-coller chaque fois que c'est possible.
Pour une entreprise établie au Sénégal, en Côte d'Ivoire ou ailleurs dans la région, deux régimes se superposent et il faut les traiter séparément. Le traitement de données personnelles relève du droit national et de son autorité de contrôle, et cette formalité s'instruit localement, avant le déploiement, sur le périmètre de ce que l'outil peut atteindre. Le droit européen s'ajoute, sans se substituer, dès lors que le résultat produit par le système est utilisé dans l'Union, ce qui vise une part réelle des prestataires travaillant pour des donneurs d'ordre européens. Notre article sur les guides français qui ne fonctionnent pas dans la région détaille les hypothèses implicites qu'il faut remplacer sur ce terrain.
Par quoi commencer cette semaine ?
Par trois vérifications qui prennent moins d'une heure au total, et par un fichier d'une page.
Ouvrez les paramètres d'organisation de votre outil et désactivez le retour d'expérience. C'est la seule exception documentée à l'engagement de non-entraînement sur les formules professionnelles, et elle se referme en une minute.
Demandez à votre équipe qui utilise un compte personnel gratuit pour du travail. Posez la question sans reproche, parce que la réponse est presque toujours au moins une personne, et parce que c'est le seul point où votre exposition ne dépend d'aucun contrat.
Écrivez la liste de ce qui ne doit jamais être saisi, en une page. Nommez vos catégories réelles : identités de clients, dossiers du personnel, prix négociés, éléments couverts par un accord de confidentialité. Cette liste vaudra pour tous les outils que vous adopterez ensuite, et c'est le livrable le plus durable de l'exercice. C'est celui que nous construisons avec nos clients avant l'ouverture du premier compte.
Ce que cet article établit tient en trois lignes. Sur les formules professionnelles, les deux principaux éditeurs s'engagent par écrit à ne pas entraîner leurs modèles sur vos données, et cet engagement est réel. Il comporte une exception commune, le bouton de retour d'expérience, que l'un des deux éditeurs permet à un administrateur de fermer. Le risque dominant d'une organisation n'est donc pas dans le contrat qu'elle signe, il est dans les comptes personnels que personne n'a recensés.
À lire également
- Qu'est-ce qu'un agent IA : pourquoi le périmètre d'accès compte plus que la consigne, et ce qu'il faut décider avant de brancher un connecteur.
- Vos équipes utilisent déjà l'IA, avec ou sans vous : l'ampleur mesurée des usages non gouvernés, et la politique interne qui les rattrape.
- AI Act : le calendrier réel, et qui est vraiment concerné : les obligations en vigueur, celles qui sont reportées, et le champ d'application hors Union.
- Quelle IA choisir en 2026 : les quatre critères extérieurs au modèle, dont le régime des données.
FAQ
Mes conversations professionnelles servent-elles à entraîner l'IA ?
Non par défaut, sur les formules professionnelles des deux principaux éditeurs, qui l'écrivent tous deux sur leurs pages officielles. Une exception subsiste et elle est commune : si un utilisateur clique sur le pouce levé ou baissé, la conversation entière peut être utilisée, y compris lorsque l'entraînement est désactivé.
Et sur un compte gratuit ou personnel ?
Le régime change, et il diffère selon l'éditeur. Chez l'un, les conversations servent à l'entraînement sauf opposition explicite de l'utilisateur ; chez l'autre, elles n'y servent que si l'utilisateur l'autorise. Dans les deux cas, un collaborateur qui travaille sur son compte personnel ne bénéficie d'aucun engagement souscrit par son employeur.
Combien de temps mes conversations sont-elles conservées ?
Chez Anthropic, une conversation supprimée disparaît de l'historique immédiatement et des systèmes de stockage sous trente jours. Si vous avez autorisé l'amélioration du modèle, les données peuvent rester cinq ans sous forme dépersonnalisée dans les chaînes d'entraînement. Une conversation signalée par les systèmes de sécurité est conservée jusqu'à deux ans, et ses scores de classification jusqu'à sept ans.
Puis-je effacer rétroactivement mes données d'un modèle ?
Non. Désactiver l'entraînement ou supprimer une conversation empêche son usage pour les entraînements futurs, mais les données restent présentes dans les entraînements déjà en cours et dans les modèles déjà entraînés. C'est une raison de plus de traiter la question avant le déploiement plutôt qu'après.
Vaut-il mieux brancher un connecteur ou coller le document ?
Brancher le connecteur, du point de vue de la réutilisation. Anthropic précise que le contenu brut provenant des connecteurs n'entre pas dans les données susceptibles d'améliorer les modèles, alors qu'un contenu copié directement dans la conversation redevient du contenu de conversation ordinaire. C'est l'inverse de l'intuition courante.
Que dit la CNIL en 2026 ?
Sa foire aux questions sur l'IA générative reste datée du 18 juillet 2024. Sa publication la plus récente sur le sujet est une note exploratoire du 20 juillet 2026, coécrite avec le Conseil de l'IA et du Numérique, consacrée à l'IA agentique : elle décrit un changement d'échelle lié aux mémoires persistantes et aux connexions multiples, et conclut que le cadre européen existant s'applique déjà, mais que ses modalités de mise en œuvre doivent être adaptées.
Pour aller plus loin
E-book : les outils IA qui comptent en 2026
Le panorama des outils qui meritent votre attention, et de ceux qui n'en meritent pas.
Telecharger l'e-bookKaramo Sylla
Fondateur d'AI5D
Karamo Sylla est ingenieur et consultant en intelligence artificielle, fondateur d'AI5D. Il accompagne les dirigeants et les organisations d'Afrique de l'Ouest dans leur transformation par l'IA, de la strategie a l'execution, et il est le createur du Protocole AI5D.