← Journal

9 août 2026 · 8 min de lecture · Données

Où partent vos données quand vous utilisez une IA en ligne ?

Il est 15 h 40, vous devez répondre à un client avant la fin de la journée, et le paragraphe que vous venez d'écrire est confus. Vous le copiez, vous ouvrez un onglet, vous collez, vous demandez « reformule ça de façon plus claire ». Trois secondes plus tard, vous avez votre paragraphe. Vous avez aussi, sans y penser une seconde, transmis à une entreprise située à sept mille kilomètres le nom de votre client, le montant du contrat et la nature du différend qui vous oppose.

La question n'est pas de savoir si c'était grave. C'est de savoir où ce texte se trouve maintenant, combien de temps il va y rester, et qui peut le lire. Ce sont trois questions différentes, et les réponses sont publiques : elles figurent dans la documentation des éditeurs. Encore faut-il avoir le temps de lire quarante pages de politique de confidentialité, et rares sont ceux qui l'ont.

Voici donc l'essentiel, vérifié dans les textes officiels.

Premier point : la version que vous utilisez change tout

C'est le point le plus mal compris, et de loin. Les grands éditeurs appliquent deux régimes radicalement différents selon le type de compte.

Sur les offres grand public — comptes gratuits et abonnements individuels — vos conversations servent en général à améliorer les modèles, et les durées de conservation se comptent en mois ou en années.

Chez Anthropic, un changement discret d'août 2025 illustre bien le sujet : les utilisateurs des offres Free, Pro et Max ont dû choisir, avant une date butoir, s'ils acceptaient que leurs conversations servent à l'entraînement. En cas d'acceptation, la durée de conservation passe de trente jours à cinq ans (annonce officielle d'Anthropic). Combien de vos collaborateurs ont lu la fenêtre avant de cliquer ?

Chez Google, les conversations Gemini sont conservées par défaut dix-huit mois dans le compte, un réglage modifiable de trois à trente-six mois. Mais le vrai détail est ailleurs, et Google l'écrit noir sur blanc : les échanges relus par des évaluateurs humains ne sont pas supprimés quand vous effacez votre historique. Ils sont stockés séparément, dissociés du compte, et conservés jusqu'à trois ans (Gemini Apps Privacy Hub).

Sur les offres professionnelles — plans entreprise, API sous contrat — la logique s'inverse : les données ne servent pas à l'entraînement par défaut, la rétention est courte, et un accord de sous-traitance encadre le tout.

Retenez cette phrase, elle vaut pour tous les éditeurs : ce n'est pas l'outil qui détermine votre niveau de protection, c'est le contrat. Le même modèle, la même interface, la même réponse à l'écran — et deux régimes juridiques sans rapport l'un avec l'autre.

Deuxième point : « supprimer » ne signifie pas toujours supprimer

Voici l'histoire la plus instructive de ces deux dernières années, et elle n'a rien à voir avec une faille de sécurité.

Le 13 mai 2025, dans le cadre du procès en contrefaçon opposant le New York Times à OpenAI, une magistrate de New York ordonne à l'éditeur de conserver l'ensemble des journaux de sortie, y compris les conversations que les utilisateurs avaient supprimées. Motif : ces échanges pourraient constituer des preuves. OpenAI conteste, invoque ses engagements de confidentialité, et perd. Les utilisateurs de ChatGPT, eux, n'ont pas voix au chapitre : ils sont juridiquement tiers au procès.

L'obligation a pris fin le 26 septembre 2025, et OpenAI est revenu à sa politique habituelle de suppression sous trente jours (communiqué d'OpenAI). Mais l'affaire ne s'est pas arrêtée là : les plaignants ont obtenu la production d'un échantillon de vingt millions de conversations dépersonnalisées. Le juge Sidney Stein a confirmé cette obligation le 5 janvier 2026, estimant que la vie privée des utilisateurs était suffisamment protégée par la taille de l'échantillon, la dépersonnalisation et l'ordonnance de protection en vigueur (ABA Journal, Jones Walker).

Un point mérite d'être signalé par honnêteté : les conversations provenant de l'Espace économique européen, de Suisse et du Royaume-Uni ont été exclues de l'obligation de conservation. Un utilisateur européen n'était donc pas directement concerné.

Mais la leçon de fond demeure, et elle est indépendante de cette affaire : la promesse de suppression d'un éditeur ne vaut que jusqu'à ce qu'un juge étranger en décide autrement. Aucun contrat, aucune case cochée dans les paramètres ne protège de cela. Votre politique de rétention interne s'arrête à la porte de votre prestataire.

Troisième point : oui, des humains lisent

L'idée que « de toute façon, c'est une machine, personne ne voit rien » est fausse, et là encore les éditeurs le documentent eux-mêmes.

Google indique qu'une partie des conversations Gemini est relue et annotée par des évaluateurs humains, formés, chargés d'identifier les réponses de mauvaise qualité ou dangereuses — et précise que ces évaluateurs peuvent être des prestataires. L'éditeur ajoute une recommandation qui devrait figurer dans toutes les chartes internes : ne saisissez pas d'informations confidentielles que vous ne voudriez pas voir relues.

Deux précisions qui comptent. D'abord, Google déclare dissocier les échanges du compte avant relecture. C'est une garantie réelle et limitée : si le nom de votre client figure dans le corps du message, il n'est pas anonymisé par magie. Il fait partie du texte.

Ensuite, désactiver le paramètre « Keep Activity » empêche vos futures conversations d'être utilisées pour améliorer les modèles — mais Google précise que même dans ce cas, les échanges sont conservés soixante-douze heures et peuvent continuer d'être examinés, avec l'aide de relecteurs humains, à des fins de sécurité et de protection. Le réglage réduit l'exposition. Il ne la supprime pas.

Quatrième point : le vrai risque n'est pas l'outil, c'est le compte personnel

Vous pouvez avoir négocié un contrat entreprise irréprochable et fuir malgré tout par tous les côtés. C'est même le scénario le plus fréquent : il porte un nom, le shadow AI, et il concerne aujourd'hui près d'un salarié sur deux.

Les mesures de terrain sont sans ambiguïté. Selon les analyses de trafic de Cyberhaven, la proportion des données saisies dans les outils d'IA qui contiennent des informations sensibles est passée d'environ un dixième en 2023 à 39,7 % en 2026 — soit, en moyenne, un salarié qui saisit une information sensible dans une IA tous les trois jours (Cyberhaven Labs, 2026 AI Adoption & Risk Report).

LayerX, qui observe l'activité côté navigateur plutôt que de sonder les salariés, relève que 77 % des utilisateurs professionnels collent du contenu dans des IA génératives, et que 82 % de ces copier-coller passent par des comptes non gérés, hors de toute supervision (LayerX, Enterprise AI & SaaS Data Security Report 2025).

Le coût n'est pas théorique. Le rapport Cost of a Data Breach 2025 d'IBM constate qu'une organisation sur cinq a subi une violation liée à une IA non encadrée, et chiffre le surcoût moyen de ces incidents à environ 670 000 dollars (IBM).

Et l'incident fondateur reste le plus parlant : au printemps 2023, quelques semaines après avoir autorisé ChatGPT, Samsung découvre que ses ingénieurs y ont saisi du code source de semi-conducteurs et le compte rendu d'une réunion confidentielle. L'entreprise restreint aussitôt l'usage des IA génératives sur ses équipements, en expliquant qu'il est impossible de récupérer une donnée une fois partie sur un serveur externe.

C'est exactement le problème.

Un mot de passe se change. Un accès se révoque. Un paragraphe de contrat entré dans un système tiers ne se rappelle pas.

Cinquième point : la géographie du serveur ne fait pas la loi applicable

« Nos données sont hébergées en Europe. » Vous l'avez entendu, et c'est souvent vrai. C'est aussi insuffisant.

Le CLOUD Act, loi américaine de 2018, permet aux autorités des États-Unis d'exiger d'un fournisseur relevant du droit américain la communication de données qu'il détient — quel que soit le pays où se trouvent les serveurs. La filiale européenne d'un groupe américain reste dans le périmètre. Le centre de données de Francfort ne change rien à l'affaire.

Quant au Data Privacy Framework, le cadre qui autorise aujourd'hui les transferts de données personnelles vers les États-Unis, il est valide — mais sous surveillance. Le Tribunal de l'Union européenne a rejeté le 3 septembre 2025 le recours du député Philippe Latombe, en précisant toutefois qu'il jugeait la situation telle qu'elle existait en 2023 (IAPP). Un pourvoi est pendant devant la Cour de justice, et l'organe américain chargé de contrôler les garanties du dispositif a perdu son quorum en janvier 2025. Deux cadres transatlantiques successifs ont déjà été annulés par cette même Cour. Un troisième épisode n'est pas à exclure.

Ce n'est pas de la politique-fiction : Bruxelles en a tiré les conséquences. Le 3 juin 2026, la Commission a présenté le Cloud and AI Development Act, qui instaure quatre niveaux de souveraineté conditionnant l'accès à la commande publique, le plus élevé visant précisément à neutraliser l'exposition au droit extraterritorial (Commission européenne). Ce n'est encore qu'une proposition de règlement, en cours de négociation. La direction, elle, est claire.

Ce que le déploiement local change — et ce qu'il ne change pas

Faire tourner un modèle sur vos propres serveurs supprime le problème à la racine, pour une raison simple : il n'y a plus de destinataire. Pas de transfert, donc pas de question de transfert. Pas de sous-traitant, donc pas d'accord de sous-traitance à négocier ni à auditer. Pas d'entraînement d'un tiers sur vos données, puisque aucun tiers ne les reçoit. Pas de politique de rétention à surveiller, puisque la vôtre est la seule qui s'applique. Et aucune ordonnance étrangère ne peut atteindre ce qui n'est jamais sorti.

Il faut dire aussi ce que le local ne fait pas, sans quoi la démonstration ne vaudrait rien.

Il ne vous dispense pas de l'AI Act. Le règlement se déclenche sur la mise sur le marché ou la mise en service d'un système dans l'Union européenne : installer un outil de tri de candidatures sur vos serveurs, c'est le mettre en service, avec les obligations correspondantes. La connectivité n'est un critère nulle part — c'est l'idée reçue que nous avons démontée en détail dans notre article sur l'AI Act.

Il ne règle pas vos droits d'accès internes. Un modèle local branché sur des documents mal cloisonnés reproduira fidèlement ce cloisonnement défaillant, et le rendra même plus visible.

Il ne fait pas disparaître les questions RGPD : base légale, information des personnes, minimisation, durées de conservation restent entières. Elles deviennent simplement des questions internes, que vous pouvez trancher seul.

Et il suppose des moyens : du matériel, un choix de modèle adapté à l'usage, une exploitation. Pour beaucoup de tâches courantes, les modèles ouverts actuels suffisent très largement. Pour d'autres, non — et le dire fait partie du travail : j'ai détaillé ce qu'un modèle local sait faire, et ce qu'il ne sait pas faire, mesures à l'appui.

Ce que vous pouvez faire lundi matin

Faites l'inventaire réel. Pas la liste des outils autorisés : la liste des outils utilisés. Les deux ne se ressemblent jamais. C'est d'ailleurs la même première étape que pour la mise en conformité AI Act d'une PME : un seul recensement sert aux deux chantiers.

Vérifiez sous quel régime tourne chaque usage. Compte personnel ou compte entreprise ? Contrat de sous-traitance signé ou conditions générales grand public acceptées d'un clic ? C'est la question la plus rentable de toute la démarche.

Classez avant d'interdire. Faire résumer un article de presse public et faire relire un projet de contrat ne posent pas le même problème. Une règle qui ne distingue pas les deux ne sera pas respectée.

Offrez une alternative. Toutes les études convergent : l'interdiction pure déplace l'usage vers les téléphones personnels, où vous ne voyez plus rien du tout. Le collaborateur sait que l'outil lui fait gagner une heure. Lui demander de renoncer sans rien proposer, c'est obtenir une conformité de façade.

Vous n'avez pas besoin de renoncer à l'IA. Vous avez besoin de savoir où vont vos phrases quand vous appuyez sur Entrée — et de pouvoir choisir, usage par usage, ce qui a le droit de sortir de chez vous.

Pour un nombre croissant de tâches, la réponse la plus simple reste celle où la question ne se pose pas : le modèle vient jusqu'aux données, pas l'inverse.

Sources

Article à jour au 9 août 2026. Les politiques de confidentialité des éditeurs évoluent fréquemment : vérifiez les pages officielles avant toute décision.

Vous vous demandez ce qui sort de chez vous ?

Vingt minutes au téléphone suffisent à faire le point sur vos usages. Sans engagement.

Prendre rendez-vous