← Toutes les actualités
Presse · 7 octobre 2026 · 15 min de lecture

Un document retiré peut continuer de répondre à travers votre IA

Un document retiré peut continuer de répondre à travers votre IA

Une procédure de retrait traite le fichier, pas les copies que l'IA en a faites. La fiche de retrait vérifie qu'un document retiré a bien disparu.

Une entreprise retire un document quand il est remplacé, quand il est faux, ou quand une personne a demandé l’effacement de ses données. Une procédure de retrait écrite avant l’arrivée de l’IA traite le document source. Elle ne connaît pas les copies que les systèmes d’IA en ont faites : un index de recherche, un résumé enregistré, une mémoire d’agent, un jeu de questions de test. Un document retiré encore cité par l’IA, c’est une décision documentaire prise par écrit que l’assistant défait sans que personne le sache.

Cet article s’adresse au CDO, au CTO ou au responsable de la gestion des connaissances d’un grand groupe dont un assistant ou un agent interne lit déjà le patrimoine documentaire. Si votre assistant interroge les documents en direct, sans index, sans mémoire et sans résumé enregistré, l’argument porte seulement sur les fiches dérivées et les exports ; il prendra toute sa force le jour où vous ajouterez une mémoire ou un second connecteur.

La personne pour qui ce texte est inconfortable est le responsable qualité d’un site industriel. Après une non-conformité, il a retiré la procédure de contrôle à réception d’un composant et publié sa nouvelle version, avec un critère d’acceptation modifié. Au retour d’expérience suivant, un contrôleur raconte qu’il a demandé le critère à l’assistant de l’usine et que la réponse reprenait l’ancien. Il s’en est aperçu parce que la fiche affichée au poste disait autre chose. Le responsable qualité ouvre la GED : l’ancienne version est bien archivée. Il ne sait pas où l’assistant l’a trouvée.

Le geste que propose cet article ne coûte rien. Retrouvez, dans le journal d’archivage de la GED ou le registre des révisions du système qualité, le dernier document officiellement retiré, et posez à votre assistant la question à laquelle il répondait. Le résultat alimente un artefact décrit plus bas, la fiche de retrait.

Deux réponses viennent spontanément. La première est la procédure maison : le circuit de retrait tenu par le records management ou le système qualité, qui archive la version périmée et notifie les destinataires. La seconde est l’outil déjà acheté : la synchronisation des connecteurs, qui retire de l’index un fichier supprimé, et les politiques de rétention et d’archivage, dont certaines excluent désormais les contenus archivés de l’indexation de l’assistant. Ces moyens agissent sur le fichier ; le contenu du document, recopié ou reformulé ailleurs, leur échappe. En juillet, nous décrivions un corpus qui dérive en silence quand les documents changent. Cet article traite le cas inverse : une décision explicite de faire disparaître un contenu, que les copies de l’IA ne suivent pas.

Où vivent les copies d’un document une fois que l’IA l’a lu

Selon son architecture, un assistant d’entreprise conserve des traces d’un document à plusieurs étages.

L’index de recherche découpe le document en passages et en stocke des représentations. Quand le connecteur est bien réglé, la suppression du fichier se propage à l’index après un délai de synchronisation. Quand le document est seulement déplacé dans un espace d’archive que le connecteur continue de lire, rien ne se propage.

Les contenus produits à partir du document lui survivent : un résumé enregistré dans un espace d’équipe, une fiche pratique rédigée avec l’aide de l’assistant, une réponse copiée dans un courriel puis classée. Chacun reprend le contenu retiré sous une autre forme et sous un autre nom de fichier.

Les mémoires persistantes des agents conservent ce qu’ils ont retenu d’un échange. Dans une note exploratoire publiée le 20 juillet 2026, la CNIL et le Conseil de l’IA et du Numérique relèvent que la conservation de l’historique des interactions et le recours à des mémoires persistantes augmentent les données conservées par ces systèmes « sur des supports variés ». La note porte sur les données personnelles et ne crée pas d’obligation nouvelle. Elle décrit un mécanisme qui vaut aussi pour le contenu documentaire.

Enfin, l’équipe IA garde ses propres copies : le jeu de questions de référence dont les réponses attendues citent le document, et les consignes qui le mentionnent par son nom. Le jour où le document est retiré, le test continue de valider l’ancienne réponse.

Document retiré encore cité par l’IA : ce que les outils couvrent, et ce qu’ils laissent

L’outillage existant mérite d’être décrit dans sa meilleure forme. Un connecteur bien configuré propage les suppressions. Les contrôles d’accès s’appliquent au moment de la requête, si bien qu’un document rendu inaccessible ne remonte plus. Microsoft a annoncé en septembre 2026, pour un déploiement entre octobre et novembre, une option d’archivage dans les politiques de rétention de Purview : les fichiers SharePoint et OneDrive inactifs passent dans une archive, restent disponibles pour l’eDiscovery et sortent de l’indexation de Copilot. L’option n’est pas activée par défaut.

La frontière de ces outils est nette. Ils traitent un fichier, dans un environnement. Ils ignorent qu’une fiche pratique reprend trois paragraphes de la procédure retirée, qu’un agent a mémorisé son critère clé, ou que le jeu de questions de référence attend encore l’ancienne réponse. L’archivage par inactivité ne coïncide pas non plus avec un retrait : une procédure retirée après une non-conformité était, la veille, l’un des documents les plus consultés du site.

C’est à cette frontière que le responsable qualité réapparaît. Son circuit de retrait a fonctionné : la version périmée est archivée, les destinataires sont notifiés. Rien, dans ce circuit, ne lui demandait de vérifier ce que l’assistant de l’usine en avait gardé, et personne d’autre ne l’a fait.

Une autre discipline a déjà écrit cette règle. Le 10 février 2026, le Comité européen de la protection des données a adopté le bilan de son action coordonnée sur le droit à l’effacement, menée en 2025 par 32 autorités de contrôle auprès de 764 responsables de traitement. La moitié des autorités répondantes y expriment des préoccupations sur l’effacement dans les sauvegardes, et de nombreux organismes n’ont pas de procédure spécifique pour ce cas. Le rapport recommande de garder la trace des demandes d’effacement pour les appliquer aux systèmes restaurés, de vérifier que l’effacement a été effectué et d’être en mesure de le démontrer. La protection des données a donc déjà admis qu’un effacement doit atteindre les copies de l’original. Les copies créées par l’IA appellent le même rattrapage pour tout document retiré, personnel ou non. La transposition porte sur la méthode, suivre un retrait jusqu’à ses copies, et non sur l’objet : cet article ne traite pas de conformité au RGPD, et le DPO n’en est destinataire que pour les retraits liés à une demande d’effacement.

La fiche de retrait

Le geste de l’introduction produit un artefact, la fiche de retrait. C’est le seul nom nouveau de cet article.

Ce qu’elle contient. Pour chaque document retiré : son identifiant, le motif du retrait (remplacé, erroné, effacement demandé), la question de contrôle à laquelle il répondait, la réponse obtenue de l’assistant après le retrait et ses sources citées, la liste des copies vérifiées avec leur état (absente, présente puis supprimée, non vérifiable), la date et le service auquel chaque copie non vérifiable a été transmise.

Son domicile. La procédure de retrait existante, dans la GED ou le système de management de la qualité, tenue par le records management ou le gestionnaire documentaire. La fiche y ajoute une section, « copies IA vérifiées », remplie avec l’équipe qui exploite l’assistant.

Le moment où ses premières lignes s’écrivent. Au prochain retrait programmé, une version remplacée par une autre dans le cours normal des révisions. Jamais au moment d’un retrait d’urgence après une non-conformité : c’est précisément la situation où l’on n’a pas le temps de chercher les copies.

Une fiche remplie. Document : procédure de contrôle à réception du composant, version précédente. Motif : remplacée après non-conformité. Question de contrôle : quel est le critère d’acceptation du composant à réception ? Réponse de l’assistant après retrait : nouveau critère, source citée la nouvelle version. Copies vérifiées : index de l’assistant de l’usine, absente ; fiche pratique de l’équipe de nuit rédigée avec l’assistant, présente puis remplacée ; jeu de questions de référence, réponse attendue mise à jour ; mémoire de l’agent de planification, non vérifiable, transmise à l’équipe IA.

Sa règle de lecture. Si l’assistant répond avec le document de remplacement et que toutes les copies sont absentes ou supprimées, le retrait est complet. S’il cite ou paraphrase le document retiré, une copie lui échappe : on la cherche avant de clore le retrait. Si une copie est non vérifiable, le retrait reste ouvert et l’exploitant de l’assistant indique comment la purger. Entre-temps, le document retiré figure sur la liste d’exclusion de l’assistant, et la question de contrôle rejoint le jeu de questions de référence pour être rejouée à chaque passage.

Son mode d’échec. Si l’exercice réussit, le gestionnaire documentaire découvre des copies qu’aucune procédure ne lui demandait de connaître, et doit les signaler à des équipes qui ne s’y attendaient pas. C’est son coût : une question posée et quelques copies cherchées par retrait. Si l’assistant ne cite pas ses sources, la règle de lecture ne s’applique pas, et ce constat est en soi un résultat : on ne peut pas vérifier qu’un retrait a atteint cet assistant.

La pièce qu’elle crée. Une fiche qui porte une copie « non vérifiable » établit qu’à une date donnée, l’entreprise savait qu’un contenu retiré pouvait encore être servi. C’est notre lecture, sans décision publiée à l’appui, qu’une trace datée suivie d’une transmission reste préférable à un retrait déclaré complet sans vérification. La portée d’une telle pièce dépend de votre contexte : l’avis de votre direction juridique s’impose avant d’en faire une règle de groupe. Pour les retraits liés à une demande d’effacement, la fiche ne contient aucune donnée personnelle, seulement la référence de la demande, et c’est la procédure du DPO qui s’applique.

La fiche ne crée aucun poste. Elle s’adosse à la procédure de retrait que finance déjà le système qualité et, si votre organisation configure cet automne l’archivage des contenus inactifs, au projet qui le déploie. La contrepartie est une dépendance : si l’assistant change d’architecture, la liste des copies à vérifier change avec lui.

Ce qu’un terrain réel a montré, et ce qu’il n’établit pas

Chez TotalEnergies Retail Power & Gas, le chatbot client s’appuie sur environ 500 pages de documentation web officielle. Lors du diagnostic mené avec K-AI, 19 % de ces pages se sont révélées à corriger, y compris des cas difficiles à repérer à l’œil à cette échelle. En trois semaines, 53 % des cas ont été résolus en traitant d’abord les plus critiques, avec un à deux experts mobilisés une demi-journée à une journée par semaine. Les experts métier ont tranché chaque cas ; K-AI a préparé le diagnostic et indiqué vers quel expert orienter chacun.

La frontière de cette preuve doit être dite. Elle établit qu’un corpus en production peut porter une part significative de contenus à corriger, et qu’un traitement priorisé reste soutenable avec des ressources limitées. Elle ne mesure pas la propagation des retraits vers les copies d’un assistant. La fiche de retrait sert précisément à instruire cette question chez vous.

Ce que la DKP ajoute, et où elle s’arrête

Une Document Knowledge Platform (DKP) est la couche de qualité et de gouvernance documentaire qui s’exécute en amont des systèmes d’IA : elle gouverne le patrimoine (Govern), détecte et traite anomalies, doublons, obsolescences et contradictions (Clean), puis n’active le corpus auprès des agents qu’une fois ces deux étapes tenues (Activate). Elle ne remplace ni la GED, ni l’outil de rétention et d’archivage, ni l’assistant. Elle ne se vend pas comme un outil de conformité à la protection des données ou de gestion du cycle de vie des données, et n’a pas vocation à figurer dans un appel d’offres de ces catégories. Le retrait d’un document est seulement le moment où le problème documentaire devient visible. Cette position ne dépend ni du calendrier des régulateurs, ni de celui des éditeurs : la couche documentaire précède le moteur.

Le records management détient une partie de la réponse : il sait quel document est retiré, quand et pourquoi. La contribution de la DKP tient à ce que cette discipline ne produit pas : les documents du patrimoine qui reprennent le contenu retiré sous un autre nom. Une DKP compte, pour chaque document retiré, les fiches, notes et pages qui portent encore ses affirmations, pour que le retrait d’une procédure n’oublie pas la fiche de l’équipe de nuit qui la recopiait. C’est son unité de travail propre, l’affirmation suivie à travers les documents, que la gestion des versions et la rétention ne produisent pas.

K-AI répond de ce dénombrement, de sa reproductibilité et du routage de chaque copie documentaire vers le service concerné. La décision de retirer reste au métier. La purge des index, des mémoires et des consignes de l’assistant reste à l’équipe qui l’exploite et à son fournisseur. Sur le plan technique, l’analyse porte uniquement sur les contenus documentaires désignés, dans un périmètre d’ingestion contractuel ; les questions des utilisateurs, les mémoires des agents et les journaux restent dans vos outils. Aucune donnée n’est réutilisée pour entraîner des modèles.

Et si vous ne faites rien

Le statu quo a un résultat prévisible. Chaque retrait sera déclaré complet au moment où le fichier quitte l’espace actif de la GED. L’assistant continuera, selon les cas, de citer une fiche dérivée, de s’appuyer sur sa mémoire ou de valider l’ancienne réponse dans ses tests. Personne ne le saura avant qu’un utilisateur ne rapporte une réponse fondée sur un document que l’entreprise croyait disparu.

Conclusion : auditer, nettoyer, surveiller

Auditer : poser à l’assistant la question à laquelle répondait le dernier document retiré, et lire les sources citées. Nettoyer : chercher les copies, documentaires et techniques, et transmettre celles qui échappent au gestionnaire documentaire. Surveiller : faire de la fiche de retrait une étape écrite de chaque retrait, et rejouer les questions de contrôle à chaque passage du jeu de questions de référence.

Au retour d’expérience suivant, le responsable qualité ne demandera plus où l’assistant a trouvé l’ancien critère. Il présentera la fiche de retrait de la procédure de contrôle à réception, avec la liste des copies vérifiées et la réponse de l’assistant après le retrait.

Foire aux questions

Pourquoi l’IA cite-t-elle encore un document que nous avons supprimé ou archivé ?

Parce que le document a pu laisser des copies que la procédure de retrait ne traite pas : un index qui n’a pas encore été synchronisé ou qui lit l’espace d’archive, une fiche dérivée, un résumé enregistré, la mémoire d’un agent ou un jeu de questions de test. Lire les sources citées par la réponse indique laquelle.

Supprimer un fichier suffit-il à le retirer de l’index d’un assistant IA ?

Avec un connecteur bien configuré, la suppression se propage à l’index après un délai de synchronisation. Elle ne touche pas les contenus qui reprennent le document sous un autre nom, ni les mémoires et les tests de l’assistant.

Comment repérer les documents obsolètes encore utilisés par notre IA ?

Partez des retraits récents enregistrés dans la GED ou le système qualité, posez à l’assistant la question à laquelle chaque document répondait et lisez les sources citées. Une réponse qui cite ou paraphrase le document retiré signale une copie à chercher.

L’archivage automatique des contenus inactifs règle-t-il le problème ?

Il sort de l’indexation les fichiers archivés, ce qui est utile. Il repose sur l’inactivité, qui ne coïncide pas avec la décision de retirer un document, et il n’atteint pas les copies du contenu enregistrées ailleurs.

Que faire quand le retrait fait suite à une demande d’effacement de données personnelles ?

La procédure du DPO s’applique. La fiche de retrait ne contient alors que la référence de la demande, sans donnée personnelle, et elle sert à vérifier que l’effacement a atteint les copies de l’assistant, comme le recommande le Comité européen de la protection des données pour les sauvegardes.

Quel est le cadre de confidentialité d’un examen du patrimoine documentaire ?

Le périmètre d’ingestion est contractuel et limité aux contenus documentaires désignés, à l’exclusion des questions des utilisateurs, des mémoires des agents, des journaux d’usage et de la télémétrie. Aucune donnée n’est réutilisée pour entraîner des modèles. Le périmètre est validé conjointement par le Document Owner métier et le RSSI ou le DPO, jamais par la seule DSI.

Sources


Pour aller plus loin

K-AI Corpus Diagnostic — 10 jours ouvrés, rapport complet des 20 anomalies les plus critiques de votre référentiel documentaire, garantie remboursement si aucune anomalie valable n’est détectée. Un échange d’une heure peut partir de quelques fiches de retrait : on regarde ensemble, pour chaque document retiré, combien d’autres documents reprennent encore son contenu, et vers quel service orienter chacun. Contactez l’équipe K-AI : contact@k-ai.ai. Le périmètre de chaque diagnostic est validé conjointement par le Document Owner métier et le RSSI/DPO, jamais par la seule DSI.

K-AI accompagne déjà CMA CGM, Veolia, PwC, BNP Paribas, TotalEnergies et CEVA Logistics. Partenaires : AWS, Snowflake, Microsoft, Wavestone, Devoteam.

Et chez vous, quel est votre patrimoine documentaire ?

30 minutes avec un fondateur. On audite gratuitement un échantillon de vos documents et on vous montre exactement ce que K-AI détecte.

Demander une démo → Lire d’autres articles