Un utilisateur de Reddit a récemment découvert qu’en saisissant dans Google la commande de recherche « site:claude.ai/share », on pouvait faire apparaître des centaines d’historiques de conversations avec Claude, révélant plus de 200 conversations. Elles s’étendent sur au moins 25 pages de résultats de recherche, dont certaines remontent à plusieurs semaines. Anthropic a ajouté la balise noindex et Google a retiré les résultats de recherche associés le 26 juillet.
Types de contenu divulgué : justificatifs de cryptomonnaie, données de patients pour des essais cliniques et plans produits non publiés d’entreprise
(Source : Reddit)
Après des tests, des internautes ont constaté que les conversations Claude divulguées couvraient plusieurs types d’informations personnelles et d’entreprises sensibles :
· Justificatifs de portefeuille de cryptomonnaie
· Numéros d’assurance maladie présumés
· Conseils juridiques et dossiers de santé (y compris le nom complet des patients participant à des essais cliniques, leur âge, leur sexe, leur origine ethnique et leurs dates de traitement)
· Documents internes d’entreprise (fiches de paie, historiques de conversations du système CRM, plans produits non encore publiés)
· Noms d’enfants et numéros de téléphone
· Données de localisation (base de données de « collecte de données de localisation », supposée contenir des adresses et des codes d’accès pour des appartements)
Om Patel (fondateur de BigIdeasDB) a ajouté que la fuite ne se limitait pas aux historiques de conversation : elle englobe aussi les interactions générées par la fonctionnalité « Artifacts » de Claude, notamment des mini-programmes et des documents.
Cause technique : absence de balise noindex et limites des robots.txt
La cause directe de cette fuite tient au fait que les pages de partage de Claude ne comportaient pas de balise « noindex ». Anthropic disposait, depuis septembre 2025, d’instructions dans robots.txt demandant aux moteurs de recherche de ne pas accéder aux liens de partage, mais cela ne suffisait pas : selon la documentation des développeurs de Google, si une page est liée par d’autres sites, Google doit que la page elle-même porte la balise noindex, ou que l’en-tête de réponse inclue x-robots-tag, afin d’empêcher réellement l’indexation.
Le média《Wired》, après examen des pages divulguées, a confirmé qu’elles ne comportaient effectivement pas de balise noindex ; cela explique aussi pourquoi certains résultats de recherche affichent « Aucune information disponible pour cette page ». Google sait que le lien existe, mais ne peut pas lire le contenu de la page ; le même problème se retrouve sur la page publique des Artifacts de Claude.
Avancement de la correction et problème de conservation permanente : 453 conversations déjà archivées
(Source : Claude)
Anthropic a ajouté la balise noindex et Google a commencé à retirer les résultats de recherche liés à Claude vers le 26 juillet ; toutefois, au moment de boucler l’article, Bing permettait encore de retrouver une partie du contenu. Il n’était plus possible de corriger le problème : sur GitHub, le dépôt nommé « Shared-Claude-Chats » a été définitivement archivé, contenant 453 conversations de Claude et 519 conversations de Grok, soit au total 11 241 messages, tous stockés sous forme de texte brut.
Il ne s’agit pas d’un cas isolé : ChatGPT avait aussi connu, il y a 11 mois, une situation presque identique (« Rendre cette conversation détectable » a conduit à l’indexation de milliers de conversations par des moteurs de recherche ; la fonctionnalité a depuis été supprimée). L’année dernière, Anthropic avait également connu une situation similaire, avec environ 600 conversations indexées par Google.
FAQ
Quelle est la cause technique directe qui a conduit à la fuite des conversations Claude ?
La cause directe est que les pages de partage de Claude ne comportaient pas de balise « noindex ». Bien qu’Anthropic ait mis en place robots.txt depuis septembre 2025, d’après les explications des développeurs de Google, pour les pages déjà liées par d’autres sites, Google a besoin que la page elle-même porte la balise noindex afin d’empêcher complètement l’indexation ; après examen, le média《Wired》a confirmé que ces pages ne disposaient pas de cette balise. Anthropic a corrigé le problème en ajoutant la balise noindex après l’incident.
Même si Anthropic a réparé, les conversations divulguées dans le passé sont-elles désormais conservées définitivement ?
Oui. Sur GitHub, le dépôt nommé « Shared-Claude-Chats » a été archivé, conservant définitivement 453 conversations de Claude et 519 conversations de Grok, soit 11 241 messages, sous forme de texte brut ; en plus, au moment de l’article, Bing permettait encore de retrouver une partie du contenu. Les utilisateurs peuvent gérer, dans l’onglet confidentialité des paramètres de Claude, les conversations partagées, mais le contenu déjà archivé ne peut pas être supprimé de cette manière.
Comment Anthropic et Google ont-ils répondu à cet incident ?
Un porte-parole d’Anthropic, Amie Rotherham, a déclaré que les liens de partage ne sont pas devinables : en choisissant de partager, les utilisateurs rendent leur contenu public, comme d’autres contenus publics sur Internet pouvant être sauvegardés par des tiers. Le porte-parole de Google, Ned Adriance, a indiqué que les moteurs de recherche ne peuvent pas contrôler quelles pages sont rendues publiques sur Internet ; Google fournit aux propriétaires de sites des outils clairs pour décider si une page doit être indexée et il respecte toujours ces réglages.