Un fil Reddit a révélé ce week-end qu’une recherche Google basique donnait accès à plusieurs centaines de conversations partagées sur Claude, l’assistant conversationnel d’Anthropic, un chiffre que certains utilisateurs du forum évaluaient plutôt en milliers. Certaines pages indexées contenaient des échanges professionnels ou personnels.
« des stratégies juridiques, du code ou des dépannages techniques, ou encore des sujets personnels » : au bout d’un moment, si les gens sont assez stupides pour balancer ce genre de choses sur des IA, tant pis pour eux.
Et allez, encore un génie qui blame les victimes. Les seuls responsables ici sont chez Anthropic.
Alors je pense que c’est plus compliqué que ça. A mon avis c’est s’ils ont activé « partage » cela créé un lien. Ensuite, comment Google en a eu connaissance (et bing surtout)… Je sais que Chrome peut le voir aussi, mais vu que c’était aussi sur bing…
Pour le coup, je pense pas. À moins qu’il soit établi que c’était des conversations que leurs utilisateurs ont maintenues privées et qui ont été rendues publiques par erreur côté Anthropic, l’hypothèse la plus raisonnable est que ces utilisateur ont partagé publiquement le lien vers ces conversations, et c’est comme ça que le bot Google les a trouvées…
" Nous rappelions récemment les réglages à vérifier avant de confier des documents sensibles à ChatGPT, notamment la gestion de ses liens partagés, une précaution qui vaut désormais aussi pour Claude."
Non mais on croit rêver en vous lisant, vous êtes dans un autre monde au quoi.
Confier des document sensibles ou confidentiels à au IA qui va les traiter sur un autre territoire sans que vous ayez aucun contrôle sur la chose?
Mais le seul conseil un tout petit peu sensé que vous pourriez donner serait « ne le faites pas du tout ».
Tout le reste ce sont des conneries monstrueuses. Vous savez ce qu’en font ces sociètés de vos réglages ?
ÇA DOIT BIEN LES FAIRE MARRER DE LIRE CES CONSEILS DÉBILES.
Du coup, l’erreur est dans le réglage par défaut: un bouton « share » devrait renvoyer une URL privée (que l’on peut transmettre à des tiers) et non indexable par un bot. Il semble qu’un minimum de chiffrage avec une clé symétrique qui serait dans la partie anchor de l’URL (après le #, vu que ce n’est jamais transmis côté serveur/publique) aurait été logique et bienvenue. Bref, c’est une négligence d’Anthropic de laisser ces partages indexables, publics et non chiffrés.
Non, c’est une fonctionnalité. Le but de cette fonction de partage, c’est justement de partager publiquement, et c’est clairement indiqué quand on active le partage :
Effectivement on peut à la limite leur reprocher de ne pas avoir mis de robots.txt pour demander aux robots de ne pas indexer. Mais dans la mesure où c’est clairement annoncé comme étant public une fois partagé, c’est pas franchement nécessaire de les rendre non indexables… Surtout que de toute façon, le respect ou non du robots.txt dépend seulement de la bonne volonté du robot…
Les deux ne sont pas incompatibles mais la responsabilité finale ne change pas. Si ce qui remonte dans le fil Reddit est vrai et qu’on est encore (on a déjà eu le problème, je ne dis pas que c’est le même, juste que bon … on a déjà vu le film « oopsy j’ai leak tes data ») sur une erreur de tag noindex et/ou un conflit avec le robots.txt sur ces conversations, le fait de partager un lien même sur un forum public ne devrait pas faire que ça se retrouve dans l’index Google.
En tout cas la bonne chose c’est évidement de faire de la pédagogie auprès des utilisateurs et rappeler que quiconque a le lien d’une conversation partagé peut y avoir accès, mais se servir de ça pour dire que les gens sont « stupides » parce qu’ils font confiance à Anthropic pour protéger leurs données, c’est simplement odieux.
En revanche je rejoins un peu @max6 sur ce coup : la bonne règle d’hygiène est de traiter les conversations avec les modèles cloud comme des discussions publiques.
Ce n’est pas la même chose de pouvoir accéder à la conv si on possède le lien et posséder effectivement le lien, là ils ont donné le lien à la terre entière.
Un chouette papier sur le problème de la config utilisé par Claude.ai, la réponse de l’équipe d’Anthropic et pourquoi c’est comme ça :
https://netguard24-7.com/blog/a-field-note-on-claudeai-share-url-discoverability
TLDR : quand le robots.txt bloque les crawlers le « noindex » n’est jamais pris en compte.
Google’s own documentation advises against combining those two directives. When a page is disallowed in robots.txt, Googlebot never fetches it and therefore never observes the
X-Robots-Tagheader. If an external site links to a disallowed URL, Google can still list the bare URL in search results, which is precisely what is observable with a simplesite:claude.ai inurl:sharequery.
I reported this to Anthropic through their Vulnerability Disclosure Program on April 17, 2026. Anthropic’s Security Team provided a responded with technical merits around directive interaction, Anthropic’s position landed on a threat-model justification that I find defensible. What is still worth a short public note is the gap between user expectations of a « shared by link » feature and the mechanics of search-engine discoverability, and the configuration-hygiene question it raises for any platform shipping a similar feature.
PS: le post en question date d’avril 2026… ^^
Je ne comprends pas comme toi ce qui est proposé. Le message dit « Toute personne disposant du lien peut voir » ce qui est fondamentalement différent de « cette conversation est publique » ou « les liens sont publiés et indexés par les moteurs de recherche ».
Le fait de dire qu’il faut disposer du lien pour voir, implique qu’il n’est pas affiché à tous vents. Mais c’est visiblement le cas et l’ambiguïté est problématique ici.
Sur pas mal de sites, lorsque tu crées un lien public, le lien est au format « https://lesite.com/43242FEFOECDEDEO3232#2O23023JEDEDOK3DEOK »
Il s’agit bien d’un lien public, avec une partie client (la partie après le #) sans laquelle, tu ne peux pas voir le contenu. Cette partie n’est jamais envoyé au serveur (c’est dans le standard HTTP depuis 1996) et elle sert à déchiffrer le contenu (et même le serveur ne peut pas accéder au contenu, ici ce serait inutile). Ce type de lien, lorsque tu le partages, seul le destinataire peut voir le contenu car il a l’anchor. Un individu tiers qui aurait juste « https://lesite.com/43242FEFOECDEDEO3232 » n’aurait pas accès aux données, quelque soit la manière dont il se l’est procuré (qu’il suive ou pas les directives de robots.txt).
Ce n’est pas parce que ça se retrouve sur Google que le lien est affiché à tous vents. C’est peut-être tout simplement l’utilisateur qui a posté ensuite le lien sur un espace public…
Sauf que si l’utilisateur fout se lien sur un forum par exemple, le robot qui parcours ce forum, il a bien accès à l’anchor…
L’article montre une capture d’écran avec tous les liens sur le site claude.ai. Si c’était posté sur un forum, il y a aurait d’autres résultats avec notamment sur le forum qui l’a posté. Même dans ce cas, que le lien soit public, c’est quand même l’utilisateur qui l’a expressément choisi, vu qu’il l’a copié à la main. Difficile de se plaindre après. Dans le cas qui nous concerne, c’est que l’utilisateur est amené à penser (par la tournure de phrase) que seul celui qui a le lien peut voir sa conversation alors que c’est visiblement faux.
L’article indique bien que claude.ai autorise l’indexation des liens de partages (justement pour des raisons de SEO, plus tu as de lien, plus tu montes dans les résultats). Donc c’est volontaire et pas une négligence d’Anthropic.
Note, ce n’est pas spécifique à Claude, OpenAI a récemment publié la conversation en T. Tao et ChatGPT à propose du contre exemple d’une conjecture que l’IA à mise à jour. Je suis presque sûr que Terence Tao n’a pas volontairement voulu que tout un chacun sache ce qu’il fait avec ChatGPT.
Difficile pour moi de croire à une négligence: c’est volontaire et c’est volontairement mal tourné dans la phrase pour te laisser croire qu’il y a un minimum de contrôle sur la publication. Évidemment, aucun de ces sites n’écrit: « En cliquant sur ce bouton, vos conversations seront publiques, consultées par les moteurs de recherche, disponibles dans les résultats de recherche pour les mots clés utilisés dans vos conversations et utilisées pour l’entraînement des futures IA ».
Non, c’est pas comme ça que Google fonctionne… Si tu fais une recherche avec site:xxx, il ne donne en résultat que les pages de son index qui sont sur xxx, pas les pages tierces qui ont des liens vers xxx. Et quand bien même ça serait le cas, le fait que sur une capture où on voit 3 résultat il n’y ait aucun forum ne prouve pas grand chose, échantillon minuscule, il pourrait très bien y avoir des forums plus loin dans les résultats…
Il n’affiche jamais comment il a trouvé ces liens à la base pour aller les indexer.
Rien ne permet d’affirmer que ce n’est pas le cas. Pour que ça soit le cas, il faudrait prouver que quelqu’un d’autre que l’utilisateur a diffusé le lien. Le fait que ça se retrouve dans Google ne prouve aucunement ça, ça peut tout a fait résulter du fait que l’utilisateur a posté le lien à un endroit où Googlebot y avait accès.
Oui, ils ne l’ont pas bloqué avec le robots.txt. Robots.txt qui de toute façon n’est qu’une convention, que les robots n’ont aucune obligation légale de respecter.
Il a déjà posté publiquement des liens de conversations qu’il a eu avec ChatGPT : https://mathstodon.xyz/@tao/115351400633010670
Donc à moins qu’il dise que la conversation dont tu parles a été dévoilée à son insu, accuser OpenAI de l’avoir fait n’est qu’une accusation en l’air…
Cet article a d’ailleurs l’air de dire que c’est bien lui qui a partagé le lien : https://www.developersdigest.tech/blog/jacobian-conjecture-counterexample-fable
EDIT : c’est confirmé, c’est bien Terence Tao lui même qui a partagé le lien, sur son blog. Il va falloir revoir tes certitudes ![]()
https://terrytao.wordpress.com/2026/07/21/a-digestion-of-the-jacobian-conjecture-counterexample/
(tout en bas de l’article : " AI disclosure: I used an AI chatbot to discuss various aspects of this problem and to confirm several of the calculations made here.")
Donc non seulement il a bien partagé le lien, mais il y avait une volonté claire justement que « tout un chacun sache ce qu’il fait avec ChatGPT », puisqu’il a partagé spécifiquement ce lien dans ce but.
Vraiment la meilleure lecture du problème de robots.txt / noindex https://netguard24-7.com/blog/a-field-note-on-claudeai-share-url-discoverability
Et l’anti pattern assumé de manière hallucinante par anthropic ^^ (même si en étant charitable on peu comprendre).
Mais @xryl a raison de mon point de vue. C’est une erreur d’UX.
Le fait qu’Anthropic ait accouru pour retirer les résultats montre que c’était une erreur je pense.
