Eén zoekoperator leverde andermans werk op
In het weekend van 25 juli typte een gebruiker één zoekoperator in Google, site:claude.ai/share, en kreeg honderden gesprekken van anderen met Claude terug. Het waren geen voorbeelden en geen kopregels. Het waren volledige transcripties, geplaatst op het open web, leesbaar voor iedereen die dezelfde zoekopdracht herhaalde. Berichtgeving tot en met 27 juli beschreef juridische strategie geschreven door praktiserende advocaten, sessies over techniek en foutzoeken, cv's en financiële details, geïndexeerd naast doodgewone vragen.
Op 27 juli waren de Google-resultaten grotendeels verdwenen, nadat Anthropic de configuratie van zijn deelpagina's had aangepast. Bing gaf er nog steeds een deel van terug. Dat gat tussen twee zoekmachines is hier het eerste bruikbare signaal: de blootstelling werd nooit bepaald door de bedoeling van de leverancier, maar door wat elke crawler al mocht doen, en die toestemming was allang verleend voordat iemand ging kijken.
De blokkade hield juist de correctie tegen
Het mechanisme weegt zwaarder dan het incident. De robots.txt van Anthropic verbood het crawlen van de deel-URL's al. Dat klinkt als de sterkere bescherming en het is de zwakkere. Googles eigen Search Central-documentatie is uitgesproken over dit samenspel: wil de noindex-regel werken, dan mag de pagina niet geblokkeerd zijn door een robots.txt-bestand, want een crawler die geen toegang krijgt leest nooit de instructie om weg te blijven, en het adres kan alsnog in de resultaten opduiken zodra andere pagina's ernaar linken.
De blokkade hielp dus niet alleen niet. Zij sneed het enige kanaal af waarlangs de juiste instructie kon aankomen. Eén deellink die één keer in een openbaar forum, een supportdraad of een geëxporteerd chatlogboek belandt, is genoeg om het adres in handen van Google te leggen, en vanaf dat moment is een geblokkeerde pagina een indexeerbare pagina. De veilige instelling is de tegenintuïtieve: laat de crawler bij de pagina komen, zodat u hem via een header of een metatag kunt zeggen niet op te nemen wat hij aantreft.
Twee leveranciers, één archief, dezelfde bedrading
Een openbare GitHub-repository met de naam Shared-Claude-Chats had al 453 Claude-gesprekken en 519 Grok-chats verzameld die uit blootgestelde links waren getrokken. Het tweede getal verdient het langste nadenken. Twee leveranciers zonder onderling verband, twee los van elkaar gebouwde deelfuncties, één identieke storing. Dat is geen gebrek in de oplevering van één bedrijf. Dat is een ontwerppatroon in de manier waarop gespreksproducten adressen uitdelen.
Het patroon herhaalt zich moeiteloos. Een team bouwt delen via link, houdt de resulterende URL voor privé omdat die lang en onraadbaar is, en schrijft nooit een indexeringsregel omdat niemand verwacht dat het adres reist. Het adres reist altijd. Als uw eigen product, uw documentportaal, uw rapportagedashboard of uw systeem voor cliëntlevering op deze manier links aanmaakt, hebt u dezelfde bedrading en vrijwel zeker dezelfde aanname eronder.
Controleer elk oppervlak dat links aanmaakt
Deïndexeren is geen herstel. Een resultaat weghalen stopt toekomstige vondsten via die ene zoekmachine. Het haalt niets terug wat al is opgehaald, in cache gezet, gearchiveerd of opnieuw geplaatst, en de GitHub-verzameling is het bewijs dat ophalen heeft plaatsgevonden. Voor een Europese onderneming volgt de juridische lezing er meteen uit: onder de AVG is het platform verwerkingsverantwoordelijke voor wat zijn eigen dienst op het open web publiceert, en wie op delen klikt geeft toestemming voor verstrekking aan een gekozen ontvanger, niet voor publicatie en indexering. Dat zijn twee verschillende verwerkingen, en instemmen met de eerste dekt de tweede niet.
Het werk van deze week bestaat er niet in te wachten op een verklaring van de leverancier. Breng elk oppervlak in uw bedrijf in kaart dat inhoud verandert in een link die een vreemde in handen kan hebben: gedeelde chats die uw medewerkers in AI-tools aanmaken, de deelfunctie van uw eigen product, exports uit uw ticketsysteem, gegenereerde cliëntrapporten. Bevestig voor elk ervan dat de pagina bereikbaar is voor crawlers en een uitdrukkelijke noindex draagt, in plaats van zich te verschuilen achter een blokkade die stilzwijgend het tegendeel garandeert. Draai daarna de site:-operator op uw eigen domeinen en lees wat er terugkomt. De Autoriteit Persoonsgegevens beoordeelt de melding op de feitelijke blootstelling, niet op de huidige stand van de zoekmachine.
Lees hierna: Cognizant leidde 30.000 van 350.000 op in Claude | Claudes storingen worden pas in 2027 verholpen



