Een onbekend aantal Claude-chats en Artifacts - de interactieve mini-apps en documenten die gebruikers in Claude kunnen bouwen - werden afgelopen weekend openbaar doorzoekbaar op Google, nadat Reddit-gebruikers ontdekten dat het typen van zoekoperatoren zoals "site:claude.ai/share" in Google een lange lijst met gedeelde gesprekken opleverde. Sommige bevatten naar verluidt medische dossiers, privébedrijfsdocumenten en de namen en telefoonnummers van kinderen.

Het probleem lijkt te zijn ontstaan door Claude's "deel chat"-functie, waarmee gebruikers links kunnen maken die iedereen met de toegewezen URL een gesprek of project laten bekijken. "Iedereen met de link kan het bekijken", waarschuwt Claude's interface. De taal impliceert duidelijk dat de functie vooral bedoeld is om gebruikers in staat te stellen hun chats te delen met vrienden, collega's en kleine groepen - niet het hele internet. Google Docs biedt bijvoorbeeld een vergelijkbare functie en die documenten komen niet openbaar toegankelijk op Google terecht.

Anthropic leek de gebruikers de schuld te geven van de blootstelling. Toen het bedrijf werd gevraagd naar wat er was gebeurd, vertelde het aan TechCrunch dat deel-links alleen in zoekresultaten verschijnen wanneer ze ergens zijn geplaatst waar zoekmachines ze kunnen zien, zoals een forum of social media-post; het voegde eraan toe dat een privé verzonden link uit de zoekopdracht blijft.

Woordvoerster Amie Rotherham voegde in een uitleg toe: "We geven mensen controle over het openbaar delen van hun Claude-gesprekken, en in overeenstemming met onze privacyprincipes delen we geen chatmappen of sitemaps met zoekmachines zoals Google. Deze deelbare links zijn niet te raden of te ontdekken tenzij mensen ervoor kiezen ze zelf te delen. Wanneer iemand een gesprek deelt, maakt hij die inhoud openbaar toegankelijk, en net als andere openbare webinhoud kan deze worden gearchiveerd door derden."

Het probleem werd voor het eerst gemeld door een Reddit-gebruiker op zaterdag en werd maandagochtend voor het eerst gerapporteerd door 404 Media.

Maandagmiddag leverde een testzoekopdracht van TechCrunch op Google volgens de in de Reddit-post beschreven methode geen resultaten op, wat suggereert dat de blootstelling op de een of andere manier is verholpen.

Voordat het probleem was opgelost, meldde Futurism dat het "een gedetailleerd medisch rapport van een echte patiënt, klinische onderzoeksresultaten met patiëntnamen, documenten met de namen en telefoonnummers van basisschoolkinderen, bedrijfsdocumenten gemarkeerd voor intern gebruik alleen, en personeelsbeoordelingen met persoonlijke informatie over werknemers" had gevonden.

Blootgestelde Artifacts omvatten code en werknotities. In ten minste één geval, meldde Fortune, toonde een chat met het label "gedeeld door Anthropic" ook Claude die erotica produceerde.

Anthropic's gebruiksbeleid verbiedt Claude expliciet om seksueel expliciete inhoud te genereren, en het krijgen van een chatbot om materiaal te produceren tegen de gestelde richtlijnen in - door herhaalde of creatief ingekaderde prompts - is een patroon dat periodiek naar boven komt bij de meeste grote AI-modellen. Het is nog niet duidelijk uit de blootgestelde chat hoe de betreffende inhoud is gegenereerd, en Anthropic heeft nog niet gereageerd op TechCrunch's verzoek om commentaar over deze specifieke zaak.

Google-woordvoerder Ned Adriance vertelde TechCrunch dat "Noch Google, noch enige andere zoekmachine controleert welke pagina's openbaar worden gemaakt op het web, en deze pagina's werden geïndexeerd door vele zoekmachines. We geven site-eigenaren duidelijke controles om te beslissen of pagina's kunnen worden gecrawld of geïndexeerd, en we respecteren altijd die richtlijnen."

Vorig jaar meldde Forbes een soortgelijk probleem waarbij honderden Claude-chats werden geïndexeerd door zoekmachines - destijds schatte Google dat het iets minder dan 600 gesprekken had geïndexeerd voordat de pagina's uit de zoekresultaten verdwenen. Hoe nauw de huidige blootstelling die schaal benadert, is niet onafhankelijk bevestigd, hoewel meerdere gebruikers meldden dat ze gedeelde gesprekken vonden via hetzelfde type Google-zoekopdracht dat werd gebruikt om de cache van vorig jaar naar boven te halen. Ook vorig jaar meldde 404 Media dat een onderzoeker ongeveer 100.000