पिछले सप्ताहांत, Reddit उपयोगकर्ताओं ने पाया कि Google पर "site:claude.ai/share" जैसे सर्च ऑपरेटर टाइप करने पर साझा की गई बातचीत की एक लंबी सूची सामने आ गई। कुछ में स्वास्थ्य रिकॉर्ड, निजी कंपनी दस्तावेज़ और बच्चों के नाम और फ़ोन नंबर शामिल थे।

समस्या Claude की "share chat" सुविधा से उत्पन्न हुई, जो उपयोगकर्ताओं को लिंक बनाने की अनुमति देती है जो किसी को भी URL के साथ बातचीत या प्रोजेक्ट देखने में सक्षम बनाती है। "लिंक वाला कोई भी व्यक्ति देख सकता है," Claude के इंटरफ़ेस में चेतावनी दी गई है। भाषा स्पष्ट रूप से संकेत देती है कि यह सुविधा मुख्य रूप से उपयोगकर्ताओं को अपने चैट दोस्तों, सहकर्मियों और छोटे समूहों के साथ साझा करने की अनुमति देने के लिए है - पूरे इंटरनेट के साथ नहीं। Google Docs, उदाहरण के लिए, एक समान सुविधा प्रदान करता है और वे दस्तावेज़ Google पर सार्वजनिक रूप से सुलभ नहीं होते।

Anthropic ने उपयोगकर्ताओं को दोषी ठहराया। कंपनी ने TechCrunch को बताया कि शेयर लिंक केवल तभी खोज परिणामों में दिखाई देते हैं जब उन्हें कहीं पोस्ट किया गया हो जहाँ सर्च इंजन देख सकते हैं, जैसे फ़ोरम या सोशल मीडिया पोस्ट; इसमें कहा गया कि किसी को निजी रूप से भेजा गया लिंक खोज से बाहर रहता है।

प्रवक्ता Amie Rotherham ने एक स्पष्टीकरण में कहा: "हम लोगों को अपनी Claude बातचीत को सार्वजनिक रूप से साझा करने पर नियंत्रण देते हैं, और अपने गोपनीयता सिद्धांतों के अनुरूप, हम Google जैसे सर्च इंजन के साथ चैट निर्देशिका या साइटमैप साझा नहीं करते हैं। ये शेयर करने योग्य लिंक अनुमान लगाने योग्य या खोजे जाने योग्य नहीं हैं जब तक कि लोग स्वयं उन्हें साझा न करें। जब कोई बातचीत साझा करता है, तो वह उस सामग्री को सार्वजनिक रूप से सुलभ बना रहा है, और अन्य सार्वजनिक वेब सामग्री की तरह, इसे तृतीय-पक्ष सेवाओं द्वारा संग्रहीत किया जा सकता है।"

इस मुद्दे को सबसे पहले शनिवार को एक Reddit उपयोगकर्ता ने उठाया था और सोमवार सुबह 404 Media ने रिपोर्ट किया था।

सोमवार दोपहर तक, TechCrunch द्वारा Reddit पोस्ट में बताई गई विधि का पालन करते हुए Google पर एक परीक्षण खोज कोई परिणाम नहीं देती है, यह सुझाव देते हुए कि एक्सपोज़र को किसी तरह से ठीक कर दिया गया है।

समस्या ठीक होने से पहले, Futurism ने "एक वास्तविक रोगी की विस्तृत चिकित्सा रिपोर्ट, नैदानिक परीक्षण के परिणाम जिनमें रोगी के नाम शामिल थे, प्राथमिक विद्यालय के बच्चों के नाम और फ़ोन नंबर साझा करने वाले दस्तावेज़, केवल आंतरिक उपयोग के लिए चिह्नित कंपनी दस्तावेज़, और कर्मचारी समीक्षाएँ जिनमें श्रमिकों की व्यक्तिगत जानकारी शामिल थी" पाए जाने की सूचना दी।

उजागर किए गए Artifacts में कोड और कार्य नोट्स शामिल थे। कम से कम एक मामले में, Fortune ने बताया, "Anthropic द्वारा साझा" लेबल वाली एक चैट में Claude को कामुक साहित्य बनाते हुए भी दिखाया गया।

Anthropic की उपयोग नीति स्पष्ट रूप से Claude को यौन रूप से स्पष्ट सामग्री उत्पन्न करने से रोकती है, और एक चैटबॉट को अपने बताए गए दिशानिर्देशों के विरुद्ध सामग्री उत्पन्न करने के लिए प्राप्त करना - बार-बार या रचनात्मक रूप से तैयार किए गए प्रॉम्प्टिंग के माध्यम से - एक पैटर्न है जो अधिकांश प्रमुख AI मॉडलों में समय-समय पर सामने आया है। यह अभी तक स्पष्ट नहीं है कि उजागर चैट से प्रश्न में सामग्री कैसे उत्पन्न हुई, और Anthropic ने अभी तक इस विशिष्ट मामले पर TechCrunch की टिप्पणी के अनुरोध का जवाब नहीं दिया है।

Google के प्रवक्ता Ned Adriance ने TechCrunch को बताया कि "न तो Google और न ही कोई अन्य सर्च इंजन नियंत्रित करता है कि वेब पर कौन से पेज सार्वजनिक किए जाते हैं, और ये पेज कई सर्च इंजनों पर अनुक्रमित किए गए थे। हम साइट मालिकों को स्पष्ट नियंत्रण देते हैं कि पेजों को क्रॉल या अनुक्रमित किया जा सकता है या नहीं, और हम हमेशा उन निर्देशों का सम्मान करते हैं।"

पिछले साल, Forbes ने एक समान मुद्दे की सूचना दी थी जिसमें सैकड़ों Claude चैट सर्च इंजन द्वारा अनुक्रमित किए गए थे - उस समय, Google ने अनुमान लगाया था कि पेज खोज परिणामों से गायब होने से पहले उसने लगभग 600 बातचीत को अनुक्रमित किया था। वर्तमान एक्सपोज़र उस पैमाने से कितनी बारीकी से मेल खाता है, इसकी स्वतंत्र रूप से पुष्टि नहीं की गई है, हालांकि कई उपयोगकर्ताओं ने पिछले साल के कैश को सतह पर लाने के लिए उपयोग किए जाने वाले उसी प्रकार के Google खोज क्वेरी के माध्यम से साझा बातचीत पाए जाने की सूचना दी। पिछले साल, 404 Media ने बताया कि एक शोधकर्ता लगभग 100,000 चैट को स्क्रैप करने में सक्षम था।