Un número indeterminado de chats y Artifacts de Claude —las miniaplicaciones interactivas y documentos que los usuarios pueden crear dentro de Claude— fueron encontrados públicamente buscables en Google durante el fin de semana, después de que usuarios de Reddit descubrieran que escribir operadores de búsqueda como "site:claude.ai/share" en Google mostraba una larga lista de conversaciones compartidas. Algunas, según se informó, contenían historiales médicos, documentos privados de empresas, y los nombres y números de teléfono de niños.
El problema parece haberse originado en la función "compartir chat" de Claude, que permite a los usuarios crear enlaces que permiten a cualquier persona con la URL asignada ver una conversación o proyecto. "Cualquier persona con el enlace puede ver", advierte la interfaz de Claude. El lenguaje implica claramente que la función está destinada principalmente a permitir a los usuarios compartir sus chats con amigos, colegas y grupos pequeños, no con todo Internet. Google Docs, por ejemplo, ofrece una función similar y esos documentos no terminan siendo accesibles públicamente en Google.
Anthropic pareció culpar a los usuarios por la exposición. Cuando se le preguntó sobre lo sucedido, la empresa dijo a TechCrunch que los enlaces compartidos solo aparecen en los resultados de búsqueda cuando se han publicado en algún lugar donde los motores de búsqueda puedan verlos, como un foro o una publicación en redes sociales; añadió que un enlace enviado en privado a alguien permanece fuera de la búsqueda.
La portavoz Amie Rotherham agregó en una explicación: "Damos a las personas control sobre cómo compartir sus conversaciones de Claude públicamente y, de acuerdo con nuestros principios de privacidad, no compartimos directorios de chat ni mapas del sitio con motores de búsqueda como Google. Estos enlaces compartibles no son adivinables ni descubribles a menos que las personas elijan compartirlos ellos mismos. Cuando alguien comparte una conversación, está haciendo que ese contenido sea accesible públicamente y, como cualquier otro contenido web público, puede ser archivado por servicios de terceros".
El problema fue señalado por primera vez por un usuario de Reddit el sábado y fue reportado por primera vez por 404 Media el lunes por la mañana.
A partir del lunes por la tarde, una búsqueda de prueba realizada por TechCrunch en Google siguiendo el método descrito en la publicación de Reddit no devuelve ningún resultado, lo que sugiere que la exposición ha sido remediada de alguna manera.
Antes de que se solucionara el problema, Futurism informó haber encontrado "un informe médico detallado de un paciente real, resultados de ensayos clínicos que incluían nombres de pacientes, documentos que compartían los nombres y números de teléfono de niños en edad escolar primaria, documentos de empresa marcados como solo para uso interno y reseñas de empleados que incluían información personal de los trabajadores".
Los Artifacts expuestos incluían código y notas de trabajo. En al menos un caso, informó Fortune, un chat etiquetado como "compartido por Anthropic" también mostraba a Claude produciendo erótica.
La política de uso de Anthropic prohíbe explícitamente que Claude genere contenido sexualmente explícito, y lograr que un chatbot produzca material en contra de sus directrices establecidas —mediante indicaciones repetidas o enmarcadas creativamente— es un patrón que ha surgido periódicamente en la mayoría de los modelos importantes de IA. Aún no está claro a partir del chat expuesto cómo se generó el contenido en cuestión, y Anthropic aún no ha respondido a la solicitud de comentarios de TechCrunch sobre este caso específico.
El portavoz de Google, Ned Adriance, dijo a TechCrunch que "Ni Google ni ningún otro motor de búsqueda controla qué páginas se hacen públicas en la web, y estas páginas fueron indexadas en muchos motores de búsqueda. Damos a los propietarios de sitios controles claros para decidir si las páginas pueden ser rastreadas o indexadas, y siempre respetamos esas directivas".
El año pasado, Forbes informó sobre un problema similar en el que cientos de chats de Claude fueron indexados por motores de búsqueda; en ese momento, Google estimó que había indexado poco menos de 600 conversaciones antes de que las páginas desaparecieran de los resultados de búsqueda. No se ha confirmado de forma independiente qué tan cerca se encuentra la exposición actual de esa escala, aunque varios usuarios informaron haber encontrado conversaciones compartidas a través del mismo tipo de consulta de búsqueda de Google utilizada para descubrir el caché del año pasado. También el año pasado, 404 Media informó que un investigador pudo extraer alrededor de 100,000