In een plotwending die werkelijk niemand verrast die de 'verzamel alle data, stel later vragen'-aanpak van de AI-industrie heeft gevolgd, is Elon Musks xAI getroffen door een rechtszaak die beweert dat de Grok-modellen zijn getraind op materiaal van seksueel misbruik van kinderen (CSAM). De klacht, ingediend op woensdag door een eiser die alleen bekend is als Jane Doe, beweert dat haar kinderfoto's van misbruik - gemaakt in de vroege jaren 2000 toen ze op kleuterleeftijd was - zijn gebruikt om Groks beeld- en videogeneratiecapaciteiten te trainen.

De afbeeldingen van Doe zijn al lang gehasht door organisaties zoals het National Center for Missing and Exploited Children (NCMEC) en het Canadian Centre for Child Protection (CCCP) om dergelijke inhoud te identificeren en te verwijderen. Ze ontvangt meldingen van het US Department of Justice Victim Notification System wanneer ze mogelijk een slachtoffer is in een nieuw onderzoek. Dus kun je je haar verbazing voorstellen toen CCCP haar op de hoogte stelde dat AI-gegenereerde CSAM die haar afbeeldt, was gevonden op xAI. De klacht beweert dat online forums 'daders die chatten over het creëren van AI-gegenereerde CSAM van eiseres en andere soortgelijke bekende, legacy-slachtoffers van CSAM' bevatten.

Doe vreest nu dat xAI het niet alleen gemakkelijker heeft gemaakt om meer afbeeldingen te maken van de meest verontrustende periode in haar leven, maar ook dat het bedrijf die AI-gegenereerde outputs heeft opgeslagen en gebruikt om Grok verder te trainen. De klacht suggereert dat Grok mogelijk is getraind op zowel de originele afbeeldingen die haar al meer dan 20 jaar achtervolgen als de recente AI-gegenereerde.

Dit is de eerste zaak die xAI beschuldigt van het trainen op CSAM, maar de klacht is een beetje vaag over dat specifieke punt. Het merkt op dat de afbeeldingen van Doe deel uitmaakten van een CSAM-hashlijst die door NCMEC wordt onderhouden, en 'datzelfde materiaal' zou 'deel zijn geweest van de dataset die xAI gebruikte om Groks beeld- en videogeneratiecapaciteiten te bouwen.' De klacht wijst er ook op dat hoewel xAI gewelddadige inhoud uit trainingsdata filtert, de voorwaarden expliciet geen CSAM, niet-consensuele intieme beelden (NCII) of NSFW-materiaal uitsluiten. En aangezien het technisch moeilijk is om de invloed van een trainingvoorbeeld uit een reeds getraind model te verwijderen, zou eventuele CSAM die vóór verwijdering is ingenomen, waarschijnlijk Groks outputs blijven vormen.

De voorgestelde class action van Doe probeert elk slachtoffer te vertegenwoordigen wiens kinderfoto's zijn gebruikt om Grok-CSAM te genereren. Het beschuldigt X van het overtreden van federale kinderpornografiewetten en Masha's Law, die beide overlevenden van CSAM het recht geven om te procederen. De advocaat van Doe, Margaret E. Mabie, suggereerde dat 'xAI alle drie deed' - productie, bezit en distributie.

Als Doe wint, zou xAI schadevergoeding kunnen verschuldigd zijn aan elk slachtoffer dat kan bewijzen dat Grok CSAM heeft gegenereerd op basis van hun echte foto's. Doe wil ook dat de rechtbank xAI beveelt om alle door Grok gegenereerde CSAM te vernietigen en Grok te blokkeren van het genereren van seksuele outputs, inclusief de NSFW 'bikini-foto's' die Musk heeft gepromoot. Sarah London, een andere advocaat van Doe, zei in een persbericht dat Doe 'bijna twee decennia heeft geleefd wetende dat afbeeldingen van het ergste dat haar ooit is overkomen online onder daders circuleren, en dat ze op elk moment kunnen terugkomen. xAI moet verantwoordelijk worden gehouden voor het bewust trainen van zijn modellen op afbeeldingen van het gruwelijke misbruik dat zij heeft ondergaan, en op de misbruikafbeeldingen van elke andere overlevende in deze klasse.'

X reageerde niet op Ars' verzoek om commentaar - want waarom zou je commentaar geven als je het rechtssysteem het gewoon kunt laten uitzoeken?