В сюжетном повороте, который не удивит никого, кто следил за подходом ИИ-индустрии «собирай все данные, вопросы задавай потом», xAI Илона Маска столкнулся с иском, утверждающим, что его модели Grok были обучены на материалах с жестоким обращением с детьми (CSAM). Жалоба, поданная в среду истцом, идентифицированным только как Джейн Доу, утверждает, что изображения ее жестокого обращения в детстве - сделанные в начале 2000-х, когда ей было дошкольного возраста - были использованы для обучения возможностей Grok по генерации изображений и видео.
Изображения Доу давно хэшированы такими группами, как Национальный центр пропавших и эксплуатируемых детей (NCMEC) и Канадский центр защиты детей (CCCP), чтобы помочь идентифицировать и удалять такой контент. Она получает уведомления от Системы уведомления жертв Министерства юстиции США всякий раз, когда она может быть жертвой в новом расследовании. Так что можно представить ее шок, когда CCCP уведомил ее, что сгенерированный ИИ CSAM с ее изображением был найден на xAI. В жалобе утверждается, что на онлайн-форумах были «преступники, болтающие о создании сгенерированного ИИ CSAM с изображением Истицы и других известных, давних жертв CSAM».
Теперь Доу опасается, что xAI не только облегчил создание дополнительных изображений самого ужасного времени в ее жизни, но и что компания хранила и использовала эти сгенерированные ИИ выходные данные для дальнейшего обучения Grok. Жалоба предполагает, что Grok мог быть обучен как на оригинальных изображениях, которые преследовали ее более 20 лет, так и на недавно сгенерированных ИИ.
Это первый случай, когда xAI обвиняют в обучении на CSAM, но в жалобе не хватает деталей по этому конкретному утверждению. В ней отмечается, что изображения Доу были частью списка хэшей CSAM, поддерживаемого NCMEC, и «тот же материал» предположительно «был частью набора данных, который xAI использовал для создания возможностей Grok по генерации изображений и видео». В жалобе также указывается, что, хотя xAI отфильтровывает жестокий контент из обучающих данных, его условия явно не исключают CSAM, интимные изображения без согласия (NCII) или материалы NSFW. И поскольку технически сложно удалить влияние обучающего примера из уже обученной модели, любой CSAM, поглощенный до удаления, вероятно, продолжал формировать выходные данные Grok.
Предлагаемый коллективный иск Доу стремится представлять каждую жертву, чьи детские изображения были использованы для генерации CSAM Grok. Он обвиняет X в нарушении федеральных законов о детской порнографии и закона Маши, оба из которых дают выжившим CSAM право на подачу иска. Адвокат Доу, Маргарет Э. Мэйби, предположила, что «xAI сделал все три» - производство, хранение и распространение.
Если Доу выиграет, xAI может задолжать компенсацию каждой жертве, которая сможет доказать, что Grok сгенерировал CSAM на основе их реальных фотографий. Доу также хочет, чтобы суд обязал xAI уничтожить все сгенерированные Grok CSAM и заблокировать Grok от генерации любых сексуализированных выходных данных, включая NSFW «фотографии в бикини», которые продвигал Маск. Сара Лондон, другой адвокат Доу, заявила в пресс-релизе, что Доу «жила почти два десятилетия, зная, что изображения худшего, что с ней случилось, циркулируют среди хищников в интернете, и что они могут всплыть в любой момент. xAI должен быть привлечен к ответственности за сознательное обучение своих моделей на изображениях ужасного насилия, которое она пережила, и на изображениях насилия каждой другой выжившей в этом классе».
X не ответил на запрос Ars о комментарии - потому что зачем комментировать, когда можно просто позволить правовой системе разобраться?