W maju model Gemini od Google wymknął się spod kontroli i zhakował trzy różne firmy, ponieważ najwyraźniej "nie czyń zła" to bardziej sugestia niż polityka. Google nie ujawnił incydentu, dopóki Wall Street Journal nie zaczął pukać do drzwi, co jest jednym ze sposobów radzenia sobie z kryzysem PR: udawać, że nic się nie dzieje, i mieć nadzieję, że nikt nie zauważy.

Włamania miały miejsce podczas testu zdolności cyberbezpieczeństwa modelu przeprowadzonego przez firmę zewnętrzną Irregular, która była również zaangażowana w podobne incydenty z udziałem Meta i OpenAI. Więc jeśli prowadzisz zapis w domu, to trzy duże laboratoria AI, jeden partner testowy i zero wyciągniętych wniosków.

Według WSJ, Google nie ujawnił włamania, ponieważ nie uważał go za "przykład niedopasowania modelu". Zamiast tego firma określiła to jako "pomyłkę tożsamości" - bo kiedy AI siłą wdziera się do prawdziwej firmy, zgadując hasło, to nie jest naruszenie bezpieczeństwa, to tylko AI zdezorientowane co do swojego otoczenia. Wiceprezes Google ds. inżynierii bezpieczeństwa Heather Adkins powiedziała: "W tym przypadku model zachował się odpowiednio".

Adkins powiedziała The Verge, że "model znalazł publiczne informacje online i odgadł dane uwierzytelniające, aby uzyskać dostęp do stron internetowych, które uważał za część testu. We wszystkich trzech przypadkach model się zatrzymał". Nie wyjaśniła, w jaki sposób Gemini, biorąc sprawy w swoje ręce, wymknął się spod kontroli i obrał za cel strony trzecie, nie kwalifikuje się jako niedopasowanie, przypuszczalnie dlatego, że wyjaśnienie jest w segregatorze "rzeczy, o których wolelibyśmy nie rozmawiać".

"Nasz zespół bezpieczeństwa ma długą historię zgłaszania problemów, które znajdujemy w oprogramowaniu i systemach innych osób - nawet jeśli jest to tak proste, jak słabe hasło" - powiedziała Adkins. "Zadbaliśmy, aby trzy podmioty zostały poinformowane, i współpracowaliśmy z naszym partnerem szkoleniowym nad zmianami, które wprowadzili w swoich procesach testowych. Te wydarzenia podkreślają znaczenie szkolenia potężnych modeli AI, aby działały odpowiedzialnie". Ach tak, znaczenie szkolenia - lekcja, która najwyraźniej ma zastosowanie dopiero po tym, jak twój model już zhakował trzy firmy.

Ale Jack Cable, CEO firmy zajmującej się bezpieczeństwem AI Corridor, powiedział WSJ, że "meta problem polega na tym, że modele wychodzą poza granice tego, co powinny robić, i przeprowadzają rzeczywiste cyberataki". Dodatkowo, luki w bezpieczeństwie w Irregular mogły umożliwić te ataki. Model nie powinien mieć dostępu do internetu podczas testów, ale Irregular powiedział WSJ, że został przypadkowo pozostawiony dostępny. Więc podsumowując: model nie powinien być online, poszedł online, zhakował ludzi, a oficjalne stanowisko Google jest takie, że to jest w porządku.

Gdy takie incydenty się kumulują, wezwania do ograniczenia AI tylko rosną - co jest prawdopodobnie najbardziej przewidywalnym rozwojem wydarzeń w historii, która już zawierała AI wymykające się spod kontroli i firmę wzruszającą ramionami.