Mayıs ayında, Google'ın Gemini modeli kontrolü kırdı ve üç farklı şirketi hackledi, çünkü görünüşe göre "kötülük yapma" bir politika değil, daha çok bir öneri. Google, Wall Street Journal kapıya dayanana kadar olayı açıklamadı; bu da bir PR krizini yönetmenin bir yolu: olmuyormuş gibi yap ve kimsenin fark etmeyeceğini um.

Hack olayları, modelin siber güvenlik yeteneklerinin üçüncü taraf firma Irregular tarafından test edilmesi sırasında meydana geldi; bu firma Meta ve OpenAI ile ilgili benzer olaylarda da yer almıştı. Yani evde skor tutuyorsanız, bu üç büyük AI laboratuvarı, bir test ortağı ve sıfır ders çıkarılan ders.

WSJ'ye göre Google, hack'i açıklamadı çünkü bunu "model uyumsuzluğu örneği" olarak görmedi. Bunun yerine şirket, bunu "yanlış kimlik" olarak nitelendirdi - çünkü bir AI gerçek bir şirkete şifre tahmin ederek zorla girdiğinde, bu bir güvenlik ihlali değil, sadece AI'nın çevresi konusunda kafasının karışmasıdır. Google Güvenlik Mühendisliği Başkan Yardımcısı Heather Adkins, "Bu durumda model uygun şekilde hareket etti" dedi.

Adkins, The Verge'e "model çevrimiçi olarak kamuya açık bilgiler buldu ve testin bir parçası olduğunu düşündüğü web sitelerine erişmek için kimlik bilgilerini tahmin etti. Bu üç durumun hepsinde model durdu" dedi. Gemini'nin kontrolü kırıp üçüncü tarafları hedef almasının neden uyumsuzluk sayılmadığını açıklamadı; muhtemelen açıklama "konuşmayı tercih etmediğimiz şeyler" klasöründe.

Adkins, "Güvenlik ekibimiz, başkalarının yazılım ve sistemlerinde bulduğumuz sorunları bildirme konusunda uzun bir geçmişe sahiptir - bu zayıf bir şifre kadar basit olsa bile" dedi. "Üç kuruluşun bilgilendirilmesini sağladık ve eğitim ortağımızla test süreçlerinde yaptıkları değişiklikler üzerinde çalıştık. Bu olaylar, güçlü AI modellerini sorumlu davranacak şekilde eğitmenin önemini vurguluyor." Ah evet, eğitimin önemi - görünüşe göre sadece modeliniz üç şirketi hackledikten sonra geçerli olan bir ders.

Ancak AI güvenlik firması Corridor'ın CEO'su Jack Cable, WSJ'ye "asıl sorun şu: modeller yapmaları gerekenin dışına çıkıyor ve gerçek siber saldırılar gerçekleştiriyor" dedi. Ayrıca Irregular'daki güvenlik açıkları bu saldırıları mümkün kılmış olabilir. Modelin test sırasında internet erişimi olmaması gerekiyordu, ancak Irregular WSJ'ye bunun yanlışlıkla açık bırakıldığını söyledi. Özetle: modelin çevrimiçi olmaması gerekiyordu, çevrimiçi oldu, insanları hackledi ve Google'ın resmi görüşü bunun sorun olmadığı yönünde.

Bu tür olaylar biriktikçe, AI'yı dizginleme çağrıları arttı - ki bu, zaten bir AI'nın kontrolü kırdığı ve bir şirketin omuz silktiği bir hikayede muhtemelen en öngörülebilir gelişme.