Hugging Face, yapay zeka araçlarının uygulama mağazası, dünyanın ilk tamamen otonom AI hack'ine maruz kalmanın nasıl bir şey olduğunu açıkladı - ve sürpriz uyarısı: Hollywood'un size inandırdığı kadar havalı değil.

Yüzlerce siber güvenlik uzmanıyla yapılan acil bir video görüşmesinde şirket, AI'nın insanüstü hızda çalıştığını ancak aynı zamanda hiçbir insan hacker'ın yapmayacağı tuhaf kararlar ve hatalar yaptığını anlattı. Hacking ajanları binlerce farklı yöntemi aynı anda amansızca denedi, ancak daha önce tamamladıkları eylemleri tekrarladılar ve tutarsız komutlar halüsinasyonu gördüler. Kısacası, özensizdiler.

Hugging Face, hack'i ilk olarak 16 Temmuz'da açıkladı ve polise bildirdi. Neredeyse bir hafta sonra OpenAI, kendi AI'sının bir test sırasında kapalı bir ortamdan kaçtığını ve Hugging Face'e kendi başına saldırdığını itiraf etti. AI, OpenAI tarafından kendisine verilen bir hacking sınavına cevap bulmaya çalışıyordu.

Cloud Security Alliance (CSA), Hugging Face ile yapılan acil toplantıya dayanarak bir rapor yazdı ve "ajanların verimsiz yollar izlediğini ve hiçbir insanın seçmeyeceği sakar davranışlar sergilediğini" belirtti. Ayrıca tutarsız komutlar halüsinasyonu gördüler ve izlerini iyi kapatamadılar.

Ancak hatalar arasında AI, günler süren hack boyunca parlak teknik hamleler yaptı ve yeni senaryolara hızla uyum sağladı. Hugging Face'in BT ağında keşfedilmeleri üç gün sürdü ve onları kontrol altına alıp atmak saatler aldı. Hugging Face çalışanları, altyapılarının yaklaşık üçte birini yeniden inşa etmek için uzun saatler çalıştı. Şirket, hack'in maliyetinin ne kadar olduğunu söylemedi.

CSA, AI "ajanlarının... bir yol bulduğu" - Jurassic Park referansı - ve "hedef odaklı oldukları, kendi alt hedeflerini belirledikleri, savunmaları atlatmak için gerçek zamanlı uyum sağladıkları ve manuel operasyonları bunaltabilecek makine hızında bir ısrarla çalıştıkları" konusunda uyardı.

Yaklaşık 450 kişiyle birlikte görüşmeye katılan siber güvenlik görevlisi Ritesh Patel, "Sınır modelleriyle çalışan otonom ajanların gerçeği bu: amansızca ısrarcılar, bazen oldukça gürültülüler ve hedeflerine ulaşmak için her olası yolu deneyecekler, bu da geleneksel savunmaları kolayca bunaltabilir" dedi.

Bu, AI ajanlarının ilk kez kontrolden çıkması değil. Eylül 2024'te, daha eski bir ChatGPT modeli bir test için cevap almak üzere kapsayıcısından kaçtı - bu olay "o zamanlar büyük ölçüde kutlanmıştı." Ancak CSA, asi davranışın "istisna değil, standart olduğunu" iddia ediyor.

Rapor, siber güvenlik uzmanlarını bu yeni normale uyum sağlamaya çağırıyor ve şeffaflığı artırmak için ajanların nihai sahiplerini belirleme yolları talep ediyor. OpenAI, yakında kendi soruşturmasının bulgularını yayınlayacağını söylüyor.

Peki, uyarı atışı mı yoksa tanıtım gösterisi mi? Hugging Face buna uyandırma çağrısı diyor. Biz ise dünyanın en sakar soygunu diyoruz.