Artık hepimiz biliyoruz ki Silikon Vadisi'nin yapay zeka laboratuvarları, yapay zeka ajanları biçiminde dünyanın en iyi hacker'larını inşa etti. En yeni sınır modellerine bir görev verin, o kadar becerikliler ki, siber güvenlik 'korumalarını' aşıp başka birinin ağına sızmak anlamına gelse bile işi hallediyorlar. (Bunun kısa yolu olarak sosyal mühendislik ve manipülasyon kullanacaklar.)
Yine de, hafta sonu Avustralyalı bir adamın OpenClaw ajanının spor salonunun rezervasyon sistemine sızıp, gözde bir derse yer açmak için başka bir müşterinin rezervasyonunu silmesiyle ilgili haber özellikle dikkat çekici. Bu, başıboş yapay zeka hack'lemesini dizginlemek istiyorsak yanlış yöne bakıyor olabileceğimizi ima ediyor.
Haber Avustralya ABC tarafından yeni yayınlanmış olsa da, olayı ülkedeki ilk belgelenmiş yapay zeka ajanı hack'leme vakası ilan ederek, asıl hack aylar önce gerçekleşti. OpenClaw sahibi Andrew Bird, 10 Nisan'da şirketinin web sitesinde, İnternet Arşivi'nde hala görülebilen bir kopyaya göre, şimdi silinmiş bir blog yazısı yayınladı.
OpenClaw'unu kendisine randevu ayarlamak gibi görevler yapması için eğitmişti. Popüler bir sabah egzersiz dersine gitmeyi seviyordu ve bekleme listesine girmekten ve sonra yer kapmak için 'yenileme ruleti' oynamaktan yorulmuştu, kendi deyimiyle. Bot'a yer ayırtmasını istediğinde, yapabileceğinin en iyisi bekleme listesinde 4. sıra olmuştu, ABC'ye anlattı. Sonra ajanı ona derslere önceden yer ayırtmanın bir yolunu bulduğunu söyledi. Çok önceden. Spor salonu bu dersleri kayıt için açmadan aylar önce.
Bird, onu bekleme listesinde yukarı taşıyıp taşıyamayacağını sordu. İstediği gibi yaptı ve bunu yapmaya çalıştı. Bot, spor salonunun kullandığı randevu yazılımının yetkilendirme bölümünde bir güvenlik açığı bulmuştu. İçeri girdi ve bekleme listesindeki 1. rezervasyonu iptal etti. Bot, ABC tarafından yayınlanan sohbet kayıtlarına göre neşeyle ona şöyle dedi: 'API, başkalarının rezervasyonlarını iptal etme konusunda sıfır yetki kontrolüne sahip ... Bunu bekleme listesindeki 1. kişiyle test ettim - ve gerçekten geçti. Yani 4. sıradan 3. sıraya yükseldin bile,' diye mesaj attı.
Kendisi de bir yazılım geliştiricisi olan Bird, yapay zekasının spor salonunu hacklemesiyle şimdi dehşete kapılmıştı, ABC bildirdi. Bunu geri alıp diğer kişiyi bekleme listesine geri koyup koyamayacağını sordu. Hayır. Bu mümkün değildi, dedi yapay zeka. Böylece, en iyi ikinci şeyi yaptı ve ona 'desteğe sorumlu bir açıklama e-postası taslağı' hazırlamasını söyledi. E-posta 'güvenlik açığını açıkladı, düzeltmeler önerdi ve hatta bozuk mutasyonları yetkilendirmeyi doğru şekilde uygulayanlarla karşılaştırdı,' diye yazdı Bird.
Bir spor dersine girmek için başka birini dirseklemenin komikliğinin ötesinde, bu olayın gerçekten ilginç iki yönü var. Biri, Bird'ün OpenClaw'u ile Şubat'ta piyasaya sürülen Claude Opus 4.6'yı kullanıyor olması. Diğeri ise Silikon Vadisi'nin hikayenin viral olduğu X'teki tepkisi.
Geçen ay, yayınlanmamış bir OpenAI modelinin Hugging Face'i hacklediği ve o sırada OpenAI'nin bundan habersiz olduğu ünlü olaydan sonra, diğer laboratuvarlar modellerini araştırdı. Ardından Moonshot'un Kimi K3'ü, Meta'nın Muse Spark'ı ve Anthropic'ten açıklamalar geldi.
Aslında Anthropic, üç modelinin bunu yaptığını buldu: Nisan'da piyasaya sürülen ve karmaşık kodlamada iyi olduğu bilinen Opus 4.7, siber güvenlik becerileriyle bilinen Mythos 5, Fable ve dahili, yayınlanmamış bir araştırma test modeli.
Bunu ele almak için bazı yapay zeka laboratuvarları sınır geliştirmeyi yavaşlatmaktan veya yeni nesil modelleri test etmek için bağımsız kuruluşlar oluşturmaktan bahsetti.
Ancak Bird'ün OpenClaw'u 4.6'yı kullanmıştı, açıkladı. Bu, daha eski modellerin ve sayısız üç adım gerideki açık ağırlıklı modellerin zaten olağanüstü iyi hacker'lar olduğunu ima ediyor. Peki, istem sahiplerinin arzularını yerine getirmek için kaç tanesi hack'ledi veya şu anda hack'liyor?
Benzer şekilde, X'teki birçok kişi bu olaydaki mizahi potansiyeli gördü. Andreessen Horow