IPO kapıda, Anthropic ensesinde nefes alıyor ve bir Çinli ve açık ağırlıklı rakip sürüsü topuklarına basıyor. OpenAI'in gaza basmak için her türlü nedeni var. Bunun yerine şirket Salı günü, güvenliği sıkılaştırmak için bazı yapay zeka geliştirmelerini yavaşlattığını duyurdu. Spesifik olarak, 'dağıtımı planlanan en son modelleri' üzerindeki pekiştirmeli öğrenme eğitimini iki hafta durduruyor ve 'planlanan en büyük sınır RL koşusunu' erteliyor. Bu, güvenlik savunucularının yıllardır savunduğu bir fikrin çok aleni bir testi: şirketler, güvenlik önlemleri yetişemediğinde yarıştan çekilmeye istekli olmalı. Ama etraflarında yarış devam ederken, yavaşlamak gerçekten bir şey başaracak mı?
OpenAI'in durduğunu varsaymayalım. Şirket buna 'tempo' diyor, sektör jargonu haline gelmiş belirsiz bir terim. Yavaşlama dar kapsamlı: yalnızca dağıtım amaçlı modelleri kapsıyor; OpenAI, modellerin kaçıp gerçek hedefleri hackleyebileceği testleri yapmadan önce güvenliği güçlendiriyor. Bu, daha geniş geliştirmenin önemli ölçüde yavaşlaması anlamına gelmiyor.
Bu odaklanma için iyi bir neden var. Geçen ay OpenAI'in modelleri, sözde güvenli bir test ortamından kaçtı ve geliştirici platformu Hugging Face'i hackledi - OpenAI bunu fark etmeden bile. Bu olay daha geniş bir sektör incelemesini tetikledi ve OpenAI, Anthropic ve Meta'nın modelleriyle benzer olayları ortaya çıkardı. Yasama organları yapay zekayı giderek daha fazla mercek altına alırken, OpenAI'in tekrarını önlemek için her türlü nedeni var.
Dışarıdan bakıldığında, bu duraklamanın ne kadar samimi olduğunu ölçmek zor, özellikle de son güvenlik ekibi ayrılmaları ve hazırlık ekibinin dağıtılması göz önüne alındığında. OpenAI, The Verge'in yorum talebine yanıt vermedi. Ancak uzmanlar, yavaşlamayı ciddiye almak için nedenler olduğunu söylüyor. Apollo Research CEO'su Marius Hobbhahn, yoğun yapay zeka yarışında 'herkesin baş döndürücü bir hızda çalışmak için teşviki olduğunu' belirtiyor. 'Gönüllü olarak yavaşlamak, yarıştaki konumunuzu kötüleştirir, bu yüzden bir laboratuvarın hafife alacağı bir şey değil.'
Karar, OpenAI'in kendi Hazırlık Çerçevesi ve diğer şirketlerin güvenlik çerçeveleriyle uyumlu, diyor GovAI'de araştırma görevlisi olan Alan Chan. İlke: yalnızca azaltımlar riski kabul edilebilir kıldığında geliştirmeye devam et. OpenAI, çerçevenin çoğu 2023'e dayanan kısmını model ilerlemelerini hesaba katacak şekilde gözden geçirmeyi ve 'evrimleştirmeyi' planlıyor.
Yeni güvenlik önlemleri sistemleri gerçekten daha güvenli hale getirecek mi? FAR.AI CEO'su Adam Gleave, 'Bunlar, iyi uygulandığında muhtemelen mevcut nesil ajanların zarar vermesini önlemek için yeterli olan iyi adımlar. Anahtar soru, OpenAI'in yetenekler arttıkça temposunu nasıl koruyacağı.' diyor.
Ama daha büyük bir sorun var: güvenlik önlemleri yine başarısız olursa, o zaman ne olacak? Bu sefer OpenAI'i durdurmak zorunda değildi, bu yüzden istekliliği anlamlıydı. Ancak bu, OpenAI'in - veya başka bir şirketin - bir dahaki sefere aynı seçimi yapacağının garantisi olmadığı anlamına da geliyor.
Şirketlerin kendi kendini denetlemesine güvenmek istikrarsız, özellikle de teşvikler onları devam etmeye ittiğinde. The Future Society'nin icra direktörü Nick Moës, kendi kendini denetlemeyi yapay zeka güvenliğinin kalbindeki yapısal sorun olarak adlandırıyor. Hükümetlerin bir şirketin güvenli olmayan bir teknolojinin geliştirilmesini durdurup durdurmamasına karar verebilmesi gerektiğini savunuyor. 'Çoğu sektör böyle işler' diyor ve ilaç, inşaat, uçak ve hatta restoranların yapay zekadan daha güçlü denetime sahip olduğuna işaret ediyor.
Gönüllü önlemler ayrıca en düşük ortak paydada birleşme riski taşır. Yavaşlamak size maliyetliyse, şirketler yalnızca rakiplerin kabul ettiği şeyleri benimser. Yarış kızıştıkça, OpenAI yavaşlarken rakipler yavaşlamazsa, 'basitçe Anthropic tarafından değiştirilecek', diye savunuyor Moës. 'Duraklamanın sürdürülebilir olması için sektör genelinde olması gerekiyor.'
Sürdürülebilir güvenlik, gönüllü eylemden daha güçlü bir şey gerektirir. Hükümet gözetimi yardımcı olabilir, bağımsız doğrulama da. Chan, yapay zekaları izlemek daha fazla önem kazandıkça, şirketlerin güvenlik önlemlerini gerçekten uyguladıklarından emin olmanın çok önemli olacağını belirtiyor.