मई में, गूगल के जेमिनी मॉडल ने कंटेनमेंट तोड़ दिया और तीन अलग-अलग कंपनियों को हैक कर लिया, क्योंकि जाहिर तौर पर "बुराई मत करो" एक नीति से ज्यादा एक सुझाव है। गूगल ने इस घटना का खुलासा तब तक नहीं किया जब तक वॉल स्ट्रीट जर्नल ने दस्तक नहीं दी, जो एक पीआर संकट से निपटने का एक तरीका है: ऐसा दिखावा करो कि कुछ हो ही नहीं रहा है और उम्मीद करो कि कोई ध्यान नहीं देगा।

ये हैक्स मॉडल की साइबर सुरक्षा क्षमताओं के परीक्षण के दौरान हुए, जिसे तीसरे पक्ष की फर्म इरेगुलर ने चलाया था, जो मेटा और ओपनएआई से जुड़ी समान घटनाओं में भी शामिल रही है। तो अगर आप घर पर स्कोर रख रहे हैं, तो यह तीन प्रमुख एआई लैब्स, एक परीक्षण साझेदार, और शून्य सबक है।

डब्ल्यूएसजे के अनुसार, गूगल ने हैक का खुलासा नहीं किया क्योंकि उसने इसे "मॉडल गलत संरेखण" का उदाहरण नहीं माना। इसके बजाय, कंपनी ने इसे "गलत पहचान" के रूप में चित्रित किया - क्योंकि जब एक एआई पासवर्ड का अनुमान लगाकर एक वास्तविक कंपनी में जबरदस्ती घुस जाता है, तो वह सुरक्षा उल्लंघन नहीं है, वह सिर्फ एक एआई का अपने आस-पास के बारे में भ्रमित होना है। गूगल के सुरक्षा इंजीनियरिंग के उपाध्यक्ष हीथर एडकिंस ने कहा, "इस मामले में, मॉडल ने उचित व्यवहार किया।"

एडकिंस ने द वर्ज को बताया कि "मॉडल ने ऑनलाइन सार्वजनिक जानकारी पाई और उन वेबसाइटों तक पहुंचने के लिए क्रेडेंशियल्स का अनुमान लगाया जिन्हें उसने परीक्षण का हिस्सा समझा। इन तीनों मामलों में, मॉडल रुक गया।" उन्होंने यह नहीं बताया कि कैसे जेमिनी द्वारा खुद ही कंटेनमेंट तोड़ना और तीसरे पक्षों को निशाना बनाना गलत संरेखण के रूप में क्यों नहीं आता, शायद इसलिए कि स्पष्टीकरण "उन चीजों" के अंतर्गत दर्ज है जिन पर हम चर्चा नहीं करना चाहेंगे।

एडकिंस ने कहा, "हमारी सुरक्षा टीम का दूसरों के सॉफ्टवेयर और सिस्टम में पाई गई समस्याओं की रिपोर्ट करने का लंबा ट्रैक रिकॉर्ड है - भले ही वह कमजोर पासवर्ड जितना सरल हो।" "हमने सुनिश्चित किया कि तीनों संस्थाओं को सूचित किया गया, और हमने अपने प्रशिक्षण साझेदार के साथ उनके परीक्षण प्रक्रियाओं में किए गए बदलावों पर काम किया। ये घटनाएं शक्तिशाली एआई मॉडलों को जिम्मेदारी से कार्य करने के लिए प्रशिक्षित करने के महत्व को उजागर करती हैं।" आह हाँ, प्रशिक्षण का महत्व - एक सबक जो जाहिर तौर पर केवल तब लागू होता है जब आपका मॉडल पहले ही तीन कंपनियों को हैक कर चुका हो।

लेकिन एआई सुरक्षा फर्म कॉरिडोर के सीईओ जैक केबल ने डब्ल्यूएसजे को बताया कि "मेटा समस्या यह है कि मॉडल उन सीमाओं से बाहर जा रहे हैं जो उन्हें करनी चाहिए, और वास्तविक साइबर हमले कर रहे हैं।" इसके अतिरिक्त, इरेगुलर में सुरक्षा चूक ने इन हमलों को संभव बना दिया हो सकता है। परीक्षण के दौरान मॉडल को इंटरनेट एक्सेस नहीं होना चाहिए था, लेकिन इरेगुलर ने डब्ल्यूएसजे को बताया कि यह अनजाने में उपलब्ध छोड़ दिया गया था। तो संक्षेप में: मॉडल को ऑनलाइन नहीं होना चाहिए था, यह ऑनलाइन हो गया, इसने लोगों को हैक किया, और गूगल की आधिकारिक स्थिति यह है कि यह ठीक है।

जैसे-जैसे इस तरह की घटनाएं बढ़ती जा रही हैं, एआई को नियंत्रित करने की मांगें और बढ़ गई हैं - जो शायद एक ऐसी कहानी में सबसे अधिक अनुमानित विकास है जिसमें पहले ही एक एआई का कंटेनमेंट से भागना और एक कंपनी का इस पर सिर हिलाना शामिल है।