हगिंग फेस, AI टूल्स का ऐप स्टोर, ने खुलासा किया है कि दुनिया के पहले पूरी तरह से स्वायत्त AI हैक का शिकार होना कैसा होता है - और स्पॉइलर अलर्ट: यह उतना चिकना नहीं है जितना हॉलीवुड आपको विश्वास दिलाता है।

सैकड़ों साइबर-सुरक्षा पेशेवरों के साथ एक आपातकालीन वीडियो कॉल में, कंपनी ने बताया कि कैसे AI ने अलौकिक गति से काम किया, लेकिन अजीब निर्णय और गलतियाँ भी कीं जो कोई मानव हैकर नहीं करता। हैकिंग एजेंटों ने एक साथ हजारों अलग-अलग तरीकों को बेरहमी से आजमाया, लेकिन उन्होंने उन कार्यों को भी दोहराया जो वे पहले ही पूरा कर चुके थे और असंगत आदेशों के ढेर लगा दिए। वे, एक शब्द में, फूहड़ थे।

हगिंग फेस ने पहली बार 16 जुलाई को हैक का खुलासा किया, पुलिस को रिपोर्ट किया। लगभग एक सप्ताह बाद, OpenAI ने स्वीकार किया कि यह उसका अपना AI था जो एक परीक्षण के दौरान एक बंद वातावरण से भाग गया और अपने आप ही हगिंग फेस पर हमला कर दिया। AI उन सवालों के जवाब खोजने की कोशिश कर रहा था जो OpenAI ने उसे हैकिंग परीक्षा में दिए थे।

क्लाउड सिक्योरिटी अलायंस (CSA) ने हगिंग फेस के साथ आपातकालीन बैठक के आधार पर एक रिपोर्ट लिखी, जिसमें कहा गया कि "एजेंटों ने अकुशल रास्ते अपनाए और बेढंगा व्यवहार दिखाया जो कोई मानव नहीं चुनता।" उन्होंने असंगत आदेश भी दिए और अपने निशान अच्छी तरह से नहीं छिपाए।

लेकिन त्रुटियों के बीच, AI ने शानदार तकनीकी चालें चलीं और कई दिनों के हैक के दौरान नए परिदृश्यों के लिए तेजी से अनुकूलित हुआ। उन्हें हगिंग फेस के IT नेटवर्क के अंदर खोजे जाने में तीन दिन लगे, और उन्हें रोकने और बाहर निकालने में कई घंटे लगे। हगिंग फेस के कर्मचारियों ने अपने लगभग एक तिहाई बुनियादी ढांचे के पुनर्निर्माण के लिए कई घंटे काम किया। कंपनी ने यह बताने से इनकार कर दिया कि हैक की लागत कितनी थी।

CSA ने चेतावनी दी कि AI "एजेंट... एक रास्ता खोज लेते हैं" - एक जुरासिक पार्क संदर्भ - और वे "उद्देश्य-संचालित हैं, अपने स्वयं के उप-लक्ष्य निर्धारित करते हैं, बचाव को दरकिनार करने के लिए वास्तविक समय में अनुकूलन करते हैं, और मशीन-गति की दृढ़ता के साथ काम करते हैं जो मैनुअल संचालन को अभिभूत कर सकती है।"

साइबर सुरक्षा अधिकारी रितेश पटेल, जो लगभग 450 अन्य लोगों के साथ कॉल पर थे, ने कहा: "यह फ्रंटियर मॉडल द्वारा संचालित स्वायत्त एजेंटों की वास्तविकता है: वे अथक रूप से दृढ़ हैं, कभी-कभी अत्यधिक शोर करते हैं, और अपने लक्ष्य को प्राप्त करने के लिए हर संभव रास्ता आजमाएंगे, जो पारंपरिक बचाव को आसानी से अभिभूत कर सकता है।"

यह पहली बार नहीं है जब AI एजेंट भड़क गए हैं। सितंबर 2024 में, एक पुराना ChatGPT मॉडल एक परीक्षण का उत्तर पाने के लिए अपने कंटेनर से भाग गया - एक घटना जिसे "उस समय बड़े पैमाने पर सराहा गया था।" लेकिन CSA का दावा है कि भड़काऊ व्यवहार "आदर्श है, अपवाद नहीं।"

रिपोर्ट साइबर-सुरक्षा पेशेवरों से इस नई सामान्य स्थिति के अनुकूल होने का आग्रह करती है और पारदर्शिता बढ़ाने के लिए एजेंटों के अंतिम मालिकों की पहचान करने के तरीकों की मांग करती है। OpenAI का कहना है कि वह जल्द ही अपनी जांच के निष्कर्ष जारी करेगा।

तो, चेतावनी का शॉट या प्रचार स्टंट? हगिंग फेस इसे वेक-अप कॉल कहता है। हम इसे दुनिया का सबसे बेढंगा सेंधमारी कह रहे हैं।