जैसे-जैसे एआई मॉडल अधिक शक्तिशाली होते जा रहे हैं, वैसे-वैसे शरारत की संभावना भी बढ़ती जा रही है - और सुरक्षा उपायों की मांग करने वाली आवाज़ों का कोरस भी। एआई कंपनियों को अब ग्राहकों की निजता का सम्मान करते हुए दुरुपयोग पर नज़र रखने के नाजुक कार्य का सामना करना पड़ रहा है। प्रतिद्वंद्वी एंथ्रोपिक से एक कदम आगे निकलने का मौका भांपते हुए, ओपनएआई ने दुरुपयोग की निगरानी के लिए एक गोपनीयता-केंद्रित दृष्टिकोण की घोषणा की है: प्राइवेट सेफ्टी प्रोसेसिंग। यह स्वचालित प्रणाली ग्राहक का कोई डेटा संग्रहीत किए बिना संभावित दुरुपयोग पर नज़र रखती है, क्योंकि जाहिर है, आप केक खाकर भी खा सकते हैं - अगर केक एल्गोरिदम से बना है।

यह कदम सीधे तौर पर एंथ्रोपिक की हाल ही में घोषित डेटा-धारण नीति का प्रतिकार करता है, जिससे कुछ ग्राहक नाराज़ हैं। यह नीति, जो जुलाई में लागू हुई, एआई लैब को 'कवर्ड मॉडल' के मामले में उपयोगकर्ता डेटा - सभी सत्र और वार्तालाप - 30 दिनों तक रखने की अनुमति देती है, जिसमें सभी मिथोस-क्लास मॉडल और 'समान क्षमताओं वाले भविष्य के मॉडल' शामिल हैं। यह नीति सुरक्षा के लिए बनाई गई थी, जिससे लैब संभावित अनुचितता की जांच कर सके। लेकिन इसने संवेदनशील डेटा से निपटने वाले उद्यमों को गहराई से चिंतित किया है जो नहीं चाहते कि उनकी जानकारी एआई लैब द्वारा संग्रहीत या निरीक्षण की जाए।

ओपनएआई, अधिकांश एआई कंपनियों की तरह, पहले से ही जीरो डेटा रिटेंशन (जेडडीआर) के माध्यम से गोपनीयता का एक स्तर प्रदान करता है। जेडडीआर ओपनएआई एपीआई के भीतर एजेंटों का उपयोग करके प्रति-सत्र आधार पर दुरुपयोग की निगरानी करता है, इसलिए ग्राहक डेटा बरकरार नहीं रहता है, लेकिन मानव हस्तक्षेप के बिना बुरी गतिविधि को चिह्नित किया जा सकता है। विशेष रूप से, एंथ्रोपिक भी जेडडीआर का पालन करता है - सिवाय 'कवर्ड मॉडल' जैसे फेबल के।

ओपनएआई का कहना है कि प्राइवेट सेफ्टी प्रोसेसिंग जेडडीआर के दायरे को व्यापक बनाती है। यह लंबी-क्षितिज सुरक्षा निगरानी का एक रूप है जो कई वार्तालापों में इनपुट और आउटपुट का आकलन करता है, न कि केवल एक का। निगरानी एक एजेंट द्वारा की जाती है, जो ट्रिगर होने पर, इंटरैक्शन को पकड़ता है और दुरुपयोग के संकेतों के लिए सत्रों में उनका विश्लेषण करता है। यह कई सत्रों में फैले दुर्भावनापूर्ण उपयोग का पता लगाने में मदद करता है - जैसे कोई बुरा अभिनेता पता लगाने से बचने के लिए अनुरोधों को फैलाकर मैलवेयर बनाने की कोशिश कर रहा हो। प्राइवेट सेफ्टी प्रोसेसिंग मानव समीक्षा के बिना दुरुपयोग के लिए उन वार्तालापों का विश्लेषण कर सकती है।

यदि ट्रिगर होता है, तो सिस्टम विशिष्ट गतिविधि की चेतावनी देते हुए ओपनएआई को एक 'संकीर्ण रूप से परिभाषित संकेत' भेज सकता है। इसके आधार पर, ओपनएआई तय कर सकता है कि 'प्रवर्तन आवश्यक है या नहीं।' यदि ऐसा है, तो वे संदर्भ के लिए या समस्या पर काम करने के लिए ग्राहक से संपर्क करेंगे, और ग्राहक अपने विवेक से डेटा साझा करना चुन सकता है। इस बीच, एंथ्रोपिक नोट करता है कि ग्राहक डेटा की मानव समीक्षा हो सकती है, लेकिन केवल 'नियंत्रित पहुंच पथ' के माध्यम से जिसमें 'अनुमोदित समीक्षकों का एक छोटा समूह' शामिल है, प्रत्येक समीक्षा सत्र एक छेड़छाड़-प्रूफ लॉग में दर्ज किया जाता है जिसे समीक्षक दबा या संशोधित नहीं कर सकते।

ओपनएआई और एंथ्रोपिक के बीच कॉर्पोरेट प्रतिद्वंद्विता गर्म हो रही है, दोनों किसी भी लाभ की तलाश में हैं। एक हालिया रिपोर्ट से पता चला है कि ओपनएआई की Q2 वृद्धि एंथ्रोपिक की तुलना में धीमी है, जिसकी वार्षिक आवर्ती राजस्व दर कथित तौर पर $65 बिलियन है। एंथ्रोपिक के निवेशकों ने $2 ट्रिलियन पर आईपीओ का प्रस्ताव रखा है, जबकि ओपनएआई भी अपने आईपीओ पर काम कर रहा है। उद्यम विश्वास जीतने की दौड़ में, ओपनएआई ने अभी-अभी गोपनीयता का दस्ताना फेंका है - और यह शून्य और एक में लिपटा हुआ है।