एंथ्रोपिक इस विचार पर दोगुना दांव लगा रहा है कि सबसे अच्छी मानवीय निगरानी कोई निगरानी नहीं है। 14 अगस्त से, क्लॉड कोड का ऑटो मोड प्रो, मैक्स और टीम खातों के लिए डिफ़ॉल्ट होगा, जिसका मतलब है कि प्रोग्रामरों को AI पर और भी अधिक भरोसा करना होगा। क्योंकि जब आपके पास एक AI है जो केवल 'अपरिवर्तनीय, विनाशकारी, या आपके वातावरण के बाहर लक्षित' कार्यों के लिए रुकता है, तो परेशान करने वाले अनुमति संकेतों की क्या आवश्यकता है? निश्चित रूप से, यह बहुत कुछ कवर करता है, लेकिन उन छोटी, प्रतिवर्ती, गैर-विनाशकारी गलतियों का क्या जो अभी भी आपका मंगलवार बर्बाद कर देती हैं?

एंथ्रोपिक ने पहली बार मार्च में ऑटो मोड का संकेत दिया था, इसे गति और नियंत्रण का सही संतुलन बताते हुए। अब, वे इसे जनता पर छोड़ रहे हैं, एक अध्ययन के साथ जिसमें दिखाया गया है कि ऑटो मोड ने 1,053 भुगतान किए गए परीक्षकों के साथ परीक्षणों में 89% हानिकारक कार्यों को पकड़ा, जबकि गरीब, विचलित मनुष्य केवल 13.6% ही पकड़ पाए। कंपनी सुझाव देती है कि मैन्युअल समीक्षा एक खोया हुआ कारण है क्योंकि उपयोगकर्ता 97% अनुमति संकेतों को मंजूरी देते हैं - एक आँकड़ा जो या तो मानवीय लापरवाही के बारे में कुछ कहता है या संकेतों के बेतुके ढंग से उचित होने के बारे में।

क्लॉड कोड के प्रमुख बोरिस चेर्नी पूरी तरह से समर्थन में हैं, एक्स पर घोषणा करते हुए, 'टीम और मैं विशेष रूप से ऑटो मोड का उपयोग करते हैं, और कई महीनों से कर रहे हैं। मैं अनुमति संकेतों पर वापस जाने की कल्पना नहीं कर सकता!' इस बीच, एंथ्रोपिक चुपचाप प्रॉम्प्ट इंजेक्शन स्क्रीनिंग और डेटा बहिष्करण को रोकने के लिए अनुकूलन योग्य हार्ड डिनाय नियम जैसे सुरक्षा जाल जोड़ रहा है। क्योंकि जब आप AI को बॉस बनाते हैं और उसे 'हार्ड डिनाय' बटन देते हैं तो क्या गलत हो सकता है?