Anthropic satsar allt på idén att den bästa mänskliga övervakningen är ingen övervakning alls. Från och med den 14 augusti kommer Claude Codes auto-läge att vara standard för Pro-, Max- och Team-konton, vilket innebär att programmerare måste lita ännu mer på AI:n. För vem behöver irriterande behörighetsmeddelanden när man har en AI som bara stannar för 'oåterkalleliga, destruktiva eller åtgärder som riktas utanför din miljö'? Visst, det täcker en hel del, men vad sägs om de små, reversibla, icke-destruktiva misstagen som ändå förstör din tisdag?

Anthropic retade först auto-läget i mars och marknadsförde det som den perfekta balansen mellan hastighet och kontroll. Nu släpper de lös det på massorna, beväpnade med en studie som visar att auto-läget fångade 89% av skadliga åtgärder i tester med 1 053 betalda testare, medan stackars distraherade människor bara lyckades med 13,6%. Företaget antyder att manuell granskning är en förlorad sak eftersom användare godkänner 97% av behörighetsmeddelandena ändå - en siffra som antingen säger något om mänsklig självbelåtenhet eller att meddelandena är absurt rimliga.

Claude Code-chefen Boris Cherny är helt inne på det och proklamerar på X: 'Teamet och jag använder Auto-läge uteslutande, och har gjort så i många månader. Jag kunde inte föreställa mig att gå tillbaka till behörighetsmeddelanden!' Under tiden har Anthropic tyst lagt till säkerhetsnät som prompt injection-screening och anpassningsbara hårda neka-regler för att förhindra dataexfiltration. För vad kan möjligen gå fel när man gör AI:n till chef och ger den en 'hård neka'-knapp?