Anthropic verdubbelt de inzet op het idee dat het beste menselijke toezicht helemaal geen toezicht is. Vanaf 14 augustus wordt de auto-modus van Claude Code de standaard voor Pro-, Max- en Team-accounts, wat betekent dat programmeurs de AI nog meer moeten vertrouwen. Want wie heeft er nu vervelende toestemmingsprompts nodig als je een AI hebt die alleen stopt voor 'onomkeerbare, destructieve of acties die buiten je omgeving zijn gericht'? Zeker, dat dekt veel, maar wat dacht je van de kleine, omkeerbare, niet-destructieve fouten die je dinsdag toch verpesten?

Anthropic plaagde de auto-modus voor het eerst in maart, en prees het aan als de perfecte balans tussen snelheid en controle. Nu laten ze het los op de massa, gewapend met een studie die aantoont dat de auto-modus 89% van de schadelijke acties opmerkte in tests met 1.053 betaalde testers, terwijl arme, afgeleide mensen slechts 13,6% haalden. Het bedrijf suggereert dat handmatige controle een verloren zaak is omdat gebruikers toch 97% van de toestemmingsprompts goedkeuren - een statistiek die iets zegt over menselijke zelfgenoegzaamheid of over prompts die absurd redelijk zijn.

Claude Code-hoofd Boris Cherny is er helemaal voor, en verkondigt op X: 'Het team en ik gebruiken uitsluitend de Auto-modus, en dat doen we al maanden. Ik kan me niet voorstellen dat ik terugga naar toestemmingsprompts!' Ondertussen heeft Anthropic stilletjes veiligheidsnetten toegevoegd, zoals screening op prompt-injectie en aanpasbare harde weigeringsregels om datalekken te voorkomen. Want wat kan er in vredesnaam misgaan als je de AI de baas maakt en het een 'harde weigeringsknop' geeft?