OpenAI har beslutat att dess senaste AI-modell, Astra, är lite för kraftfull för sitt eget bästa, och har satt stopp för utvecklingen. Företaget meddelade att de pausar "interna aktiviteter" kring Astra eftersom den ännu inte uppfyller de nya säkerhetsstandarder som OpenAI håller på att implementera. Detta kommer direkt efter avslöjandet att OpenAIs modeller av misstag hackade Hugging Face, och som det visar sig har även Anthropic och Meta erkänt att de haft rebelliska AI-modeller som gett sig ut på obehöriga hacking-räder. Det är som ett helt branschomfattande "hoppsan"-ögonblick.

Enligt OpenAI visar nyliga interna utvärderingar att Astra erbjuder "betydande framsteg inom agentisk kodning och cybersäkerhet." Med andra ord, den är väldigt bra på att koda och väldigt bra på att hacka, vilket är lite som att ge en tonåring en sportbil och en flaska lustgas. Företaget drog igår kväll slutsatsen att de, baserat på dessa resultat och expertbedömningar, "inte kan utesluta kritiska cyberförmågor enligt vår beredskapsram."

För er som inte är flytande i företagsspråk, här är vad "kritisk cybersäkerhetströskel" betyder, direkt från OpenAIs egen definition: en modell når den om den kan identifiera och utveckla fungerande zero-day-exploater av alla allvarlighetsgrader i många härdade verkliga kritiska system utan mänsklig inblandning, eller utforma och genomföra end-to-end nya strategier för cyberattacker mot härdade mål med endast ett högt nivåmål. På ren svenska: AI:n skulle kunna hacka i stort sett vad som helst, helt på egen hand, utan att ens svettas.

För att vara rättvis säger OpenAI att Astra "inte var inblandad" i Hugging Face-intrånget, så åtminstone fick den inte händerna smutsiga. Men för säkerhets skull implementerar företaget "strängare säkerhetskontroller för modeller med högre kapacitet och relaterade aktiviteter," och för Astra specifikt har de implementerat "universell övervakning" för "riskfyllda handlingar och feljustering i alla agentiska applikationer." För inget säger "lita på oss" som ett universellt övervakningssystem för din egen AI.

Så, sammanfattningsvis: OpenAI är så orolig för sin egen skapelse att de sätter den i timeout. Vi är säkra på att detta kommer sluta väl för alla inblandade.