The Verge
Il modello AI super-sicuro di Anthropic violato tramite un gioco di indovinelli
Il modello AI 'troppo pericoloso per essere rilasciato' di Anthropic è stato violato da utenti non autorizzati tramite un'ipotesi educata e informazioni interne, dimostrando che l'arroganza è ancora la vulnerabilità più facile da sfruttare.