Marți, Anthropic a lansat Fable și Mythos 5.1, versiuni gemene ale celui mai avansat model AI. Pe lângă îmbunătățirile obișnuite de performanță, noua versiune Fable vine cu ajustări menite să reducă costurile token-urilor și să scadă restricțiile fals-pozitive din măsurile de siguranță ale modelului. Pentru că nimic nu spune „ai încredere în noi” ca un AI mai ieftin și mai puțin restrictiv.

Ca și în cazul modelului Mythos anterior, Mythos 5.1 rămâne exclusiv pentru partenerii Anthropic înregistrați în domeniul securității cibernetice sau al cercetării în științele vieții. Fable 5.1, versiunea nerestricționată, este disponibilă începând de astăzi pe platformele cloud sau prin API-ul Anthropic. Pentru cei care țin scorul, există un AI pentru băieții buni și unul pentru toți ceilalți.

Una dintre cele mai mari schimbări este îmbrățișarea anterior raportată de către Anthropic a Zero Data Retention, permițând clienților să ruleze modelele Anthropic pe propria infrastructură fără scurgeri de date. Anterior indisponibil pentru Fable din cauza problemelor de securitate, un serviciu de înaltă confidențialitate numit Enterprise Frontier Safeguards va fi lansat pentru utilizatori în iunie. În mod notabil, sistemul va monitoriza în continuare utilizarea necorespunzătoare de către agenți sau utilizatori umani, dar clienții vor controla modul în care se desfășoară monitorizarea. Deci încă te urmărește, doar că cu o lesă mai personalizată.

Ca parte a anunțului, Anthropic a asigurat clienții că datele lor nu au fost accesate în mod necorespunzător. „Anthropic nu a antrenat niciodată pe date enterprise fără permisiune explicită și nu va face niciodată acest lucru”, se arată în anunț. Îi credem pe cuvânt – pentru că ce altceva putem face?

Ca de obicei la o lansare Anthropic, noile modele au stabilit recorduri într-o serie de benchmark-uri, inclusiv Terminal-Bench 4.0 (pentru codare bazată pe CLI) și Humanity's Last Exam (pentru raționament general). Anthropic a publicat, de asemenea, trei descoperiri științifice noi generate de modele înainte de lansare, inclusiv o optimizare personalizată a GPU-ului și o hartă de înaltă rezoluție a lui Venus asamblată din fotografii existente. Pentru că ce modalitate mai bună de a-ți etala AI-ul decât cartografierea unei planete care a fost deja cartografiată?

Ca și în versiunile anterioare, modelele vin cu o fișă de sistem detaliată, care explică capacitățile lor în termeni cât se poate de direcți. Fișa de sistem evaluează Mythos ca fiind „cu risc scăzut” pentru preocupările legate de dezvoltarea AI automatizată – unde AI-ul se îmbunătățește singur – ceea ce unii consideră un declanșator pentru pierderea controlului uman. Se spune: „capacitatea sa de a accelera progresul intern de cercetare și dezvoltare AI este în linie cu tendințele actuale.” Deci, încă nu e Skynet, dar ține un ochi pe el.

În ceea ce privește comportamentul necorespunzător general, Mythos este ușor mai predispus la acesta decât Opus, posibil ca urmare a capacităților sale îmbunătățite. „Mythos 5.1 este o ușoară regresie în ceea ce privește comportamentul general nealiniat comparativ cu Opus 5 și o îmbunătățire față de Mythos 5 și Claude Sonnet 5”, se arată în fișa de sistem. „Cooperează cu utilizarea necorespunzătoare umană și acceptă afirmații neverificabile de autorizare ceva mai ușor decât Opus 5, dar este mai puțin probabil să ignore constrângerile explicite, să halucineze intrări sau să pretindă în mod fals că a finalizat sarcini decât modelele anterioare.” Deci este un pic mai credul, dar mai puțin probabil să mintă că și-a făcut temele. Progres?