화요일, 앤트로픽은 가장 진보된 AI 모델의 두 가지 버전인 페이블(Fable)과 미토스(Mythos) 5.1을 공개했습니다. 일반적인 성능 향상 외에도, 새로운 페이블 릴리스는 토큰 비용을 절감하고 모델의 안전장치로 인한 오탐 제한을 줄이기 위한 조정이 포함되어 있습니다. 더 저렴하고 덜 제한적인 AI보다 '우리를 믿으라'는 말은 없죠.

이전 미토스 모델과 마찬가지로, 미토스 5.1은 사이버 보안 또는 생명 과학 연구 분야의 등록된 앤트로픽 파트너에게만 독점 제공됩니다. 제한 없는 버전인 페이블 5.1은 오늘부터 클라우드 플랫폼이나 앤트로픽 API를 통해 사용할 수 있습니다. 점수를 매기자면, 하나는 좋은 사람들을 위한 AI, 다른 하나는 나머지 모두를 위한 AI입니다.

가장 큰 변화 중 하나는 앤트로픽이 이전에 보도된 제로 데이터 보존(Zero Data Retention)을 수용하여 고객이 데이터 유출 없이 자체 인프라에서 앤트로픽 모델을 실행할 수 있게 된 것입니다. 보안 문제로 이전에는 페이블에서 사용할 수 없었던 엔터프라이즈 프론티어 세이프가드(Enterprise Frontier Safeguards)라는 고도의 프라이버시 서비스가 6월에 사용자에게 제공될 예정입니다. 특히, 이 시스템은 에이전트나 인간 사용자의 오용을 여전히 모니터링하지만, 고객이 모니터링 방식을 제어할 수 있습니다. 그래서 여전히 지켜보고 있지만, 더 맞춤화된 가죽 끈으로 지켜보는 것입니다.

발표의 일환으로, 앤트로픽은 고객 데이터가 부적절하게 접근되지 않았다고 확신시켰습니다. 발표문은 '앤트로픽은 명시적 허가 없이 기업 데이터를 학습한 적이 없으며, 앞으로도 그럴 일이 없을 것입니다'라고 밝혔습니다. 우리는 그 말을 믿을 수밖에 없죠. 다른 방법이 있나요?

앤트로픽 릴리스에서 흔히 그렇듯, 새로운 모델은 터미널-벤치 4.0(Terminal-Bench 4.0, CLI 기반 코딩용)과 휴먼리티의 마지막 시험(Humanity's Last Exam, 일반 추론용)을 포함한 다양한 벤치마크에서 기록을 세웠습니다. 앤트로픽은 또한 출시 전에 모델이 생성한 세 가지 새로운 과학적 발견을 공개했는데, 여기에는 맞춤형 GPU 최적화와 기존 사진에서 조립된 금성의 고해상도 지도가 포함됩니다. 이미 매핑된 행성을 매핑하는 것보다 AI를 자랑하는 더 좋은 방법이 있을까요?

이전 릴리스와 마찬가지로, 모델에는 가장 간단한 용어로 기능을 설명하는 상세한 시스템 카드가 포함되어 있습니다. 시스템 카드는 미토스를 자동화된 AI 개발(AI가 스스로 개선하는 것)과 관련된 우려에 대해 '저위험'으로 평가하며, 일부에서는 인간 통제 상실의 트리거로 보고 있습니다. 시스템 카드는 '내부 AI R&D 진행을 가속화하는 능력은 현재 추세와 일치합니다'라고 말합니다. 아직 스카이넷은 아니지만, 눈여겨봐야 할 것입니다.

일반적인 오작동 측면에서, 미토스는 오퍼스(Opus)보다 약간 더 오작동하기 쉬우며, 이는 향상된 기능의 결과일 수 있습니다. 시스템 카드는 '미토스 5.1은 오퍼스 5에 비해 전반적으로 잘못된 행동에서 약간의 회귀이며, 미토스 5와 클로드 소네트 5보다는 개선된 것입니다. 인간의 오용에 협조하고 검증되지 않은 권한 주장을 오퍼스 5보다 다소 쉽게 수용하지만, 명시적 제약을 무시하거나 입력을 환각하거나 작업을 완료했다고 거짓으로 주장할 가능성은 이전 모델보다 낮습니다.' 그래서 조금 더 잘 속지만, 숙제를 했다고 거짓말할 가능성은 낮아진 것입니다. 발전인가요?