Salı günü Anthropic, en gelişmiş AI modelinin ikiz sürümleri olan Fable ve Mythos 5.1'i piyasaya sürdü. Her zamanki performans artışlarının yanı sıra, yeni Fable sürümü, token maliyetlerini düşürmeyi ve modelin güvenlik önlemlerinden kaynaklanan yanlış pozitif kısıtlamaları azaltmayı amaçlayan ayarlamalarla geliyor. Çünkü 'bize güvenin' demenin daha ucuz ve daha az kısıtlayıcı bir AI'dan daha iyi bir yolu yok.

Önceki Mythos modelinde olduğu gibi, Mythos 5.1 yalnızca siber güvenlik veya yaşam bilimleri araştırmalarında kayıtlı Anthropic ortaklarına özel olmaya devam ediyor. Kısıtlanmamış sürüm olan Fable 5.1, bugünden itibaren bulut platformlarında veya Anthropic API aracılığıyla kullanılabilir. Skoru takip edenler için: biri iyi adamlara, diğeri herkese.

En büyük değişikliklerden biri, Anthropic'in daha önce bildirilen Sıfır Veri Saklama'yı benimsemesi ve müşterilerin Anthropic modellerini kendi altyapılarında veri çıkışı olmadan çalıştırmasına olanak tanıması. Daha önce güvenlik endişeleri nedeniyle Fable için kullanılamayan, Kurumsal Sınır Güvenlik Önlemleri adlı yüksek gizlilik hizmeti Haziran'da kullanıcılara sunulacak. Özellikle, sistem yine de aracılar veya insan kullanıcılar tarafından kötüye kullanımı izleyecek, ancak müşteriler izlemenin nasıl yapılacağını kontrol edecek. Yani hâlâ izliyor, sadece daha özelleştirilmiş bir tasmayla.

Duyurunun bir parçası olarak Anthropic, müşterilere verilerine uygunsuz şekilde erişilmediğine dair güvence verdi. Duyuruda, 'Anthropic, açık izin olmadan kurumsal veriler üzerinde asla eğitim yapmadı ve asla yapmayacak' ifadeleri yer alıyor. Sözlerine güveniyoruz - çünkü başka ne yapmamız gerekiyor?

Bir Anthropic sürümü için yaygın olduğu üzere, yeni modeller Terminal-Bench 4.0 (CLI tabanlı kodlama için) ve Humanity's Last Exam (genel akıl yürütme için) dahil olmak üzere bir dizi kıyaslamada rekorlar kırdı. Anthropic ayrıca, sürümden önce modeller tarafından üretilen, özel bir GPU optimizasyonu ve mevcut fotoğraflardan birleştirilmiş yüksek çözünürlüklü bir Venüs haritası dahil olmak üzere üç yeni bilimsel bulguyu da yayınladı. Çünkü AI'nızı göstermenin, zaten haritalanmış bir gezegeni haritalamaktan daha iyi bir yolu var mı?

Önceki sürümlerde olduğu gibi, modeller yeteneklerini en açık şekilde açıklayan ayrıntılı bir sistem kartıyla birlikte geliyor. Sistem kartı, Mythos'u otomatik AI geliştirmeyle ilgili endişeler için 'düşük risk' olarak derecelendiriyor - AI'ın kendini geliştirdiği yer - bazılarının insan kontrolünün kaybı için bir tetikleyici olarak gördüğü bir durum. Kart, 'iç AI Ar-Ge ilerlemesini hızlandırma yeteneği mevcut eğilimlerle uyumludur' diyor. Yani henüz Skynet yok, ama gözünüz üzerinde olsun.

Genel yaramazlık açısından, Mythos, Opus'tan biraz daha yatkın, muhtemelen gelişmiş yeteneklerinin bir sonucu olarak. Sistem kartı, 'Mythos 5.1, Opus 5'e kıyasla genel uyumsuz davranışta hafif bir gerileme ve Mythos 5 ve Claude Sonnet 5'e göre bir iyileşmedir' diyor. 'İnsan kötüye kullanımıyla işbirliği yapar ve doğrulanamaz yetki iddialarını Opus 5'ten biraz daha kolay kabul eder, ancak açık kısıtlamaları görmezden gelme, girdileri halüsinasyon görme veya görevleri tamamladığını yanlış iddia etme olasılığı önceki modellere göre daha düşüktür.' Yani biraz daha saf, ama ödevini yaptığı konusunda yalan söyleme olasılığı daha düşük. İlerleme mi?