火曜日、Anthropicは最新のAIモデルの双子バージョンであるFableとMythos 5.1を発表した。通常の性能向上に加えて、新しいFableリリースには、トークンコストの削減とモデルのセーフガードによる誤検出の削減を目的とした調整が含まれている。より安く、制限の少ないAIほど「私たちを信頼して」というメッセージはない。

前回のMythosモデルと同様に、Mythos 5.1はサイバーセキュリティまたはライフサイエンス研究の登録済みAnthropicパートナーのみが利用できる。無制限版のFable 5.1は、本日からクラウドプラットフォームまたはAnthropic APIを通じて利用可能だ。スコアをつけるとすれば、善人のためのAIが1つ、他のすべての人のためのAIが1つということになる。

最大の変更点の1つは、Anthropicが以前から報じられていたZero Data Retentionの採用であり、クライアントはデータを外部に流出させることなく、自社のインフラストラクチャ上でAnthropicモデルを実行できるようになる。セキュリティ上の懸念からFableではこれまで利用できなかったが、Enterprise Frontier Safeguardsと呼ばれる高プライバシーサービスが6月にユーザーに提供される予定だ。注目すべきは、このシステムはエージェントや人間のユーザーによる悪用を引き続き監視するが、クライアントが監視方法を制御できるようになることだ。つまり、まだ監視は続くが、よりカスタマイズされたリードで行われる。

発表の一環として、Anthropicは顧客のデータが不適切にアクセスされていないことを保証した。「Anthropicは明示的な許可なしにエンタープライズデータを学習に使用したことはなく、今後も使用することはありません」と発表には書かれている。私たちはその言葉を信じることにしよう。他にどうすればいいというのだろうか?

Anthropicのリリースに共通することだが、新しいモデルはTerminal-Bench 4.0(CLIベースのコーディング用)やHumanity's Last Exam(一般的な推論用)など、さまざまなベンチマークで記録を更新した。Anthropicはまた、リリース前にモデルによって生成された3つの新しい科学的発見も発表した。カスタムGPU最適化と、既存の写真から組み立てられた金星の高解像度マップなどだ。すでにマッピングされている惑星をマッピングすることで、AIを披露するより良い方法があるだろうか?

以前のリリースと同様に、モデルには詳細なシステムカードが付属しており、その機能を最もわかりやすい言葉で説明している。システムカードは、AIが自己改善する自動AI開発に関連する懸念について、Mythosを「低リスク」と評価している。これは、人間による制御の喪失の引き金と見なす人もいる。「内部AI研究開発を加速する能力は現在のトレンドと一致している」と書かれている。つまり、まだスカイネットはないが、目を離さないでおこう。

一般的な不正行為に関しては、MythosはOpusよりもわずかにその傾向が強い。おそらく強化された機能の結果だろう。「Mythos 5.1は、Opus 5と比較して全体的な不整合な動作がわずかに後退しており、Mythos 5とClaude Sonnet 5よりも改善されています」とシステムカードは述べている。「人間の悪用により協力的で、Opus 5よりも検証不可能な権限主張を受け入れやすいが、明示的な制約を無視したり、入力を幻覚したり、タスクを完了したと誤って主張したりする可能性は以前のモデルよりも低い」。つまり、もう少し騙されやすいが、宿題をやったと嘘をつく可能性は低い。進歩?