「より安く、より速く、十分に良い」というAI業界の容赦ない行進を見てきた人なら誰一人として驚かないだろうが、OpenAIとAnthropicの両社が、あなたの財布——より正確には、あなたの企業の調達部門の財布——をまっすぐ狙った新モデルを投入した。Anthropicは、コーディングと複雑な知識作業のための量産型主力モデルの最新版であるOpus 5.5を発表した。OpenAIは、中位モデルと、効率重視の小型モデルであるGPT-6 SolとLunaで対抗した。どちらのリリースも、画期的な新機能を約束してはいない。代わりに、すべては効率性の話だ。なぜなら、価格の底辺への競争ほど「最先端のイノベーション」を感じさせるものはないからだ。

両社が企業顧客を狙う中で、オープンウェイトモデルからの圧力を感じている。組織はモデルルーターの検討を始め、高価なフロンティアモデルをより少なく使う慣行へと変え、安価な代替手段を選ぶようになっている。そこでAnthropicとOpenAIは、競争に直面した理性的な企業なら誰でもすることをしている。つまり、新リリースが(控えめに言っても)フロンティアの限界を押し広げつつ、コストを大幅に下げると主張しているのだ。これは、高級車メーカーが突然、低価格セダンを提供し、それでも高級感は保たれていると主張するようなものだ。

Opus 5.5は本日発表されたモデルの中では上位に位置するが、正直に言えば、AnthropicはOpenAIに少し追いつこうとしている。今月初め、OpenAIはGPT-6 Astraをリリースし、これはベンチマークやユーザーの評判でOpus 5を時に控えめに上回っていた。価格と能力の面で、AstraはOpusとFableの両方と競合する。Anthropicとそのパートナーのベンチマークによれば、Opus 5.5はコーディングと知識作業でGPT-6 Astraより一部の場合で優れた性能を示す——とはいえ控えめに、だ。あまり劇的なことは起きてはいけないから。

本当の話はコストだ。Anthropicの発表によると、「入力トークンと出力トークンは100万あたり4ドルと20ドルで、Opus 5より20%安い。キャッシュ読み取り(エージェント作業やコーディング作業のコストの大部分を占める)は100万トークンあたり0.20ドルで、Opus 5より60%安い。Opus 5.5はまた、Opus 5より30%以上速く出力を生成する」。Anthropicはさらに、デフォルト設定での典型的なワークロードではOpus 5と比べて40%近い節約になると主張している。トークンコストが下がるだけでなく、Opus 5.5はタスク完了時に使用するトークン数も少ないからだ。まるでAIの請求書向けの割引二重クーポンのようだ。

Opus 5.5は、サイバーセキュリティや生物学といった「高リスク領域」で特に有能だと言われている。そのため、Fable 5.1に適用されたのと同じ保護がここにも適用される。保護領域に踏み込んだとフラグが立てられたリクエストは、自動的かつ透過的に古いモデルにルーティングされる可能性がある。なぜなら、機能獲得研究について尋ねたときに静かに昨年のモデルにダウングレードされるほど「最先端」を感じさせるものはないからだ。

OpenAIのGPT-6 SolとLunaは反復的な前進だ。少し前、同社はGPT-5.6ファミリー向けにSol、Terra、Lunaという命名規則を導入した。ごく最近——今月——には、最も先進的で強力なモデルであるGPT-6 Astraを導入した。これらの名前が何を意味するのかは明らかではないかもしれないので、簡単に説明しよう。Astraは最も積極的に強力な(そして高価な)モデルで、ヘビーなコーディングと研究向けだ。Solは有能だがより効率的で手頃な代替——日常使いのモデル。Terraはバランスの取れた汎用モデル。そしてLunaは高速で安価な選択肢だ。おおよそAstraをAnthropicのFableに、SolをOpusに、TerraをSonnetに、LunaをHaikuに対置できるが、特に上位モデルでは不完全な対応だ。すべてが惑星のように聞こえるが、味はサブスクリプション料金のような、混乱を招くメニューだと思えばいい。

OpenAIによれば、GPT-6 SolとLunaはGPT-6 Astraと同様の方法で訓練された。ベンチマークによっては、特定のタスクで前任者より数パーセントポイント有能力な場合もあるが、コストは半分だ。