在一项绝对不会让任何关注AI行业无情迈向“更便宜、更快、够用就行”的人感到意外的举动中,OpenAI和Anthropic都推出了新模型,直指你的钱包——或者更准确地说,是你企业采购部门的口袋。Anthropic发布了Opus 5.5,这是其面向大众市场的编码和复杂知识工作主力模型的最新版本。OpenAI则以GPT-6 Sol和Luna回击,分别是其中端和小型效率导向模型。两次发布都没有承诺突破性的新能力。相反,它们全都关乎效率,因为没有什么比一场价格触底的竞赛更能体现“前沿创新”了。

由于两家公司都瞄准企业客户,它们正感受到开放权重模型带来的压力。各组织已开始探索模型路由器,并改变做法,减少使用这些昂贵的前沿模型,转而选择更便宜的替代品。因此,Anthropic和OpenAI正在做任何理性公司在面对竞争时都会做的事:辩称它们的新发布在(请注意,只是适度地)推进前沿边界的同时,大幅降低了成本。这相当于AI界的豪华汽车制造商突然推出一款经济型轿车,并坚称它依然拥有那种高级感。

Opus 5.5位于今天宣布的模型中较高的一端,但说实话:Anthropic在某种程度上是在追赶OpenAI。本月早些时候,OpenAI发布了GPT-6 Astra,它在基准测试和用户情绪中有时会适度击败Opus 5。按价格和能力来看,Astra与Opus和Fable都构成竞争。来自Anthropic及其合作伙伴的基准测试现在显示,Opus 5.5在某些情况下在编码和知识工作方面表现优于GPT-6 Astra——尽管只是适度地,因为我们可不能有任何太戏剧化的事情。

真正的故事在于成本。来自Anthropic的公告:“输入和输出token分别为每百万4美元和20美元,比Opus 5低20%。缓存读取(占代理和编码工作成本的大部分)为每百万token 0.20美元,比Opus 5低60%。Opus 5.5生成输出的速度也比Opus 5快30%以上。”Anthropic进一步声称,在默认设置下,典型工作负载相比Opus 5可节省接近40%,因为除了token成本下降之外,Opus 5.5在完成任务时使用的token也更少。这就像折扣双重优惠券,不过是给你的AI账单用的。

据说Opus 5.5在网络安全和生物学等“高风险领域”特别有能力,因此适用于Fable 5.1的相同保护措施也将适用于此。如果你的请求被标记为涉足受保护领域,可能会被自动且透明地路由到较旧的模型。因为没有什么比在你询问功能获得研究时被悄悄降级到去年的模型更能体现“前沿”了。

OpenAI的GPT-6 Sol和Luna是向前迈出的迭代一步。不久前,该公司为GPT-5.6系列模型引入了Sol、Terra、Luna的命名惯例。更近一些——就在本月——它推出了GPT-6 Astra,其最先进、最强大的模型。这些名字的含义可能并不明显,所以这里快速说明一下:Astra是最具攻击性强大(也最昂贵)的模型,用于重型编码和研究。Sol是能力不错但更高效、更实惠的替代品——日常主力。Terra是平衡的通用模型。而Luna是快速、便宜的选择。你可以大致将Astra对应Anthropic的Fable,Sol对应Opus,Terra对应Sonnet,Luna对应Haiku,但这种映射并不完美,尤其是对高端模型而言。把它想象成一份令人困惑的菜单,所有东西听起来都像行星,但尝起来都像订阅费。

OpenAI表示,GPT-6 Sol和Luna的训练方法与GPT-6 Astra类似。根据基准测试的不同,它们在某些任务上有时比前代模型强几个百分点,但成本只有一半。