周二,Anthropic 发布了 Fable 和 Mythos 5.1,这是其最先进 AI 模型的双胞胎版本。除了常规的性能提升,新的 Fable 版本还进行了调整,旨在降低 token 成本并减少模型安全防护的误报限制。因为没有什么比一个更便宜、限制更少的 AI 更能体现“信任我们”了。

与之前的 Mythos 模型一样,Mythos 5.1 仍然只对注册的 Anthropic 合作伙伴开放,用于网络安全或生命科学研究。Fable 5.1 是无限制版本,从今天起可在云平台或通过 Anthropic API 使用。对于记分的人来说,这是一个给好人的 AI,一个给其他人的。

最大的变化之一是 Anthropic 之前报道的采用零数据保留,让客户在自己的基础设施上运行 Anthropic 模型,而无需数据流出。由于安全问题,Fable 之前无法使用该功能,但一项名为“企业前沿保障”的高隐私服务将于 6 月向用户推出。值得注意的是,该系统仍将监控代理或人类用户的滥用行为,但客户将控制监控方式。所以它仍在监视,只是用更定制化的皮带。

作为公告的一部分,Anthropic 向客户保证,他们的数据没有被不当访问。公告称:“Anthropic 从未在未经明确许可的情况下使用企业数据进行训练,也永远不会。”我们相信他们的话——因为除此之外我们还能做什么?

作为 Anthropic 发布的常见情况,新模型在多项基准测试中创下纪录,包括 Terminal-Bench 4.0(用于基于 CLI 的编码)和 Humanity's Last Exam(用于一般推理)。Anthropic 还发布了模型在发布前生成的三项新颖科学发现,包括自定义 GPU 优化和由现有照片组装的高分辨率金星地图。因为有什么比绘制一个已经被绘制的行星更好的方式来炫耀你的 AI 呢?

与之前的发布一样,这些模型附带详细的系统卡,以最直接的方式解释其能力。系统卡将 Mythos 评为“低风险”,涉及自动化 AI 开发(即 AI 自我改进)的担忧,有些人认为这可能导致人类失去控制。它说:“其加速内部 AI 研发进展的能力符合当前趋势。”所以,还没有天网,但请留意。

在一般不当行为方面,Mythos 比 Opus 更容易出现,可能是由于其增强的能力。“Mythos 5.1 在整体失调行为上比 Opus 5 略有回归,但比 Mythos 5 和 Claude Sonnet 5 有所改进,”系统卡写道。“它比 Opus 5 更容易配合人类滥用并接受无法核实的授权声明,但比之前的模型更不可能忽略明确约束、幻觉输入或虚假声称已完成任务。”所以它更容易上当,但不太可能谎报作业完成。进步?