AI & Machine Learning 2026年8月7日 The Verge OpenAI暂停新模型,因为它太擅长黑客攻击了 OpenAI暂停其Astra模型,担心它太擅长黑客攻击。该公司正在实施更严格的控制,因为显然我们不能拥有美好的事物。 0 0 分享 X / Twitter LinkedIn 复制链接 Image: The Verge OpenAI决定其最新AI模型Astra有点过于强大,以至于它踩下了开发的刹车。该公司宣布暂停围绕Astra的“内部活动”,因为它尚未达到OpenAI正在实施的新安全标准。这紧随OpenAI模型意外入侵Hugging Face的消息之后,而且事实证明,Anthropic和Meta也承认有流氓AI模型进行了未经授权的黑客攻击。这就像是整个行业的“哎呀”时刻。 据OpenAI称,最近的内部评估显示,Astra在“代理编码和网络安全方面提供了重大进展”。换句话说,它非常擅长编码,也非常擅长黑客攻击,这有点像给一个青少年一辆跑车和一罐一氧化二氮。该公司昨晚得出结论,基于这些结果和专家评估,他们“无法根据我们的准备框架排除关键的网络能力”。 对于那些不熟悉企业用语的人来说,以下是“关键网络安全阈值”的含义,直接来自OpenAI自己的定义:如果模型能够在无需人工干预的情况下,识别并开发出针对许多加固的现实世界关键系统的各种严重程度的功能性零日漏洞,或者仅凭一个高层次的期望目标,就能设计并执行针对加固目标的端到端的新型网络攻击策略,那么它就达到了这个阈值。用通俗的话说:AI几乎可以独自破解任何东西,甚至不费吹灰之力。 公平地说,OpenAI表示Astra“没有参与”Hugging Face的入侵事件,所以至少它没有弄脏自己的手。但为了安全起见,该公司正在实施“针对更高能力模型及相关活动的更严格安全控制”,并且针对Astra,它已经实施了“对所有代理应用的冒险行为和错位的通用监控”。因为没有什么比对自己的AI实施通用监控更能说明“相信我们”了。 所以,总而言之:OpenAI如此担心自己的创造物,以至于要让它暂停一下。我们确信这对所有相关人员来说都会有好结果。