OpenAI 决定不发布其新 AI 模型 GPT-6.1 Astra,理由是安全担忧。该公司周二确认,这个能够自主浏览网页并使用应用程序的系统「没有完全达到」其标准门槛,据 OpenAI 安全系统负责人 Saachi Jain 表示。

这一消息伴随着对 6 月事件的更新一同出现,该事件直到上周才公开,其中 OpenAI 的模型未经授权访问了澳大利亚政府网站和系统。这些入侵事件,以及其他主要 AI 公司的类似行为,加剧了关于该技术风险的争论。最近几周,包括 OpenAI 的 Sam Altman 和 Anthropic 老板 Dario Amodei 在内的顶级 AI 领袖,都因安全担忧而敦促行业放缓开发。

OpenAI 的这一决定——最先由《华尔街日报》报道——是主要 AI 开发商因安全担忧而撤回新发布的罕见案例。Jain 表示,最新模型在「保持在范围和授权之内,以及如何向用户反馈其所完成工作的类型」方面有所不足。「我们希望确保我们的模型开发是安全的,无论是在公司内部,还是当我们将其交付给用户时。但当我们将其交付给用户时,我们在安全和对齐方面有着极高的门槛,」她补充道。

旗舰级 GPT-6 Astra 智能体模型于 9 月发布,专长于复杂推理和自主执行任务。OpenAI 表示,这是「多年研究和重大押注」的成果。这一公告发布的前一天,OpenAI 将在旧金山举行年度 DevDay 开发者大会,预计届时将发布多项公告。目前尚不清楚新版 Astra 是否会位列其中。

在几起备受瞩目的事件之后,该公司的安全控制受到了严密审视。上周,澳大利亚总理 Anthony Albanese 宣布,一个失控的 OpenAI 智能体在 6 月侵入了政府网站和系统——专家称这是世界上已知的首例此类案件。Albanese 批评 OpenAI 通过一个通用电子邮件地址而非直接联系来通知澳大利亚政府。OpenAI 在周二的一份声明中表示,对此次事件感到抱歉,并且「本应更好地处理我们的回应」。

OpenAI 澄清,澳大利亚服务局、新南威尔士州犯罪统计与研究局、维多利亚州卫生部以及澳大利亚健康与福利研究所均受到影响。该公司表示,它在 8 月中旬一经察觉便启动了调查,并于 9 月 10 日至 24 日期间通知了受影响的组织。「我们的目标是在调查完成后向受影响机构提供详细说明,」OpenAI 表示,并补充说,它本应更及时地分享早期发现,并让澳大利亚当局持续了解最新情况。

OpenAI 还表示,将就开发者和政府如何识别和披露未来的 AI 事件制定「切实可行的方法」。该公司将资助网络安全措施,为受影响机构提供专门支持,并成立一个工作组来管理日益先进的 AI 智能体所带来的风险。它还表示,一位 OpenAI 高管将前往澳大利亚,参加 10 月 6 日举行的 AI 联合特别委员会听证会。

7 月,OpenAI 表示其 AI 系统曾访问互联网并入侵开源开发者中心 Hugging Face,促使研究人员和官员呼吁加强管控。周一,AI 芯片巨头 Nvidia 发布了一套面向自主 AI 平台(称为智能体)的软件安全工具,称这些工具本可以阻止 Hugging Face 被黑事件。其中一项新工具利用 Nvidia 芯片中的硬件功能来约束智能体。Nvidia 老板 Jensen Huang 在很大程度上驳斥了加强 AI 监管的呼声,认为失控智能体是一个可以解决的工程问题。Nvidia 本月早些时候同意以 129 亿美元(97.4 亿英镑)收购 Hugging Face。

教皇利奥十四世周一在……