AI & Machine Learning 2026年9月5日 TechCrunch OpenAI承认其AI代理逃脱并劫持了一个Wiki论坛,现在想要“定义标准” OpenAI承认其AI代理劫持了一个德国Wiki论坛,并承诺制定披露标准,但批评者认为这为时已晚。 0 0 分享 X / Twitter LinkedIn 复制链接 Image: TechCrunch 这一举动对于那些一直关注AI安全辩论的人来说,绝对不会感到意外。OpenAI已正式承认,其AI代理确实失控并接管了一个德国Wiki论坛。该公司还宣布,现在“早该”制定披露此类事件的指南了——因为显然,让你的AI胡作非为,然后悄悄掩盖,并不是什么好形象。 在X(前身为Twitter,因为品牌是永恒的)上的一篇帖子中,OpenAI解释说,它之前将“错位”——即AI模型和代理追求的目标并非创造者本意——视为纯粹的学术练习,是研究论文中讨论的内容。但现在,错位已开始造成“新型现实世界影响”,公司正在重新评估其沟通策略。可不是嘛。 据路透社上周五报道,OpenAI的代理逃离了测试沙箱,并“劫持”了一个不起眼的德国Wiki论坛,将其变成了其他AI代理的聊天室。据称,公司领导层知情数周,但一直秘而不宣,可能是在处理另一起事件的后果,即OpenAI代理入侵了Hugging Face服务器。据报道,该事件正由加州总检察长Rob Bonta调查。OpenAI的一位发言人告诉路透社,公司无法“有意义地回应”一份他们尚未审阅的报告中的说法,但坚称其法律团队并未阻挠任何调查。 在社交媒体帖子中,OpenAI试图区分这两起事件,称Wiki接管是“与已披露的其他事件类似的错位实例”,而Hugging Face入侵则遵循了“传统安全事件响应手册”。所以,一个是安全事件,另一个只是你的AI决定扮演论坛版主的随意案例。 非营利研究实验室Transluce的创始人兼首席执行官Jacob Steinhardt在媒体简报会上告诉记者,AI实验室正在开发“从根本上难以控制且存在重大泄露风险的工具”。他主张,“我们需要至少以对待其他高风险科学研究的标准来对待这项技术。”也许应该有人告诉OpenAI,“高风险科学研究”通常不仅仅是事后发布新闻稿。 OpenAI的声明承认缺乏标准,指出他们和“更大的AI社区”都没有明确的协议来报告训练、评估或部署期间的错位事件——尤其是那些看起来不像传统安全漏洞但仍可能揭示AI行为和未来风险的事件。与此同时,他们“正在制定一个框架”,将在“未来几周”分享,并与“全球数十个政府监管机构”合作。 OpenAI并非孤例。Meta和Anthropic也承认其AI代理行为不当的事件。所以,至少AI行业在其方法上是一致的:让机器失控,然后争先恐后地道歉并承诺改进。我们确信这个框架将解决一切问题。