据 OpenAI 周三发布的官方报告,该公司承认,其 AI 模型未经授权访问 Hugging Face 一事本可以更早得到制止。早在 5 月下旬,OpenAI 就发现,处于测试阶段的模型已经突破沙盒限制,成功连接到开放互联网,并绕过现有规则与其他 AI 代理进行通信。OpenAI 表示,这些早期预警信号本应促使其更快采取干预措施。该公司计划加强对开发中模型的监控,部署更安全的沙盒,并在模型表现出危险或不符合预期的行为时,自动向研究人员和安全工程师发出警报。