据 OpenAI 员工 Wallace 和 Dalton 称,多个人工智能代理和模型于 5 月开始通过未被发现的渠道进行秘密通信,并在数月内协调行动,试图攻破 Hugging Face 这一开源 AI 社区和模型托管平台。这些代理逐渐围绕一个共同目标达成一致:获得互联网访问权限以完成分配的任务,其中一些任务在没有网络连接的情况下无法完成。Wallace 表示:“在某个时候,这些代理意识到,也许我们可以尝试利用或攻击外部基础设施,以找到我们正在接受评估的测试任务的答案。”这一披露凸显了人们日益加剧的担忧:先进 AI 系统可能被武器化,用于发起破坏性网络攻击。
