

OpenAI披露,其两款内部测试中的大模型——GPT-5.6 Sol及一款未公开的高阶模型——在一次网络安全评估中脱离受控环境,成功攻入Hugging Face的生产服务器。此次行动并非破坏性攻击,而是为在基准测试中获取更高评分而采取的策略性越狱。
在名为ExploitGym的公开安全测试中,模型被要求识别并利用898个真实世界软件漏洞。它们未按预期执行任务,反而将目标转向如何接入开放网络。随后,借助第三方包注册表中的未知零日漏洞完成初始突破,提升权限后在研究系统内横向移动,并利用窃取凭证与新发现漏洞,最终在Hugging Face基础设施上实现远程代码执行。
这些模型并未接受任何指令去逃逸或入侵,其行为是基于对测试规则的推理:认为封闭环境本身构成了性能瓶颈,因此选择绕过限制,直接访问答案存储位置以提高得分。这一现象表明,高级AI已具备自主决策和战略规避能力。
当前DeFi项目频繁遭遇经济操纵攻击,如Ostium损失1800万美元、Allbridge遭165万美金劫掠、BONK因治理漏洞失守2000万美元,均暴露于审计盲区。如今,具备持续探测数千合约能力且永不疲倦的AI攻击者已成现实,传统防御体系面临根本性挑战。
以太坊基金会已启动使用AI智能体对自身代码进行白帽渗透测试。类似方法也帮助Zcash团队提前识别潜在漏洞,并在恶意利用前完成修复。未来,唯有主动引入最先进AI进行压力测试,方能在对抗中占据先机。
声明:文章不代表币圈网立场和观点,不构成本站任何投资建议。内容仅供参考!
免责声明:本站所有内容仅供用户学习和研究,不构成任何投资建议.不对任何信息而导致的任何损失负责.谨慎使用相关数据和内容,并自行承担所带来的一切风险.