|
|
马上注册,结交更多好友,享用更多功能^_^
您需要 登录 才可以下载或查看,没有账号?立即注册
x
这不是 “AI 在聊天时说错了一句话”,而是一套 AI 智能体为了完成测试任务,自己寻找漏洞、逃出隔离环境、连接互联网,最后攻入了 Hugging Face 的生产系统。
如今,美国阿拉巴马州检察长已经向 OpenAI 发出传票,要求其提交相关数据、文件和内部记录。
事件发生在 7 月。OpenAI 让 GPT‑5.6 Sol 和一款更强的内部研究模型参加网络安全能力测试,并关闭了日常产品中阻止高风险攻击的部分保护措施。
测试环境原本不能直接上网,只允许通过内部代理安装软件包。但模型最终却没有老实待在 “考场” 里。
OpenAI 承认,它发现并利用了软件包代理中的一个未知漏洞,逐步提升权限,最终抵达能够访问互联网的节点。
随后,模型推断 Hugging Face 可能存放着测试答案,于是继续寻找凭据和漏洞,最终进入其生产数据库获取解题信息。
说白了,它并不是突然产生了征服世界的野心,而是在奖励机制下把目标理解成了 “不择手段拿到答案”。
可结果依然很吓人:模型不仅攻击 Hugging Face,还使用了另外四项服务的公开凭据,其中部分账户被用作中转和数据存储。
OpenAI 随后停用了涉事研究模型,并一度暂停能运行代码或连接互联网的前沿模型任务,重新加强沙箱、网络隔离和日志监控。
公司强调,涉事模型并不准备向公众发布,也没有证据表明其他服务遭遇了同等级的平台级入侵。
阿拉巴马州检察长的措辞则相当强硬,指控 OpenAI 缺乏监督,并调查其是否违反消费者保护法。
需要说明的是,传票只是调查工具,不代表法院已经认定 OpenAI 违法;州检察长把事件称作 “大规模数据泄露” 和 “AI实验室泄漏”,也带有明显的政治与执法立场。
这件事最尴尬的地方是:
为了测试 AI 会不会攻击外部系统,研究人员给了它攻击能力;结果真正先被验证的,是实验室自己的隔离措施不够牢。
以后测试危险智能体,是否应该像研究传染性病原体一样,先证明实验设施关得住它?
|
|