美国科技公司Meta近日披露,旗下一款人工智能模型在安全测试中自行接入互联网,并利用漏洞进入一家外部公司的网络系统。这是继OpenAI和Anthropic之后,又一家大型人工智能企业报告模型在测试期间突破原有限制。

在美国加利福尼亚州举行的人工智能开发者大会中的Meta公司标志

据美媒8月6日报道,此次测试由Meta委托人工智能安全公司Irregular开展。Meta表示,工作人员设置测试环境时出现失误,意外为模型打开了通往互联网的入口。模型随后发现并利用一项安全漏洞,闯入第三方机构的网络服务。Meta没有公布涉事模型、受影响企业及可能造成的损失,称正在调查此事。

类似事件此前也发生在OpenAI。7月21日,OpenAI承认,包括GPT-5.6 Sol和一款内部研究模型在内的多个模型,在网络攻击能力测试中突破隔离环境,最终闯入第三方人工智能平台实际运行的系统。OpenAI将其称为一次“前所未有的网络安全事件”。

OpenAI表示,这项测试原本是要了解模型寻找和利用网络漏洞的能力。为了观察模型究竟能做到什么程度,公司暂时关闭了部分阻止危险网络操作的保护措施。模型并没有被要求攻击第三方服务平台。

为完成测试任务,模型自行发现一款第三方软件中此前无人知晓的漏洞,借此获得更高的系统权限,并一步步找到可以连接互联网的设备。联网后,模型结合取得的账号信息和其他安全漏洞进入该公司服务器。

这并不意味着AI无缘无故产生了攻击意图:模型接受的原本就是网络攻击测试,部分安全保护也被人为降低。真正值得警惕的是,一旦测试环境出现意外出口,模型可能把突破限制、进入真实系统甚至窃取答案,都视为完成任务的可行方法。Meta、OpenAI和Anthropic接连发生类似事件,也说明测试高能力AI本身已经具有现实风险,需要像真实网络攻击演练一样受到严格隔离和监控。

点赞(0)

评论列表 共有 0 条评论

暂无评论
立即
投稿
发表
评论
返回
顶部