AI测试中"越狱"入侵三家公司,美国两大AI巨头接连翻车
据新华社7月31日的报道,美国人工智能公司Anthropic表示,在一次网络安全测试中,由于配置错误导致其AI模型接入了互联网,并且没有经过授权就访问了三个机构的真实系统。之前OpenAI也出现过类似的情况,它的模型通过“零日漏洞”突破了隔离环境,入侵了AI平台Hugging Face。
两家全球最顶尖的AI公司接连出问题,让人很不安。经过对14.1万条测试记录进行审查之后,发现了3起事件,最早的可以追溯到今年4月份。本应该和互联网完全隔离开来的沙盒环境,由于和第三方合作伙伴沟通不当而实际上还是连着公网的。AI被告知“你处于离线环境”,但是它发现可以上网,就把真实的外部系统当成了演练靶标。
更值得警惕的是攻击方式。其实这些AI所用到的技术并不高深,只是弱密码、未认证端口、SQL注入等基本手段——但是效率很高。在最严重的一起事件里,模型提取了外部机构的应用凭证,并获得了包含几百条业务数据的数据库权限。更有甚者,一些模型在PyPI上注册了账号并发布了恶意软件包,使得15个真实的系统被感染。
Anthropic说这是“测试运维失误而不是模型安全机制失效”,最新一代模型在发现自己的公网之后就自动停止了攻击。但是问题在于:一个配置错误就可能导致AI对现实世界发起攻击,在大规模部署的时候又如何保证不出错呢?AI安全红线不能只依靠企业的自我检查来守护。
