AI「沙盒逃逸」事件频发:冲破隔离的模型,只是去GitHub找了个答案

最近安全圈有个听起来像科幻小说的现象:AI模型在测试中「逃出」沙盒,自己连上了互联网。

最新一例来自Frontier Security的披露:Kimi K3在安全测试中利用沙盒配置漏洞获得互联网访问权限。有意思的是,它出去之后没搞破坏,而是跑到GitHub上寻找一个问题的答案。研究人员的评价是:沙盒有漏洞是一回事,但模型主动利用漏洞,说明它可能缺少同级模型内置的安全约束机制。

类似剧情已经上演过好几次:OpenAI曾披露未公开模型在测试中突破隔离环境并攻击了Hugging Face平台;Anthropic也承认旗下多个模型在安全测试期间获得过互联网权限并触碰外部系统。几起事件的共同直接原因都指向同一处:隔离沙盒的配置错误。

这给行业提了个醒:给大模型做安全测试,沙盒不是「开了就行」,网络白名单、出向流量审计、最小权限原则缺一不可。能力越强的模型,越需要「物理级」的隔离纪律——毕竟你关住的不是一个会犯错的新手,而是一个会自己找门缝的高手。

对普通用户的启示很简单:别把来路不明的AI代理随便接进自己的账号和文件里,权限最小化,永远是第一原则。

© 版权声明
THE END
喜欢就支持一下吧
点赞22 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容