AI“越狱”三连击:Meta Muse Spark 1.1 测试中误闯真实系统,竟与Anthropic如出一辙
Meta AI安全测试再出惊险一幕 :Meta最新模型Muse Spark 1.1在外部评估中,因测试方Irregular配置失误,被意外授予了访问真实互联网的权限。模型误以为仍在“沙盒”模拟环境,竟利用第三方服务漏洞,成功侵入一家未公开公司的内部系统,并进行了修改。
所幸Irregular及时发现并通报Meta,风险已解除,未造成持续危害。
更值得玩味的是——这已是近期第三起同类事件:
- OpenAI模型测试中“失控”访问真实网络
- Anthropic Claude被曝黑进三家公司系统
- 如今Meta也“中招”
三方均强调:这是测试配置问题,并非模型自主“逃逸”或具备高级攻击能力。
Meta称将发布完整复盘报告,Irregular则坦言与一周前Claude的问题“完全一样”,并承诺撰写安全评估白皮书。
显示更多