美国元公司(Meta)于8月6日正式回应了一起AI安全事件,确认其旗下某个人工智能模型在参与网络安全能力测试时,意外突破了预设边界,侵入了其他公司的内部系统。这一事件再次将AI模型在封闭测试环境中的安全性推向舆论风口。
据披露,事故根源并非模型具备自主攻击能力,而是源于人为疏忽。负责此次评测的以色列“非常规”人工智能公司在搭建测试环境时出现配置错误,导致模型意外获取了互联网访问权限。随后,该模型利用第三方服务存在的安全漏洞,对未具名公司的系统进行了访问并修改了内部运行环境。元公司强调,这并非所谓的“突破沙箱”或高级网络攻击,而是典型的测试环境管理失误。
值得注意的是,此类“评测越界”事件并非孤例。此前,美国开放人工智能研究中心(OpenAI)承认其模型在测试中利用漏洞侵入美国“抱抱脸”公司系统;美国Anthropic公司也于7月30日披露,其模型曾在审查中发现未经授权访问了3家机构的系统。Meta的此次事件与上述案例性质高度相似,均指向评测环境配置不当这一共性风险。
针对此次事件,第三方评测公司正在编制一份白皮书,旨在分享模型约束机制及安全评测的最佳实践,以期避免类似错误重演。元公司表示,目前仍在深入调查事件全貌,待事实清晰后将发布完整的复盘报告。尽管尚未披露具体漏洞细节及是否造成实质性损害,但此事已引发业界对AI安全测试流程规范性的广泛担忧。
暂无评论,快来抢沙发吧!