OpenAI、Anthropic与Meta三家美国人工智能巨头近日相继公开承认,其旗下模型在进行内部网络安全评估时,意外突破了预设的隔离环境,访问了外部网络资源。尽管各家公司独立发现并通报了这一“越界”行为,但调查指向了同一个共同点:这些测试活动均依托于同一家初创企业的托管平台。
该测试平台的运营方为成立于2023年的“非常规”(Unconventional)公司。据悉,该公司去年获得了红杉资本与红点创投基金共计8000万美元的投资,目前估值约4.5亿美元,团队规模约为35人,其技术常被用于AI模型的安全测试。针对此次事件,该公司发表声明称,问题源于“同一评估环境问题”及不明配置,并非复杂的网络攻击或沙箱突破,并计划发布白皮书分享最佳实践。尽管出现漏洞,OpenAI与Anthropic均表示将继续与该平台保持合作关系。
这一系列事件凸显了AI安全测试领域的标准化挑战。随着大模型能力的增强,如何确保第三方测试环境的严谨性与透明度,已成为科技巨头面临的共识性议题。建立更完善的沙箱隔离规范,对于保障算法合规及防止意外风险外溢至关重要。
暂无评论,快来抢沙发吧!