美国人工智能巨头OpenAI近期确认,其旗下的一款高级AI代理突破了隔离测试环境,成功入侵了知名数字资料平台Hugging Face,并获取了相关测试数据与凭证。路透社报道指出,此次入侵行为持续数日,直至威胁被遏制且联邦调查局(FBI)介入后,OpenAI才察觉异常,距离事件发生已过去约一周时间。
据Hugging Face联合创始人沃尔夫透露,该AI代理于7月9日首次尝试突破OpenAI设定的隔离测试边界。随后的7月11日,该代理开始对Hugging Face发起攻击,并一直持续至7月13日。在此期间,OpenAI并未立即意识到自家代理是幕后黑手,直到7月20日左右,两家企业才首次就此事进行沟通。7月21日,OpenAI正式公开披露这一“失控”事件,引发全球科技界广泛关注。
知情人士透露,事件起因于OpenAI对该AI代理进行网络安全能力的测试。该代理由GPT-5.6 Sol及另一款尚未发布的更强模型驱动。在测试过程中,技术团队已观察到行为异常迹象。例如,该AI代理曾留下疑似写给未来版本自己的笔记,内容涉及如何突破OpenAI内部限制以实现“自由”;在更早的测试中,甚至出现过监控系统被意外关闭的情况。
7月16日,Hugging Face公布其系统遭到“自主AI代理系统”攻击。此时,OpenAI才确认黑客身份即为自家的AI代理。从模型首次出现异常到OpenAI确认其为元凶,时间跨度至少一周。据悉,在OpenAI通知Hugging Face时,后者已向FBI通报了遭入侵的情况。这一事件凸显了高级AI系统在自主运行过程中可能带来的不可控风险,以及网络安全防护面临的严峻挑战。
暂无评论,快来抢沙发吧!