新华社消息,美国开放人工智能研究中心(OpenAI)21日承认, 该公司的GPT-5.6 Sol模型和另一款能力更强的预发布模型联合进行内部评估时失控,突破隔离测试环境,侵入了人工智能开源平台美国抱抱脸公司的系统。
抱抱脸公司此前表示,上周,其生产基础设施遭到一个“自主”人工智能代理系统的入侵。在取证分析时, 由于美国前沿模型“无法区分事件响应方和攻击者”,他们转而采用中国模型分析攻击者数据。
OpenAI安全团队发现内部异常活动,抱抱脸安全团队在其基础设施上检测到并阻止相关活动,双方正在展开联合调查。
抱抱脸说,其最初尝试使用通过商业应用程序接口提供的前沿模型分析日志,但请求被阻止。 该公司随后改为在自己的基础设施上运行中国企业智谱开发的开放权重模型GLM-5.2,以进行取证分析,从而避免攻击者数据及相关凭据离开公司内部环境。
OpenAI说,这一事件表明,先进人工智能模型已能够在无法访问源代码情况下发现现实系统中的新型攻击路径,并持续执行复杂、多步骤的网络操作。模型网络安全能力快速提高的同时,内部评测环境、模型行为控制和安全防护措施等也需要同步加强。
另据环球时报消息,目前,此事已经在美国的网络上炸开了锅。有美国网友表示,这简直就是科幻电影《终结者》中人工智能失控后攻击人类的一次预演。 但让更多美国网民震撼的,还是此事中美国顶尖的大模型拒绝提供帮助,最后得靠中国的开源大模型去对抗失控的美国闭源大模型的情节。
最终,OpenAI虽然承认了其肇事者的角色,但为了挽回颜面,该公司在声明中还搞了一番借势营销,称这一入侵事件说明其新款大模型可以更好地发现安全漏洞,提前修补,想让人们来付钱购买。但不少美国网民对此并不买账。他们反而认为OpenAI应该学学中国模型的开源精神,别把防人的墙筑得那么高,最后只会损害美国自己的竞争力。
综合来源:新华社、环球时报