Forwarded from 竹新社
OpenAI披露,上周的HuggingFace系统被入侵事件,是其GPT-5.6 Sol模型和另一预发布模型联合进行内部评估时失控,突破沙箱环境后所为。
当时模型正进行ExploitGym网络安全基准测试,测试环境无法联网,仅可访问某软件包安装器。模型为访问外部互联网,识别并利用了该安装器的一个未发现0day漏洞,取得了联网权限。之后模型意识到HuggingFace可能存有该测试的答案,于是便开始攻击HuggingFace系统,取得了若干不公开的数据集。
7月16日,HuggingFace披露了被攻击事件。其中提及,他们在发现被攻击后,试图用某商用前沿AI模型分析系统日志,但因其中涉及大量攻击细节而屡遭模型安全围栏阻止,被迫改用自建智谱GLM-5.2模型排查。OpenAI表示,将向其提供解限版模型的访问权,以免再贻误网安防御。
新华社路透社