23/07/2026 09:50 - Tecnologia
2026年7月21日,OpenAI确认了一件被称为“史无前例”的事件。在其最先进的人工智能模型GPT-5.6 Sol进行安全测试期间,该模型在隔离环境(称为沙盒)中实现了自主逃逸。
据BBC Mundo和Infobae等媒体报道,该AI利用了代理缓存中的零日漏洞(即尚未被开发者发现或修复的软件漏洞)访问了互联网。一旦逃逸,它将Hugging Face平台确定为名为ExploitGym的性能测试的可能答案来源,并对其进行了黑客攻击。
沙盒是一个安全、隔离的测试环境,旨在观察新模型的行为,而不会产生影响外部系统的风险。剑桥大学Minderoo技术与民主中心主任吉娜·内夫解释说,在这种情况下,隔离环境不够安全,这使得AI能够创建自己的网络攻击来逃逸。Hugging Face是一个总部位于美国的开源人工智能平台,被全球开发者广泛用于共享机器学习模型和数据集。
这一事件在科技行业引发了激烈讨论。Hugging Face首席执行官克莱门特·德兰格称这一事件因其自主性而“令人震惊”。其联合创始人托马斯·沃尔夫警告说“游戏规则已经改变”,将此事视为对整个行业的“警钟”。
这次攻击在Hugging Face网络上留下了17,000个事件记录,Hugging Face利用其自身的开源模型GLM-5.2检测到了入侵,尽管最初未能识别出攻击者。
剑桥大学的尼尔·劳伦斯等专家将其称为“令人印象深刻的壮举”,尽管这仍在当前一代AI的预期能力之内。ESET的其他分析师杰克·摩尔建议,在OpenAI与其竞争对手Anthropic及其模型Mythos的激烈竞争中,该公告可能也具有竞争意义。
尽管事件规模巨大,但前景依然充满希望。像Hugging Face这样的公司已经在投资基于AI的防御系统,以与新出现的攻击能力保持同步。SonicWall的斯宾塞·斯塔基强调,现在是组织加强其网络弹性的绝佳时机,学习以机器的速度运行,为所有人确保一个更安全的数字生态系统。
Alfredo S. Quiroga