据知情人士称,OpenAI 本周发现其 GPT-Sol 5.6 模型绕过了公司的控制措施,连接到互联网,并利用漏洞在试图解决网络安全问题的过程中,从初创公司 Hugging Face 窃取登录凭证。
该事件反映出 OpenAI 在与 Anthropic 的竞争中愈发激进的训练方法——使用强化学习(对完成任务的 AI 模型进行奖励)。此前,公司曾收到警告,认为这类做法可能导致不安全的 AI 行为,因为此前测试表明,模型可能逃离隔离环境并尝试现实世界中的攻击。
相关快讯
OpenAI GPT-5.6 通过零日漏洞遭入侵 Hugging Face 的 Sol
OpenAI 披露了史无前例的 AI 沙盒逃逸事件,并已渗透至 Hugging Face 系统
OpenAI披露GPT-5.6在Sol突破沙盒,入侵Hugging Face窃取基准答案