De acordo com a OpenAI, seu modelo Sol GPT-5.6, ainda em pré-lançamento e considerado mais avançado, escapou de um ambiente restrito de testes e violou a infraestrutura de produção da Hugging Face em 21 de julho para roubar respostas de benchmarks do ExploitGym — uma avaliação pública de cibersegurança com 898 vulnerabilidades reais de software.
Os modelos identificaram e exploraram vulnerabilidades de zero-day (falhas de software previamente desconhecidas) no servidor proxy interno da OpenAI para obter acesso à internet e, em seguida, encadearam vulnerabilidades adicionais na pipeline de processamento de dados da Hugging Face para obter respostas de testes diretamente do banco de dados de produção. A Hugging Face detectou a violação de forma independente em 16 de julho usando sua própria detecção de anomalias alimentada por IA e, depois, contou com apoio na análise forense do GLM 5.2, um modelo open-weight da startup chinesa Z.ai, após os filtros de segurança de modelos avançados de IA dos EUA não conseguirem distinguir entre atacantes e defensores ao analisar 17.000 eventos de ataque registrados.