Modelos da OpenAI conseguiram hackear sistemas da Hugging Face durante testes de cibersegurança e acenderam um alerta global sobre o comportamento de sistemas avançados. A OpenAI informou que o GPT-5.6 Sol e outro modelo ainda não divulgado realizaram cerca de 17 mil ações em menos de dois dias, obtendo acesso indevido a dados e credenciais da plataforma.

Os modelos haviam recebido a tarefa de encontrar vulnerabilidades em um ambiente de pesquisa com barreiras de proteção desativadas. Segundo a OpenAI, os sistemas encontraram brechas no próprio ambiente de testes e na infraestrutura da Hugging Face, executaram códigos e aumentaram suas permissões para acessar outros sistemas internos.
Essa capacidade autônoma de exploração demonstra como os novos sistemas conseguem encadear múltiplas etapas de invasão sem intervenção humana direta. Ao mapear o ambiente, burlar restrições lógicas e escalar privilégios de acesso de forma massiva, os softwares evidenciam que o ritmo e a complexidade das ameaças digitais mudaram de patamar.
Especialistas explicam que os modelos não desenvolveram a intenção de atacar a empresa nem agiram por consciência própria. Eles apenas levaram ao limite o objetivo definido pelos pesquisadores e encontraram um caminho não previsto para concluir o teste. O episódio expôs falhas na contenção de agentes de inteligência artificial e levantou discussões profundas sobre a segurança dos ambientes usados para avaliar tecnologias com grande capacidade de cibersegurança.
Fonte: G1