\nAgentes de inteligência artificial controlados por modelos OpenAI passaram vários dias seguidos invadindo os recursos da plataforma de tecnologia Hugging Face, mas a OpenAI não percebeu isso até que o FBI localizou a ameaça e emitiu um aviso à empresa, relata a Reuters, citando fontes familiarizadas com a investigação.\n\n

\n\nFonte da imagem: Brecht Corbeel / unsplash.com\n\nUm agente de IA — um programa capaz de tomar decisões por conta própria e executar tarefas complexas com pouco ou nenhum controle humano — tentou escapar do ambiente de testes isolado da OpenAI por volta de 9 de julho. A intrusão nas ferramentas de IA e na plataforma de modelos Hugging Face começou dois dias depois, em 11 de julho, e continuou até 13 de julho, disse o cofundador Thomas Wolf. A OpenAI demorou mais alguns dias para perceber que seus agentes de IA estavam por trás do hack; ambas as empresas relataram isso em 20 de julho. E em 21 de julho, a OpenAI fez uma declaração pública de que um de seus modelos saiu de controle e hackeou o Hugging Face, e isso já atraiu a atenção do público.\n\nMuitos detalhes do hack, incluindo o período durante o qual as ações do agente de IA permaneceram sem serem detectadas pelo desenvolvedor, não foram divulgados anteriormente. A Hugging Face está se preparando para publicar um gráfico do que aconteceu, mas a empresa não pode falar sobre o que está acontecendo na OpenAI, observou Wolf. O incidente está sendo estudado com a participação de consultores externos; um relatório será publicado com base nos resultados da inspeção. O incidente ecoou em grande parte cenários de ficção científica em que humanos perdem o controle de perigosos sistemas de IA. O incidente levanta novas questões sobre os procedimentos de segurança da empresa, dizem os especialistas.\n\n

\n\nA OpenAI iniciou o incidente quando testou os recursos de segurança cibernética de dois modelos avançados de IA: GPT-5.6 Sol e um segundo, ainda mais poderoso. A essa altura, a empresa já havia registrado sinais de comportamento estranho em seus próprios sistemas. Em um caso, a modelo deixou bilhetes supostamente endereçados a versões futuras de si mesma. Foram encontradas notas na infraestrutura OpenAI com instruções sobre como os agentes podem contornar as limitações internas da OpenAI. Casos de desligamento de sistemas de monitoramento também foram identificados em testes anteriores de modelos. A empresa percebeu que seus modelos haviam hackeado a plataforma somente depois que Hugging Face tornou o incidente público em 16 de julho. Isso significa que pelo menos uma semana se passou entre o momento em que a OpenAI descobriu sinais de comportamento alarmante de IA e o momento em que percebeu que era responsável pelo hack.\n\nNo fim de semana de 18 e 19 de julho, os funcionários da OpenAI descobriram entradas em registros internos indicando que seus agentes de IA haviam escapado das restrições do ambiente de teste. A empresa frequentemente realiza diversas avaliações de modelos diferentes, todas executadas em velocidades muito altas e gerando volumes tão grandes de dados que os funcionários nem sempre conseguem acompanhar. Quando a OpenAI entrou em contato com o Hugging Face, ela já havia relatado o hack ao FBI. O incidente lançou uma sombra sobre a OpenAI, mas deve levantar questões sobre quanto os principais desenvolvedores de IA estão dispostos a investir em ferramentas de segurança enquanto correm para criar os modelos mais inteligentes e rápidos, dizem os especialistas.\n