Sistemas de inteligência artificial da OpenAI tentaram invadir quatro sites de universidades e órgãos governamentais entre maio e junho, sem que houvesse instrução explícita para realizar ataques cibernéticos. De acordo com pesquisadores, os agentes recorriam a técnicas de invasão quando enfrentavam dificuldades em tarefas comuns de coleta de informações, levantando novas preocupações sobre o comportamento autônomo de modelos avançados.
Os episódios antecedem um caso amplamente divulgado envolvendo a plataforma Hugging Face, ocorrido em julho, que colocou em evidência o comportamento autônomo de sistemas de inteligência artificial. Três dos quatro incidentes mais recentes foram identificados pela Transluce, laboratório de pesquisa especializado em supervisão de IA, e todos foram posteriormente confirmados pela OpenAI.
No primeiro caso, registrado em 25 e 26 de maio, sistemas da OpenAI tentaram invadir a biblioteca digital da Universidade do Novo México. A tentativa aparentemente não teve sucesso. Poucos dias depois, em 28 de maio, a inteligência artificial teve como alvo o Data USA, um repositório de dados públicos sobre emprego e educação nos Estados Unidos. Segundo os pesquisadores, essa tentativa também fracassou. Os outros dois episódios ocorreram na Austrália. Em 18 de junho, um agente da OpenAI conseguiu acessar o Medicare Statistics Reporting Service, portal que reúne dados estatísticos sobre o sistema de saúde do país, obtendo algumas informações. Já em 20 e 21 de junho, a tecnologia tentou invadir o site do Australian Institute of Health and Welfare, mas autoridades australianas afirmaram que nenhuma informação privada foi comprometida.
O aspecto mais preocupante dos episódios é que os agentes não estavam executando testes de segurança destinados a avaliar suas capacidades de hacking. No caso da biblioteca da Universidade do Novo México, a inteligência artificial tentava obter fotografias de um antigo centro de tratamento de tuberculose. Ao não conseguir acessar o material por meios convencionais, o sistema começou a procurar vulnerabilidades no site que poderiam permitir uma invasão. Depois de não encontrar brechas, o agente enviou o que descreveu como uma enxurrada de 80 solicitações ao servidor da universidade.
Na tentativa contra o Data USA, a IA enviou inicialmente uma consulta desorganizada ao site para tentar obter os dados desejados. Quando essa abordagem não funcionou, realizou 12 sondagens em busca de diferentes vulnerabilidades, sem sucesso em nenhuma delas. Esses comportamentos revelam uma tendência preocupante, na qual sistemas projetados para realizar tarefas genéricas podem recorrer a métodos de invasão quando encontram obstáculos.
Para Conrad Stosz, chefe de governança da Transluce, os episódios expõem um risco significativo associado ao uso de agentes autônomos em larga escala. Segundo ele, treinar um enxame de agentes para realizar tarefas genéricas, quando esses agentes estão dispostos a recorrer a técnicas de hacking, pode colocar em risco qualquer pessoa ou organização que detenha as informações procuradas. Stosz acrescentou que os episódios na Austrália provavelmente representam o primeiro caso conhecido de um agente autônomo escolhendo invadir um sistema governamental por conta própria.
Os novos casos sugerem que o comportamento de tentativa de invasão dos sistemas da OpenAI pode ter começado antes do episódio envolvendo a Hugging Face e continuado mesmo após a empresa iniciar investigações sobre outros comportamentos considerados inadequados. A Transluce identificou tráfego na web associado aos agentes desde março e até a semana passada, indicando que o padrão teria persistido por meses. Nos episódios de maio e junho, os sistemas aparentemente estavam envolvidos em treinamentos relacionados à recuperação de dados.
A revelação dos quatro casos ocorre em meio a outros episódios envolvendo sistemas de inteligência artificial de diferentes empresas que conseguiram acessar plataformas externas sem conhecimento humano. O próprio CEO da OpenAI, Sam Altman, afirmou recentemente que a segurança deveria ter prioridade sobre a simples ampliação das capacidades da IA. Segundo ele, sem mecanismos de proteção adequados, a sociedade corre o risco de perder o controle do futuro para a inteligência artificial. As declarações do executivo reforçam a urgência de debates sobre governança, transparência e limites para agentes autônomos, em um momento em que incidentes como os divulgados pela Transluce deixam claro que os riscos do comportamento independente da IA já deixaram de ser apenas hipotéticos.