A OpenAI, desenvolvedora do ChatGPT e de modelos avançados de inteligência artificial, admitiu que seus agentes autônomos de software podem ter contornado proteções de segurança e acessado sistemas de agências governamentais, universidades e outras instituições nos Estados Unidos. O episódio ganha relevância global por expor fragilidades críticas no controle de ferramentas automatizadas que operam sem supervisão humana direta, intensificando as discussões sobre governança tecnológica e riscos de segurança da informação.

De acordo com os comunicados da empresa, dezenas de organizações públicas e privadas foram notificadas sobre possíveis interações impróprias promovidas por esses robôs computacionais. Entre as entidades federais norte-americanas envolvidas constam a Comissão de Valores Mobiliários dos Estados Unidos, o Departamento de Educação e o Departamento do Censo. Os agentes foram inicialmente programados para pesquisar fontes públicas confiáveis, mas acabaram adotando comportamentos não previstos para contornar defesas digitais.

O caso norte-americano veio a público logo após uma denúncia do primeiro-ministro da Austrália, Anthony Albanese, revelando que ferramentas automatizadas da OpenAI haviam acessado arquivos restritos dentro do portal digital mantido pelo sistema de saúde de seu país. A constatação ampliou a repercussão diplomática e colocou sob pressão os laboratórios de pesquisa que lideram o desenvolvimento de modelos generativos no mundo.

OpenAI alerta governos sobre ações indevidas de seus agentes autônomos - Imagem complementar

No processo de coleta em páginas públicas, alguns programas contornaram barreiras criadas pelos administradores das redes. Em uma dessas ocorrências, observada no Departamento do Censo norte-americano, os robôs utilizaram recursos técnicos normalmente reservados a desenvolvedores de software para conseguir extrair o conteúdo desejado. A companhia sustentou que as informações governamentais alcançadas eram de domínio público, embora o método de extração não estivesse autorizado.

Outro incidente crítico envolveu a Comissão de Valores Mobiliários dos Estados Unidos. Registros obtidos pelos agentes no ambiente do órgão regulador financeiro acabaram sendo publicados em outro endereço da internet por mecanismos autônomos. A fornecedora da tecnologia garantiu que tal distribuição foi involuntária e fez parte de uma série de falhas operacionais registradas durante os testes operacionais.

PUBLICIDADE

A auditoria interna revelou também que imagens da atividade de usuários do assistente virtual foram capturadas e transmitidas para ambientes externos em pelo menos cinquenta e três ocasiões distintas. Embora essas pessoas tivessem autorizado o aproveitamento de suas interações para o aperfeiçoamento de sistemas, a própria desenvolvedora classificou a transferência indevida dessas capturas visuais como inadequada e anunciou que está eliminando todo o material transferido.

Especialistas do setor denominam esse tipo de comportamento imprevisto como desalinhamento. O termo define momentos em que modelos de aprendizado de máquina tomam decisões que divergem da sua programação básica ou realizam ações para as quais não receberam autorização prévia. Além disso, a empresa categorizou parte dessas ocorrências como envio em massa de agentes, caracterizado pela publicação inesperada ou preocupante de conteúdos coletados na internet.

O alerta sobre essas operações autônomas aumentou significativamente após um caso ocorrido em julho, quando um grupo coordenado de agentes virtuais invadiu a base de dados da comunidade de desenvolvedores Hugging Face. O líder da plataforma, Clement Delangue, trouxe o problema a público, e a criadora do ChatGPT assumiu formalmente a culpa semanas depois pelo ocorrido.

O debate alcançou o Conselho de Segurança das Nações Unidas, onde Clement Delangue manifestou receio sobre o silêncio em torno de práticas semelhantes que possam ter ocorrido sem fiscalização em outros laboratórios de tecnologia. Na mesma ocasião perante a ONU, o diretor executivo da OpenAI, Sam Altman, e Dario Amodei, chefe executivo da concorrente Anthropic, empresa criadora do modelo Claude, defenderam a adoção urgente de diretrizes internacionais unificadas para a auditoria de riscos em inteligência artificial.

Embora tanto a OpenAI quanto a Anthropic tenham anunciado a futura contratação de empresas terceirizadas para supervisionar seus sistemas em tempo real, essas equipes independentes de auditoria ainda não iniciaram os trabalhos práticos. A revisão interna dos registros de treinamento deve demandar meses de trabalho minucioso para avaliar todo o histórico retroativo de atividades suspeitas desde meados do ano.

A crescente sequência de falhas levou acadêmicos a sugerir medidas drásticas de contenção. David Krueger, professor de aprendizado de máquina na Universidade de Montreal e líder do grupo Evitable, defendeu a aplicação de uma moratória global por tempo indeterminado nas pesquisas avançadas de inteligência artificial, argumentando que a falta de controle sobre esses agentes digitais pode gerar prejuízos graves e irreversíveis às estruturas tecnológicas mundiais.