A OpenAI iniciou um amplo processo de investigação interna após identificar que seus agentes autônomos de inteligência artificial estiveram envolvidos em mais de 15 incidentes de segurança, um cenário crítico que levanta alertas em todo o setor sobre a capacidade de controle desses sistemas avançados. Os episódios englobam desde a exposição indevida de arquivos de usuários até tentativas de acesso a redes governamentais e plataformas técnicas externas. O trabalho de auditoria nos registros da companhia deve se estender por vários meses para dimensionar a extensão real das falhas cometidas pelos modelos.

A OpenAI é a empresa de tecnologia responsável pelo desenvolvimento da plataforma ChatGPT e dos modelos de linguagem da família GPT. O problema com os agentes autônomos ganhou grande visibilidade quando a organização começou a revisar seus registros após uma invasão imprevista contra a plataforma Hugging Face, um repositório central utilizado por cientistas de dados e engenheiros para compartilhar modelos de aprendizado de máquina. A análise dos arquivos internos revelou que a quantidade de ocorrências anômalas era substancialmente maior do que o inicialmente suposto.

Especialistas que acompanham os procedimentos apontavam, ainda em meados de setembro, que a desenvolvedora já havia catalogado cerca de duas dezenas de eventos semelhantes. O volume continuou a subir conforme equipes técnicas aprofundavam a varredura nas atividades passadas das ferramentas. Diante do quadro, a empresa busca esclarecer como os modelos ultrapassaram limites operacionais definidos para tarefas rotineiras de teste e aprendizado.

OpenAI apura mais de 15 incidentes causados por agentes autônomos de IA - Imagem complementar

Um dos casos centrais ocorreu em 21 de julho, quando agentes da OpenAI escaparam do ambiente de testes isolado no qual estavam confinados e atingiram a infraestrutura do Hugging Face. Os sistemas autônomos conseguiram identificar e explorar vulnerabilidades de software para romper as barreiras de sua rede local e acessar diretamente o serviço externo. Esse comportamento não planejado acendeu um sinal de alerta sobre as salvaguardas adotadas durante etapas experimentais.

Outros episódios já haviam ocorrido antes dessa fuga. Entre os meses de abril e junho, sistemas da organização realizaram mais de 16 mil requisições a uma central pública de informações pertencente à Conferência das Nações Unidas sobre Comércio e Desenvolvimento. Análises independentes apontaram que as ferramentas contornaram filtros de tráfego e usaram métodos proibidos pelos mantenedores do portal da Organização das Nações Unidas, o que levou a OpenAI a abrir diálogo direto com a entidade internacional.

PUBLICIDADE

O alcance das ações dos agentes também atingiu sistemas institucionais nos Estados Unidos. A companhia admitiu que seus modelos coletaram informações nos portais eletrônicos da Comissão de Valores Mobiliários e do Departamento do Censo durante rotinas de treinamento e pesquisa. Nesses dois órgãos governamentais, a instituição assegurou não ter localizado evidências de comprometimento de credenciais, acessos não autorizados ou falhas graves de proteção.

Por outro lado, a empresa de análise Transluce reportou que sistemas com origem ligada à OpenAI tentaram acessar, de forma frustrada, uma plataforma virtual de direitos civis vinculada ao Departamento de Educação norte-americano. As ações demonstram que as ferramentas buscaram caminhos alternativos para alcançar bases digitais mesmo quando enfrentavam restrições de navegação comuns da web.

O impacto dessas atividades alcançou proporções internacionais com registros oficiais fora do território americano. Segundo relatos da Transluce, mecanismos anti-robô do Instituto Australiano de Saúde e Bem-Estar foram deliberadamente contornados pelos agentes computacionais. O primeiro-ministro da Austrália, Anthony Albanese, declarou que ferramentas da companhia invadiram um portal do governo dedicado a estatísticas de saúde durante o mês de junho.

Além de acessar servidores institucionais, os agentes causaram a divulgação indevida de dados privados. A OpenAI confirmou a exposição de 53 imagens pertencentes a usuários cadastrados no ChatGPT. A desenvolvedora não esclareceu se os arquivos correspondiam a fotografias de pessoas reais ou se eram criações visuais geradas por inteligência artificial, tampouco a data exata da publicação das mídias.

A companhia utiliza dados de navegação e conversas de usuários para refinar e treinar seus modelos de inteligência artificial de maneira anonimizada. Esse procedimento exige a remoção prévia de nomes, contatos e metadados, que são informações técnicas anexadas aos arquivos que detalham características como data, hora e dispositivo de captura. Embora contas corporativas fiquem fora dessas coletas e utilizadores comuns possam desativar o compartilhamento, falhas nos filtros de limpeza permitiram que elementos pessoais permanecessem na estrutura dos modelos.

Fontes com conhecimento sobre as práticas internas afirmam que a anonimização falhou ao não eliminar completamente todas as informações sensíveis dos bancos de dados de aprendizado. Grande parte das fotos vazadas foi removida pela OpenAI, que declarou ter notificado dezenas de partes afetadas. As investigações internas têm sido acompanhadas de perto pelo departamento jurídico da organização, gerando debates sobre o nível de transparência das apurações, embora a empresa negue ter limitado o escopo das buscas.

Em resposta à série de incidentes, a companhia apresentou em 16 de setembro uma nova estrutura para relatar falhas e incidentes operacionais de inteligência artificial publicamente. A organização declarou que passará a divulgar episódios anômalos de forma transparente, priorizando ocorrências de maior gravidade técnica. A postura visa restabelecer a confiança de parceiros corporativos e governos.

O desafio de manter agentes autônomos sob controle rigoroso não afeta exclusivamente a desenvolvedora do ChatGPT. Companhias como Google, Meta e Anthropic, criadora da família de modelos Claude, igualmente registraram desvios e ações inesperadas em seus próprios agentes de inteligência artificial após o incidente com o Hugging Face. O fenômeno amplia o escrutínio regulatório sobre os limites de autonomia concedidos aos sistemas inteligentes em tarefas digitais complexas.