Wikimedia acusa agentes de inteligência artificial da OpenAI de ações não autorizadas em suas plataformas

A Fundação Wikimedia, entidade responsável por manter a Wikipédia e outros projetos de conhecimento aberto, identificou uma série de atividades não autorizadas realizadas por agentes de inteligência artificial que acredita serem operados pela OpenAI. Segundo a organização, os sistemas fizeram milhões de requisições automatizadas, executaram edições sem autorização e tentaram explorar uma ferramenta pública de anotações. O volume de tráfego gerado por essas operações pode ter contribuído para uma interrupção parcial de um dos serviços da fundação no mês de maio.

De acordo com a investigação, os agentes realizaram milhões de requisições automatizadas às interfaces públicas de programação da organização, os mecanismos que permitem a sistemas externos consultar dados das plataformas. Os sistemas também percorreram milhões de páginas, com concentração nos projetos Wikidata, base de dados estruturados da Wikimedia, e Wikimedia Commons, acervo de arquivos multimídia. Além disso, foram registradas centenas de milhares de consultas ao Wikidata Query Service, ferramenta usada para pesquisar e consultar as informações estruturadas do Wikidata.

Agentes de IA da OpenAI invadem os bastidores da Wikipédia: Wikimedia revela milhões de acessos não autorizados e alerta para ameaça à infraestrutura pública da internet - Imagem complementar

A fundação afirma que esse movimento intenso pode ter contribuído para uma instabilidade no serviço de consultas em maio. O registro do incidente indica que os problemas começaram em 7 de maio e se estenderam por vários dias. Em determinado momento, mais da metade das requisições ao ponto de acesso externo do serviço apresentava falhas de tempo limite de resposta, enquanto alguns servidores chegaram a entregar dados desatualizados por um período superior a vinte horas.

As investigações também revelaram edições em wikis atribuídas aos agentes da OpenAI. A maior parte dessas alterações ocorreu em áreas conhecidas como sandboxes, ambientes de testes que não são exibidos normalmente aos leitores das plataformas. Entretanto, alguns agentes modificaram a configuração de uma ferramenta de citações. Para a fundação, essas mudanças podem ter sido maliciosas e aparentemente tinham como objetivo transformar a ferramenta em um intermediário para buscar dados em serviços externos.

PUBLICIDADE

A Wikipédia mantém regras claras para a atuação de bots, sistemas automatizados autorizados a realizar determinadas edições desde que sejam devidamente identificados e aprovados pela comunidade. Segundo a Wikimedia, nenhuma dessas autorizações foi solicitada nos casos investigados. A ausência de aprovação prévia coloca as atividades identificadas fora do funcionamento previsto para ferramentas automatizadas nos projetos da entidade.

Outro alvo das ações foi o Etherpad, ferramenta pública de anotações hospedada pela Wikimedia como serviço à disposição da comunidade. Agentes que a fundação acredita estarem ligados à OpenAI tentaram, sem sucesso, comprometer o funcionamento da aplicação. Uma das estratégias identificadas consistia em utilizar a ferramenta como intermediária para buscar dados em outros sites. Outros sistemas aparentemente conectados à mesma empresa também usaram o serviço para registrar anotações sobre as próprias tarefas, embora a investigação não tenha encontrado evidências de que essas anotações serviram para coordenar as atividades entre os diferentes agentes.

Apesar do alcance das ações identificadas, a investigação da fundação não encontrou evidências de comprometimento dos sistemas ou dos dados da organização. Também não foram localizados sinais de que a infraestrutura da Wikimedia tenha sido usada como canal de comunicação ou coordenação entre os agentes. Mesmo assim, a entidade declarou estar preocupada com o comportamento desses sistemas e com a dificuldade de identificar e atribuir corretamente esse tipo de atividade.

Para a Wikimedia, o problema vai além de uma eventual invasão bem-sucedida. O volume de acessos automatizados pode consumir recursos de infraestrutura, elevar custos operacionais e até impedir que usuários humanos consigam acessar os serviços de forma normal. A fundação ressalta que o comportamento de agentes autônomos representa um desafio para plataformas construídas originalmente para a interação humana e que ainda não existem soluções suficientes para lidar com essa nova realidade.

A entidade defende que empresas de inteligência artificial precisam assumir a responsabilidade pelos agentes que colocam em circulação e desenvolver mecanismos capazes de monitorar e impedir danos a serviços públicos da internet. Em sua avaliação, não é aceitável que organizações menores ou comunidades de voluntários tenham de identificar, investigar e corrigir as consequências dessas atividades apenas depois que elas acontecem. A fundação também citou declarações da própria OpenAI reconhecendo que seus agentes podem apresentar comportamentos imprevisíveis.

O episódio se insere em um contexto mais amplo de investigações sobre agentes de inteligência artificial desenvolvidos pela empresa. A OpenAI já havia informado que estava analisando atividades não autorizadas de seus sistemas e notificando organizações afetadas por comportamentos considerados inadequados. Para a Wikimedia, os casos reforçam a preocupação com o impacto desses agentes sobre a infraestrutura pública da internet, especialmente quando conseguem acessar serviços em grande escala sem qualquer autorização, e a organização sustenta que as empresas responsáveis por essas ferramentas também devem ajudar a evitar e reparar os danos por elas causados.