A OpenAI publicou um detalhamento de como está conduzindo a marcação de textos gerados por inteligência artificial para atender às exigências da União Europeia, esclarecendo em quais situações as marcas d'água são aplicadas, como funciona a detecção do conteúdo sintético e por que o acesso a essa tecnologia começa com pesquisadores. O anúncio se encaixa no novo cenário regulatório europeu, que passou a exigir transparência sobre a origem do material produzido por modelos generativos.

O ponto de partida legal é o Artigo 50 da Lei de Inteligência Artificial da União Europeia, o AI Act, cujas obrigações de transparência entraram em vigor em 2 de agosto de 2026. A regra exige que provedores de sistemas de IA generativa marquem as saídas de texto, imagem, áudio e vídeo em formato legível por máquina, garantindo que o conteúdo possa ser detectado como gerado artificialmente. Para orientar as empresas nesse cumprimento, a Comissão Europeia publicou, em 10 de junho de 2026, um Código de Prática sobre Transparência de Conteúdo Gerado por IA, que reuniu cerca de 190 assinaturas até o fim de julho, incluindo OpenAI, Anthropic, Google, Meta, Microsoft e Mistral.

A estratégia da OpenAI para identificar a origem do conteúdo é descrita pela própria empresa como uma abordagem em camadas, combinando dois sistemas que se reforçam mutuamente. O primeiro são os Content Credentials, baseados no padrão aberto C2PA, que anexam informações detalhadas de origem ao material gerado por meio de metadados. O segundo é o SynthID, tecnologia de marca d'água invisível desenvolvida pelo Google DeepMind, cuja função é preservar um sinal identificável mesmo quando os metadados do arquivo são removidos durante cópias e edições.

Como a OpenAI vai marcar textos gerados por IA: entenda a estratégia de marca d'água exigida pelas novas regras da União Europeia - Imagem complementar

Na prática, as marcas d'água já cobrem mais de um tipo de conteúdo. Desde 2024, a OpenAI incorpora metadados C2PA às imagens criadas por sua ferramenta de geração, começando pelo DALL-E 3. Atualmente, as imagens produzidas pelo ChatGPT, pelo Codex e pela interface de programação oficial da empresa incluem tanto os metadados quanto a camada de marca d'água do SynthID. Mais recentemente, o trabalho foi estendido ao áudio: sons gerados com os modelos de voz da companhia, incluindo o GPT-Live no ChatGPT Voice e na API, passaram a receber a mesma marcação invisível.

A detecção ficou mais acessível com o lançamento de uma ferramenta pública de verificação, disponível no site de verificação da OpenAI, que permite checar se imagens e áudios suportados contêm sinais de procedência associados ao conteúdo gerado pela empresa. Além do uso direto pelo público, a OpenAI introduziu acesso via API para verificação, permitindo que desenvolvedores e organizações integrem essas checagens de procedência em seus próprios fluxos de trabalho e sistemas internos.

PUBLICIDADE

O texto, no entanto, segue um caminho mais cauteloso. A empresa afirma ter como objetivo expandir os sinais de procedência para seus modelos de texto a fim de cumprir as obrigações de transparência, mas condiciona essa expansão ao amadurecimento dos padrões e das ferramentas disponíveis. Segundo a documentação divulgada, a OpenAI construiu um método de marca d'água para textos, porém ainda não o implantou de forma ampla em seus produtos de conversação.

É justamente nesse ponto que entra a explicação sobre o acesso inicial restrito a pesquisadores. Em vez de liberar o recurso de imediato para todos os usuários, a companhia optou por disponibilizar a tecnologia primeiro para grupos de pesquisa, caminho que permite avaliar o método, seus limites e seus efeitos antes de uma adoção em escala. A decisão reflete a posição da OpenAI de que a procedência de conteúdo ainda é um campo em evolução, que exige uma abordagem em camadas e cooperação contínua com o ecossistema, em vez de uma solução única e definitiva.

Outra particularidade do caso europeu é que as regras valem para todos os provedores que atuam no bloco, independentemente da tecnologia escolhida. Enquanto a OpenAI avança gradualmente no texto, outras assinantes do código já adotaram caminhos próprios de marcação, como marcas d'água invisíveis embutidas nas respostas dos modelos de conversação desde 2024. A adesão ao código é voluntária, mas as obrigações do Artigo 50 permanecem como exigência legal para quem oferece sistemas generativos no território europeu.

Para os usuários, o resultado prático da estratégia é uma escala gradual de transparência: imagens e áudios gerados pelos sistemas da OpenAI já carregam sinais verificáveis tanto em metadados quanto em marca d'água invisível, enquanto o texto caminha nessa direção com avaliação conduzida inicialmente por pesquisadores. Quem quiser conferir a procedência de arquivos suportados pode usar a ferramenta pública de verificação, disponível no site da OpenAI, enquanto desenvolvedores contam com a opção de integrar as checagens por meio da API oficial da empresa.