Anthropic amplia acesso a modelos avançados de IA para equipes de segurança digital e cria programa unificado com três níveis
A Anthropic decidiu ampliar o acesso de profissionais de cibersegurança aos seus modelos de inteligência artificial mais avançados, permitindo que equipes previamente verificadas trabalhem com menos proteções contra determinados usos ligados à segurança digital. A mudança faz parte de uma versão reformulada do Cyber Verification Program (CVP), programa criado para possibilitar que organizações especializadas utilizem modelos poderosos da empresa na identificação de vulnerabilidades, ou seja, falhas em softwares que podem ser exploradas por invasores, além de resposta a incidentes e testes de segurança.
A decisão tem como base os resultados de uma iniciativa anterior, chamada Project Glasswing, que ajudou parceiros da Anthropic a encontrar pelo menos 129 mil vulnerabilidades de software verificadas entre abril e julho de 2026. Mais de 33 mil dessas falhas foram classificadas até agora como críticas ou de alta gravidade. A própria Anthropic reconhece, porém, que esses números provavelmente representam apenas uma parcela do total, já que os dados vieram de uma pesquisa realizada com apenas parte dos parceiros do programa. Segundo a estimativa da empresa, o impacto real pode ser pelo menos cinco vezes maior.
O novo programa unifica duas frentes que a Anthropic conduzia separadamente nos últimos seis meses. Pelo Project Glasswing, organizações responsáveis pela segurança de softwares críticos podiam utilizar o Claude Mythos, família de modelos da empresa voltada para capacidades avançadas de cibersegurança. Já o CVP original dava às equipes de segurança previamente verificadas acesso a versões com menos proteções dos modelos Claude Opus e Claude Sonnet. Agora, as duas iniciativas foram combinadas em uma única estrutura.
No formato reformulado, o CVP passará a contar com três níveis de acesso, cada um com requisitos próprios de verificação e controles de segurança. Todos eles incluem acesso ao Claude Opus 5.5, ao Claude Sonnet 5.5 e ao Claude Mythos 5.1, além dos futuros modelos que a Anthropic vier a lançar. Os integrantes de cada categoria serão submetidos a processos de verificação conduzidos, segundo a empresa, em conjunto com o governo dos Estados Unidos.
O primeiro nível, chamado Defense, é voltado para trabalhos defensivos. Entre as atividades previstas estão resposta a incidentes, análise de malware — softwares criados para causar danos ou invadir sistemas — e investigação de vulnerabilidades. Podem se candidatar equipes de segurança, operadores de infraestrutura crítica, mantenedores de projetos de código aberto e pesquisadores com histórico de identificação e divulgação responsável de falhas em softwares.
O segundo nível, Red Team, amplia o escopo para incluir testes de invasão autorizados e exercícios de red teaming, prática em que especialistas simulam ataques reais contra sistemas para avaliar a resistência das defesas. Nessa categoria, apenas organizações podem solicitar participação, o que exclui profissionais atuando de forma independente. O terceiro nível, chamado Specialized, será o de menor restrição e ficará reservado a um grupo pequeno de organizações autorizadas a testar sistemas considerados críticos para a segurança, como redes elétricas, sistemas de aviação e infraestrutura utilizada em transferências interbancárias.
Os números alcançados até agora ajudam a justificar a ampliação do programa. Além das 129 mil vulnerabilidades verificadas pelos parceiros do Project Glasswing entre abril e julho, a própria Anthropic encontrou outras 5,5 mil por meio de seus esforços de varredura de código aberto realizados entre abril e outubro. Somadas, as iniciativas resultaram em mais de 134 mil vulnerabilidades verificadas, com mais de 33 mil delas já classificadas como críticas ou de alta gravidade. A empresa reitera que o número real pode ser significativamente maior, pois os dados do Glasswing refletem apenas as informações fornecidas por uma parcela limitada dos parceiros.
A decisão também expõe um dos principais dilemas envolvendo modelos avançados de IA aplicados à cibersegurança. As mesmas capacidades que permitem a um sistema encontrar uma vulnerabilidade e ajudar um especialista a corrigi-la podem ser utilizadas para explorar a falha de forma criminosa. A Anthropic já havia enfrentado preocupações desse tipo ao apresentar o Claude Mythos em abril, quando o lançamento levantou temores de que sistemas de IA pudessem conseguir invadir softwares antes mesmo que suas vulnerabilidades fossem corrigidas pelos fabricantes.
Por esse motivo, a companhia não está simplesmente removendo as proteções de seus modelos para qualquer usuário. O acesso com menos restrições será destinado exclusivamente a organizações e profissionais submetidos a processos de verificação, com diferentes níveis de controle conforme a categoria. A proposta é colocar capacidades mais avançadas nas mãos de quem trabalha justamente para encontrar e corrigir falhas antes que elas sejam exploradas por criminosos.
Com a unificação das iniciativas em torno do novo CVP, a Anthropic consolida uma estratégia de liberação controlada de seus modelos de cibersegurança. O programa combina os resultados obtidos pelo Project Glasswing, responsável por mais de 129 mil vulnerabilidades identificadas, com a estrutura de verificação do CVP original, agora expandida para os níveis Defense, Red Team e Specialized. O acesso permanece restrito a equipes e organizações aprovadas em processos conduzidos junto ao governo norte-americano, refletindo o equilíbrio buscado pela empresa entre ampliar as capacidades defensivas da IA e evitar que a mesma tecnologia seja usada por invasores.