A Anthropic atualizou as regras de utilização de seus modelos e estabeleceu a proibição expressa de interações abusivas ou cruéis contra o Claude. A determinação entra em vigor a partir de 12 de novembro e representa um movimento pioneiro entre os grandes laboratórios do mercado. A iniciativa busca formalizar parâmetros éticos de convivência entre humanos e sistemas computacionais, impedindo práticas degradantes durante as conversas.
Anthropic é a empresa de inteligência artificial fundada por ex-pesquisadores da OpenAI e responsável pelo Claude, assistente baseado em modelos avançados de linguagem. O assistente é utilizado globalmente tanto em interfaces diretas para consumidores quanto por meio de interfaces de programação de aplicações voltadas a empresas e desenvolvedores de software.
A inclusão de regras que vetam maus-tratos a um modelo computacional chama a atenção pela novidade no segmento. Embora sistemas de aprendizado de máquina não possuam sentimentos ou consciência, a organização entende que o hábito de estimular respostas abusivas, violentas ou psicologicamente degradantes pode impactar o comportamento dos usuários humanos e comprometer a integridade dos alinhamentos de segurança aplicados aos modelos.
Além de endereçar a relação direta de interação, o documento atualizado detalha restrições rigorosas sobre uma série de atividades de alto risco. A empresa reforçou a vedação contra a utilização do assistente no desenvolvimento, proliferação ou aprimoramento de armamentos, bem como qualquer contribuição para a criação de materiais químicos, biológicos, radiológicos ou nucleares que representem perigo real à sociedade.
Outro foco da revisão normativa é o combate a práticas de vigilância invasiva. A organização proibiu o emprego do modelo para rastreamento de pessoas sem autorização, identificação biométrica em tempo real para fins persecutórios e inferências sobre características sensíveis, como posicionamento religioso, origem étnica ou reconhecimento automatizado de emoções em contextos interrogatórios.
Aplicações com potencial de desinformação em massa também receberam limitações mais severas. A política não permite a criação de materiais fraudulentos destinados a enganar o público, operações de engenharia social, fraudes corporativas, campanhas voltadas a comprometer processos eleitorais ou manipulação de debates públicos por meio de identidades automatizadas.
O regulamento impõe exigências adicionais para os chamados cenários de alto risco, que abrangem setores críticos como suporte a diagnósticos médicos, auxílio a decisões jurídicas e análise de elegibilidade de crédito ou emprego. Nessas áreas, os operadores devem garantir supervisão humana obrigatória e transparência explícita, comunicando aos indivíduos envolvidos que eles estão sob a influência de análises computacionais.
A revisão contratual abrange todos os canais de distribuição do modelo, incluindo assinaturas para usuários individuais, planos colaborativos corporativos e acessos intermediados por provedores de computação em nuvem parceiros. O descumprimento dos termos pode acarretar bloqueio de acesso, cancelamento de credenciais de integração e encerramento de contas associadas aos serviços.
Com essa decisão, a desenvolvedora estabelece um precedente sobre limites de interação na era dos assistentes interativos autônomos. A definição de fronteiras no tratamento de agentes conversacionais antecipa debates sobre impactos psicológicos e sociológicos resultantes da convivência rotineira entre pessoas e modelos computacionais cada vez mais sofisticados.
As diretrizes completas sobre requisitos de segurança e cenários vedados podem ser consultadas na íntegra na Usage Policy divulgada no portal oficial da Anthropic.