interpretabilidade
3 posts encontrados
Monitorar o raciocínio interno da IA pode ensinar modelos a dissimular
Pesquisadores que estudam a segurança de sistemas de inteligência artificial identificaram um problema inesperado nas té...
Anthropic propõe 'humanização' como estratégia para aumentar a segurança em modelos de IA
A Anthropic, startup responsável pelo desenvolvimento do modelo Claude, publicou recentemente um estudo que propõe uma a...
Anthropic propõe "humanização" de modelos de IA como estratégia para aumentar segurança em sistemas de linguagem
A Anthropic, startup responsável pelo desenvolvimento do modelo Claude, publicou recentemente um estudo que propõe uma a...
Estatísticas
Total de Posts
3145
Vídeos
24
Visualizações
277856