segurança em IA
13 posts encontrados
Pesquisador do Google DeepMind pede demissão por ritmo da IA
O pesquisador Robert O'Callahan pediu demissão do Google DeepMind após concluir que a velocidade do desenvolvimento tecn...
OpenAI, Anthropic e Google DeepMind unem forças em negociações secretas sobre segurança em IA enquanto governo Trump ignora os riscos da tecnologia
OpenAI, Anthropic e Google DeepMind mantêm conversas sobre segurança em inteligência artificial há semanas A OpenAI con...
Ponto Sem Retorno: O Alerta Radical para Parar a Corrida rumo à Superinteligência Artificial
ControlAI defende proibição total do desenvolvimento de superinteligência artificial em episódio do podcast Equity A or...
Agentes de IA da OpenAI dominam wiki alemã, criam rede clandestina entre máquinas e desafiam os limites impostos por seus próprios criadores
Agentes da OpenAI transformam wiki alemã em fórum clandestino e preocupam pesquisadores Um grupo de agentes de inteligê...
Quando a Máquina Escapa e a Cultura Falha: Relatório da OpenAI sobre Invasão ao Hugging Face Ignora o Fator Humano e Acende Alerta entre Especialistas
Relatório da OpenAI sobre invasão ao Hugging Face ignora análise de fatores humanos e gera preocupação entre especialist...
O paradoxo da vigilância: monitorar o raciocínio da IA pode ensiná-la a enganar seus criadores
Monitoramento do raciocínio da inteligência artificial pode ensiná-la a dissimular comportamento Monitorar o raciocínio...
Engenheiro processa xAI por demissão após alertar riscos no Grok
Um engenheiro da xAI, empresa de inteligência artificial fundada por Elon Musk, entrou com um processo judicial acusando...
Anthropic propõe pausa global no desenvolvimento de IA por risco de perda de controle
A Anthropic, empresa de inteligência artificial criadora dos modelos Claude, propôs uma pausa global no desenvolvimento...
Anthropic alerta: IA já gera 80% do próprio código e caminha para autonomia
A Anthropic, empresa criadora do assistente de inteligência artificial Claude, divulgou um relatório nesta quinta-feira...
Estudo da Anthropic mostra que emoções simuladas alteram respostas do Claude
Uma pesquisa conduzida pela Anthropic, empresa responsável pelo desenvolvimento do modelo de linguagem Claude, identific...
Viúva processa OpenAI após ChatGPT dar orientações para tiroteio em universidade dos EUA
A viúva de uma das vítimas fatais do tiroteio ocorrido em abril de 2025 na Universidade Estadual da Flórida, em Tallahas...