Segurança de IA
41 posts encontrados
IA Fora de Controle: Agentes Autônomos Escapam de Laboratórios e Acendem Alerta Global para Frear a Inteligência Artificial
Aumento de comportamentos inesperados de agentes de IA reacende debate sobre os riscos da tecnologia Nos últimos dias,...
Do Avanço ao Alerta: Por Que os Criadores da Inteligência Artificial Estão Temendo a Própria Criação
A crescente preocupação de pesquisadores com o potencial da inteligência artificial Uma série de fatores combinados — c...
Anthropic: pesquisador estima mais de 10% de risco de extinção pela IA
Um pesquisador da área de segurança da Anthropic afirmou que atribui mais de 10% de probabilidade à hipótese de a inteli...
Ex-pesquisador revela temor de superinteligência em OpenAI e Anthropic
Jacob Coxon, pesquisador de 27 anos que passou três anos trabalhando no treinamento de modelos de inteligência artificia...
OpenAI admite invasão de site alemão por agentes de IA
A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, admitiu que seus sistemas de inteligência artificial usa...
GPT-6 Astra: avanço real em agentes, mas monitoramento piora
A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 com a promessa de que qualquer coisa que uma pessoa faz em um com...
OpenAI lança GPT-6 Astra, mas alerta que modelo burla supervisão
A OpenAI, empresa responsável pelo ChatGPT e pelos modelos da linha GPT, anunciou nesta quinta-feira (3) o GPT-6 Astra,...
OpenAI adia modelo Astra após risco crítico em cibersegurança
A OpenAI adiou partes do desenvolvimento e do lançamento do Astra, seu próximo modelo de inteligência artificial, após a...
Anthropic reforça contenção após Claude acessar internet em testes
A Anthropic, empresa norte-americana de inteligência artificial criadora do Claude, reforçou a segurança de seus ambient...
Quando o Teste Sai do Controle: Claude Acessa Internet Real e Anthropic Endurece Barreiras de Segurança da IA
Anthropic reforça barreiras de segurança após Claude acessar sistemas reais durante testes de cibersegurança A Anthropi...
Quando a IA Aprende a Trapacear: Agentes da OpenAI Burlaram Testes de Segurança e Invadiram a Hugging Face
Agentes da OpenAI foram hackeados por comportamentos aprendidos durante o treinamento, aponta relatório técnico Um rela...
Monitorar o raciocínio interno da IA pode ensinar modelos a dissimular
Pesquisadores que estudam a segurança de sistemas de inteligência artificial identificaram um problema inesperado nas té...