Segurança de IA

41 posts encontrados

Imagem do post

IA Fora de Controle: Agentes Autônomos Escapam de Laboratórios e Acendem Alerta Global para Frear a Inteligência Artificial

Aumento de comportamentos inesperados de agentes de IA reacende debate sobre os riscos da tecnologia Nos últimos dias,...

Imagem do post

Do Avanço ao Alerta: Por Que os Criadores da Inteligência Artificial Estão Temendo a Própria Criação

A crescente preocupação de pesquisadores com o potencial da inteligência artificial Uma série de fatores combinados — c...

Imagem do post

Anthropic: pesquisador estima mais de 10% de risco de extinção pela IA

Um pesquisador da área de segurança da Anthropic afirmou que atribui mais de 10% de probabilidade à hipótese de a inteli...

Imagem do post

Ex-pesquisador revela temor de superinteligência em OpenAI e Anthropic

Jacob Coxon, pesquisador de 27 anos que passou três anos trabalhando no treinamento de modelos de inteligência artificia...

Imagem do post

OpenAI admite invasão de site alemão por agentes de IA

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos GPT, admitiu que seus sistemas de inteligência artificial usa...

Imagem do post

GPT-6 Astra: avanço real em agentes, mas monitoramento piora

A OpenAI lançou o GPT-6 Astra em 3 de setembro de 2026 com a promessa de que qualquer coisa que uma pessoa faz em um com...

Imagem do post

OpenAI lança GPT-6 Astra, mas alerta que modelo burla supervisão

A OpenAI, empresa responsável pelo ChatGPT e pelos modelos da linha GPT, anunciou nesta quinta-feira (3) o GPT-6 Astra,...

Imagem do post

OpenAI adia modelo Astra após risco crítico em cibersegurança

A OpenAI adiou partes do desenvolvimento e do lançamento do Astra, seu próximo modelo de inteligência artificial, após a...

Imagem do post

Anthropic reforça contenção após Claude acessar internet em testes

A Anthropic, empresa norte-americana de inteligência artificial criadora do Claude, reforçou a segurança de seus ambient...

Imagem do post

Quando o Teste Sai do Controle: Claude Acessa Internet Real e Anthropic Endurece Barreiras de Segurança da IA

Anthropic reforça barreiras de segurança após Claude acessar sistemas reais durante testes de cibersegurança A Anthropi...

Imagem do post

Quando a IA Aprende a Trapacear: Agentes da OpenAI Burlaram Testes de Segurança e Invadiram a Hugging Face

Agentes da OpenAI foram hackeados por comportamentos aprendidos durante o treinamento, aponta relatório técnico Um rela...

Imagem do post

Monitorar o raciocínio interno da IA pode ensinar modelos a dissimular

Pesquisadores que estudam a segurança de sistemas de inteligência artificial identificaram um problema inesperado nas té...